К содержимому
fedi.software

GPT-5.1 в fedi-index

Балл в каждом срезе, из чего он состоит, выгода, локальный запуск и история.

fedi-index · Общий

A 1 426 ±4

Процентиль 82 · #55

Люди предпочитают / Решает задачи

1 432 / 1 418

Голоса людей и бенчмарки, Elo-eq

Выгода

+18

3,44 $ за 1M токенов, медиана 26 провайдеров · у вендора 3,44 $

На твоём железе

Закрытые веса: только облако.

Разложение балла

A Общий 1 426 [1 422–1 430] Процентиль 82 · #55 · компонентов: 9
Источник Компонент Значение Elo-eq Вес Измерено Вариант
Epoch AI eci 150 ±0,72 1 435 ±6 35,7% 2025-11-13 —
LMArena text/overall 1 443 ±1,88 1 443 ±2 15,3% 2026-10-02 high
LMArena text/hard_prompts 1 457 ±2,45 1 446 ±2 15,2% 2026-10-02 high
LMArena text/instruction_following 1 443 ±3,20 1 454 ±3 7,5% 2026-10-02 high
LMArena text/expert 1 470 ±6,01 1 452 ±5 7,0% 2026-10-02 high
LMArena text/longer_query 1 448 ±3,22 1 445 ±3 3,7% 2026-10-02 high
Epoch AI simpleqa_verified устаревание ×0,61 0,48 ±0,02 1 448 ±5 3,7% 2026-08-27 high
LMArena text/multi_turn 1 450 ±3,83 1 444 ±4 3,7% 2026-10-02 high
Epoch AI gpqa_diamond устаревание ×0,26 0,88 ±0,02 1 447 ±9 1,4% 2025-11-13 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Код 1 405 [1 402–1 409] Процентиль 70 · #84 · компонентов: 3
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena webdev/overall 1 395 ±5,86 1 420 ±2 39,9% 2026-10-01 medium
LMArena text/coding 1 454 ±3,51 1 429 ±3 38,7% 2026-10-02 high
Epoch AI swe_bench_verified устаревание ×0,37 0,68 ±0,02 1 422 ±11 13,0% 2026-02-18 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Математика 1 408 [1 398–1 418] Процентиль 76 · #62 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/math 1 446 ±5,91 1 438 ±6 87,5% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Зрение 1 415 [1 410–1 420] Процентиль 56 · #50 · компонентов: 3 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena vision/overall 1 250 ±3,98 1 429 ±4 63,5% 2026-10-02 high
LMArena vision/ocr 1 255 ±4,47 1 428 ±4 15,5% 2026-10-02 high
LMArena vision/diagram 1 265 ±6,41 1 432 ±6 14,7% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

A Тексты 1 437 [1 431–1 442] Процентиль 81 · #51 · компонентов: 2 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/creative_writing 1 427 ±4,10 1 456 ±4 61,8% 2026-10-02 high
LMArena text/longer_query 1 448 ±3,22 1 445 ±3 32,0% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

A Язык: 繁體中文 1 434 [1 426–1 441] Процентиль 81 · #44 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/chinese 1 495 ±5,26 1 449 ±4 93,7% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Deutsch 1 417 [1 400–1 434] Процентиль 66 · #49 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/german 1 439 ±11 1 436 ±10 91,9% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: English 1 427 [1 422–1 432] Процентиль 79 · #57 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/english 1 451 ±2,74 1 442 ±3 93,9% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Español 1 410 [1 395–1 425] Процентиль 53 · #71 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/spanish 1 431 ±8,85 1 427 ±8 92,5% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Français 1 415 [1 398–1 432] Процентиль 57 · #59 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/french 1 450 ±10 1 433 ±9 92,0% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

A Язык: 日本語 1 444 [1 425–1 463] Процентиль 87 · #18 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/japanese 1 453 ±14 1 466 ±11 91,4% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: 한국어 1 418 [1 401–1 434] Процентиль 67 · #45 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/korean 1 401 ±12 1 436 ±9 92,2% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Polski 1 424 [1 411–1 438] Процентиль 68 · #42 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/polish 1 440 ±8,62 1 442 ±7 92,8% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Русский 1 424 [1 417–1 431] Процентиль 76 · #58 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/russian 1 435 ±4,22 1 439 ±4 93,8% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

История

fedi-index по месяцам
То же таблицей
Модель 2026-10
GPT-5.1 1 426 A

Бейдж

Покажите fedi-index модели на своём сайте или в README. Бейдж обновляется сам и ведёт на эту страницу.

fedi-index: GPT-5.1

Данные CC BY 4.0: сохраните ссылку на fedi.software.