К содержимому
fedi.software

GPT-5 в fedi-index

Балл в каждом срезе, из чего он состоит, выгода, локальный запуск и история.

fedi-index · Общий

B 1 404 ±6

Процентиль 70 · #87

Люди предпочитают / Решает задачи

1 395 / 1 417

Голоса людей и бенчмарки, Elo-eq

Выгода

-4

3,44 $ за 1M токенов, медиана 27 провайдеров · у вендора 3,44 $

На твоём железе

Закрытые веса: только облако.

Разложение балла

B Общий 1 404 [1 397–1 410] Процентиль 70 · #87 · компонентов: 9
Источник Компонент Значение Elo-eq Вес Измерено Вариант
Epoch AI eci 150 1 438 ±11 29,8% 2025-08-07 —
LMArena text/overall 1 406 ±2,26 1 406 ±2 16,8% 2026-10-02 high
LMArena text/hard_prompts 1 415 ±2,93 1 409 ±3 16,7% 2026-10-02 high
LMArena text/instruction_following 1 388 ±3,62 1 402 ±3 8,2% 2026-10-02 high
LMArena text/expert 1 420 ±7,62 1 411 ±6 7,3% 2026-10-02 high
Epoch AI simpleqa_verified устаревание ×0,61 0,50 ±0,02 1 455 ±5 4,1% 2026-08-27 high
LMArena text/longer_query 1 399 ±3,83 1 400 ±4 4,1% 2026-10-02 —
LMArena text/multi_turn 1 426 ±4,24 1 423 ±4 4,0% 2026-10-02 —
Epoch AI gpqa_diamond устаревание ×0,26 0,86 ±0,02 1 441 ±10 1,4% 2025-10-29 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Код 1 406 [1 401–1 410] Процентиль 70 · #83 · компонентов: 3
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena webdev/overall 1 417 ±7,92 1 426 ±2 39,6% 2026-10-01 medium
LMArena text/coding 1 436 ±4,04 1 413 ±4 38,3% 2026-10-02 high
Epoch AI swe_bench_verified устаревание ×0,37 0,74 ±0,02 1 450 ±10 13,6% 2026-02-06 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Математика 1 400 [1 392–1 408] Процентиль 71 · #74 · компонентов: 3
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/math 1 406 ±7,02 1 399 ±7 50,8% 2026-10-02 —
Epoch AI frontiermath_t1_3 устаревание ×0,86 0,55 ±0,03 1 441 ±6 29,7% 2026-06-10 high
Epoch AI frontiermath_t4 устаревание ×0,86 0,22 ±0,07 1 428 ±10 11,8% 2026-06-11 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Зрение 1 402 [1 398–1 407] Процентиль 46 · #61 · компонентов: 3 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena vision/overall 1 232 ±3,59 1 413 ±3 63,9% 2026-10-02 —
LMArena vision/ocr 1 245 ±4,61 1 419 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1 252 ±6,78 1 421 ±6 14,4% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Тексты 1 383 [1 377–1 389] Процентиль 58 · #114 · компонентов: 2 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/creative_writing 1 365 ±4,87 1 393 ±5 61,4% 2026-10-02 —
LMArena text/longer_query 1 399 ±3,83 1 400 ±4 32,2% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: 繁體中文 1 380 [1 371–1 389] Процентиль 48 · #117 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/chinese 1 423 ±6,34 1 392 ±5 93,5% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Deutsch 1 397 [1 380–1 415] Процентиль 56 · #64 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/german 1 414 ±11 1 415 ±10 91,8% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: English 1 385 [1 380–1 391] Процентиль 58 · #115 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/english 1 409 ±2,99 1 397 ±3 93,9% 2026-10-02 high

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: Español 1 382 [1 364–1 399] Процентиль 35 · #97 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/spanish 1 399 ±10 1 397 ±10 91,9% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: Français 1 375 [1 351–1 399] Процентиль 32 · #92 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/french 1 409 ±15 1 395 ±14 89,8% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: 日本語 1 415 [1 397–1 434] Процентиль 66 · #44 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/japanese 1 411 ±14 1 435 ±10 91,5% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: 한국어 1 390 [1 375–1 406] Процентиль 47 · #73 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/korean 1 361 ±11 1 406 ±8 92,4% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Polski 1 418 [1 406–1 429] Процентиль 63 · #49 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/polish 1 431 ±7,44 1 434 ±6 93,2% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: Русский 1 399 [1 388–1 409] Процентиль 60 · #94 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/russian 1 407 ±6,34 1 413 ±6 93,3% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

История

fedi-index по месяцам
То же таблицей
Модель 2026-10
GPT-5 1 404 B

Бейдж

Покажите fedi-index модели на своём сайте или в README. Бейдж обновляется сам и ведёт на эту страницу.

fedi-index: GPT-5

Данные CC BY 4.0: сохраните ссылку на fedi.software.