К содержимому
fedi.software

GPT-4.1 в fedi-index

Балл в каждом срезе, из чего он состоит, выгода, локальный запуск и история.

fedi-index · Общий

C 1 353 ±6

Процентиль 48 · #154

Люди предпочитают / Решает задачи

1 370 / 1 324

Голоса людей и бенчмарки, Elo-eq

Выгода

-56

3,50 $ за 1M токенов, медиана 23 провайдеров · у вендора 3,50 $

На твоём железе

Закрытые веса: только облако.

Разложение балла

C Общий 1 353 [1 346–1 359] Процентиль 48 · #154 · компонентов: 9
Источник Компонент Значение Elo-eq Вес Измерено Вариант
Epoch AI eci 137 ±1,27 1 333 ±10 31,2% 2025-04-14 —
LMArena text/overall 1 383 ±1,89 1 383 ±2 16,9% 2026-10-02 —
LMArena text/hard_prompts 1 384 ±2,49 1 380 ±2 16,8% 2026-10-02 —
LMArena text/instruction_following 1 367 ±2,93 1 382 ±3 8,3% 2026-10-02 —
LMArena text/expert 1 364 ±5,94 1 365 ±5 7,8% 2026-10-02 —
LMArena text/longer_query 1 385 ±3,26 1 387 ±3 4,1% 2026-10-02 —
LMArena text/multi_turn 1 398 ±3,49 1 397 ±3 4,1% 2026-10-02 —
Epoch AI simpleqa_verified выброс устаревание ×0,61 0,31 ±0,01 1 395 ±5 2,1% 2026-08-31 —
Epoch AI gpqa_diamond устаревание ×0,26 0,67 ±0,03 1 351 ±13 1,1% 2025-04-14 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Код 1 352 [1 346–1 358] Процентиль 46 · #152 · компонентов: 2
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/coding 1 391 ±3,37 1 373 ±3 78,9% 2026-10-02 —
Epoch AI swe_bench_verified устаревание ×0,37 0,49 ±0,02 1 322 ±12 12,6% 2026-02-08 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Математика 1 340 [1 334–1 345] Процентиль 43 · #146 · компонентов: 2
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/math 1 369 ±5,23 1 364 ±5 48,5% 2026-10-02 —
Epoch AI frontiermath_t1_3 устаревание ×0,86 0,06 ±0,01 1 334 ±3 44,7% 2026-08-27 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Зрение 1 381 [1 376–1 385] Процентиль 41 · #67 · компонентов: 3 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena vision/overall 1 210 ±3,40 1 394 ±3 64,0% 2026-10-02 —
LMArena vision/ocr 1 218 ±4,54 1 392 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1 215 ±6,62 1 388 ±6 14,4% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Тексты 1 378 [1 373–1 383] Процентиль 57 · #117 · компонентов: 2 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/creative_writing 1 364 ±3,92 1 391 ±4 61,9% 2026-10-02 —
LMArena text/longer_query 1 385 ±3,26 1 387 ±3 31,9% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: 繁體中文 1 350 [1 342–1 358] Процентиль 38 · #139 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/chinese 1 382 ±5,41 1 360 ±4 93,7% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: Deutsch 1 372 [1 359–1 385] Процентиль 42 · #84 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/german 1 380 ±8,47 1 385 ±7 92,8% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

B Язык: English 1 369 [1 364–1 374] Процентиль 54 · #126 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/english 1 392 ±2,46 1 380 ±3 94,0% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: Español 1 363 [1 347–1 378] Процентиль 28 · #108 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/spanish 1 376 ±9,28 1 376 ±9 92,3% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: Français 1 356 [1 338–1 375] Процентиль 25 · #101 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/french 1 382 ±11 1 371 ±10 91,5% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: 日本語 1 355 [1 342–1 368] Процентиль 32 · #88 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/japanese 1 319 ±9,56 1 366 ±7 92,9% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: 한국어 1 376 [1 362–1 389] Процентиль 36 · #87 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/korean 1 339 ±9,65 1 389 ±7 92,8% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: Polski 1 385 [1 376–1 394] Процентиль 35 · #85 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/polish 1 389 ±5,88 1 398 ±5 93,5% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

C Язык: Русский 1 374 [1 366–1 382] Процентиль 48 · #123 · компонентов: 1 предварительно
Источник Компонент Значение Elo-eq Вес Измерено Вариант
LMArena text/russian 1 377 ±4,80 1 386 ±4 93,7% 2026-10-02 —

Вес — доля компонента в балле (остальное — априорное значение, которое тянет модели с малым количеством данных к медиане популяции). Методика

История

fedi-index по месяцам
То же таблицей
Модель 2026-10
GPT-4.1 1 353 C

Бейдж

Покажите fedi-index модели на своём сайте или в README. Бейдж обновляется сам и ведёт на эту страницу.

fedi-index: GPT-4.1

Данные CC BY 4.0: сохраните ссылку на fedi.software.