GPT-4.1 w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
C 1 353 ±6
Percentyl 48 · #154
Ludzie wolą / Rozwiązuje zadania
1 370 / 1 324
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
-56
3,50 USD za 1M tokenów, mediana dostawców: 23 · producent 3,50 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
C Ogólny 1 353 [1 346–1 359] Percentyl 48 · #154 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
137 ±1,27 | 1 333 ±10 | 31,2% | 2025-04-14 | — |
| LMArena |
text/overall
|
1 383 ±1,89 | 1 383 ±2 | 16,9% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 384 ±2,49 | 1 380 ±2 | 16,8% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1 367 ±2,93 | 1 382 ±3 | 8,3% | 2026-10-02 | — |
| LMArena |
text/expert
|
1 364 ±5,94 | 1 365 ±5 | 7,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 385 ±3,26 | 1 387 ±3 | 4,1% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 398 ±3,49 | 1 397 ±3 | 4,1% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
wartość odstająca wygaszanie ×0,61 |
0,31 ±0,01 | 1 395 ±5 | 2,1% | 2026-08-31 | — |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,67 ±0,03 | 1 351 ±13 | 1,1% | 2025-04-14 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Programowanie 1 352 [1 346–1 358] Percentyl 46 · #152 · składniki: 2
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 391 ±3,37 | 1 373 ±3 | 78,9% | 2026-10-02 | — |
| Epoch AI |
swe_bench_verified
wygaszanie ×0,37 |
0,49 ±0,02 | 1 322 ±12 | 12,6% | 2026-02-08 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Matematyka 1 340 [1 334–1 345] Percentyl 43 · #146 · składniki: 2
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 369 ±5,23 | 1 364 ±5 | 48,5% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,06 ±0,01 | 1 334 ±3 | 44,7% | 2026-08-27 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Obraz 1 381 [1 376–1 385] Percentyl 41 · #67 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 210 ±3,40 | 1 394 ±3 | 64,0% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1 218 ±4,54 | 1 392 ±4 | 15,4% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1 215 ±6,62 | 1 388 ±6 | 14,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Pisanie 1 378 [1 373–1 383] Percentyl 57 · #117 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 364 ±3,92 | 1 391 ±4 | 61,9% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 385 ±3,26 | 1 387 ±3 | 31,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 繁體中文 1 350 [1 342–1 358] Percentyl 38 · #139 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 382 ±5,41 | 1 360 ±4 | 93,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Deutsch 1 372 [1 359–1 385] Percentyl 42 · #84 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 380 ±8,47 | 1 385 ±7 | 92,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 369 [1 364–1 374] Percentyl 54 · #126 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 392 ±2,46 | 1 380 ±3 | 94,0% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Español 1 363 [1 347–1 378] Percentyl 28 · #108 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 376 ±9,28 | 1 376 ±9 | 92,3% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Français 1 356 [1 338–1 375] Percentyl 25 · #101 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 382 ±11 | 1 371 ±10 | 91,5% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 日本語 1 355 [1 342–1 368] Percentyl 32 · #88 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 319 ±9,56 | 1 366 ±7 | 92,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 한국어 1 376 [1 362–1 389] Percentyl 36 · #87 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 339 ±9,65 | 1 389 ±7 | 92,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Polski 1 385 [1 376–1 394] Percentyl 35 · #85 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 389 ±5,88 | 1 398 ±5 | 93,5% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Русский 1 374 [1 366–1 382] Percentyl 48 · #123 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 377 ±4,80 | 1 386 ±4 | 93,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-4.1 | 1 353 C |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.