GPT-5.4 w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
A 1 459 ±5
Percentyl 94 · #20
Ludzie wolą / Rozwiązuje zadania
1 457 / 1 462
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+39
5,62 USD za 1M tokenów, mediana dostawców: 35 · producent 5,62 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
A Ogólny 1 459 [1 454–1 464] Percentyl 94 · #20 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
157 ±1,01 | 1 492 ±8 | 33,0% | 2026-03-05 | — |
| LMArena |
text/overall
|
1 469 ±1,91 | 1 469 ±2 | 15,8% | 2026-10-02 | high |
| LMArena |
text/hard_prompts
|
1 485 ±2,29 | 1 472 ±2 | 15,8% | 2026-10-02 | high |
| LMArena |
text/instruction_following
|
1 469 ±2,78 | 1 479 ±3 | 7,8% | 2026-10-02 | high |
| LMArena |
text/expert
|
1 507 ±4,23 | 1 482 ±4 | 7,6% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1 474 ±2,68 | 1 469 ±2 | 3,9% | 2026-10-02 | high |
| LMArena |
text/multi_turn
|
1 482 ±3,36 | 1 473 ±3 | 3,9% | 2026-10-02 | high |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,45 ±0,02 | 1 439 ±5 | 3,8% | 2026-08-27 | xhigh |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,93 ±0,02 | 1 474 ±8 | 1,4% | 2026-03-06 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 434 [1 431–1 438] Percentyl 86 · #40 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 497 ±2,96 | 1 467 ±3 | 39,0% | 2026-10-02 | high |
| LMArena |
webdev/overall
|
1 465 ±9,63 | 1 440 ±3 | 38,8% | 2026-10-01 | high-codex-harness |
| Epoch AI |
swe_bench_verified
wygaszanie ×0,37 |
0,77 ±0,02 | 1 468 ±10 | 13,8% | 2026-03-06 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Agenci 1 447 [1 442–1 452] Percentyl 65 · #21 · składniki: 2
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,01 ±0,00 | 1 461 ±2 | 66,5% | 2026-10-02 | high |
| τ²-bench (Sierra) |
tau2/banking_knowledge
wygaszanie ×0,76 |
0,39 ±0,05 | 1 479 ±8 | 26,4% | 2026-05-06 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Matematyka 1 461 [1 454–1 467] Percentyl 95 · #14 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 488 ±5,40 | 1 478 ±5 | 52,6% | 2026-10-02 | high |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,79 ±0,02 | 1 491 ±5 | 30,2% | 2026-06-11 | xhigh |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,49 ±0,08 | 1 471 ±13 | 9,8% | 2026-06-11 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Obraz 1 462 [1 459–1 466] Percentyl 91 · #11 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 302 ±2,98 | 1 477 ±3 | 62,9% | 2026-10-02 | high |
| LMArena |
vision/ocr
|
1 311 ±2,95 | 1 482 ±3 | 15,7% | 2026-10-02 | high |
| LMArena |
vision/diagram
|
1 326 ±4,22 | 1 487 ±4 | 15,3% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 452 [1 448–1 457] Percentyl 87 · #35 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 439 ±3,51 | 1 468 ±4 | 62,0% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1 474 ±2,68 | 1 469 ±2 | 31,9% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 繁體中文 1 452 [1 445–1 460] Percentyl 90 · #23 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 520 ±5,07 | 1 469 ±4 | 93,7% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Deutsch 1 445 [1 430–1 460] Percentyl 90 · #15 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 472 ±9,53 | 1 464 ±8 | 92,5% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: English 1 443 [1 438–1 448] Percentyl 88 · #35 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 467 ±2,51 | 1 458 ±3 | 94,0% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Español 1 431 [1 419–1 444] Percentyl 77 · #35 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 454 ±7,25 | 1 448 ±7 | 93,0% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Français 1 453 [1 441–1 465] Percentyl 91 · #13 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 493 ±7,17 | 1 472 ±7 | 93,1% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 日本語 1 466 [1 449–1 483] Percentyl 92 · #11 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 483 ±13 | 1 489 ±10 | 92,0% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 한국어 1 453 [1 440–1 467] Percentyl 91 · #13 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 450 ±9,98 | 1 473 ±8 | 92,7% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Polski 1 449 [1 436–1 462] Percentyl 89 · #15 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 471 ±8,48 | 1 468 ±7 | 92,9% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Русский 1 462 [1 455–1 469] Percentyl 93 · #17 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 480 ±3,98 | 1 479 ±4 | 93,8% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-5.4 | 1 459 A |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.