Przejdź do treści
fedi.software

GPT-5.4 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 459 ±5

Percentyl 94 · #20

Ludzie wolą / Rozwiązuje zadania

1 457 / 1 462

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+39

5,62 USD za 1M tokenów, mediana dostawców: 35 · producent 5,62 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

A Ogólny 1 459 [1 454–1 464] Percentyl 94 · #20 · składniki: 9
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 157 ±1,01 1 492 ±8 33,0% 2026-03-05 —
LMArena text/overall 1 469 ±1,91 1 469 ±2 15,8% 2026-10-02 high
LMArena text/hard_prompts 1 485 ±2,29 1 472 ±2 15,8% 2026-10-02 high
LMArena text/instruction_following 1 469 ±2,78 1 479 ±3 7,8% 2026-10-02 high
LMArena text/expert 1 507 ±4,23 1 482 ±4 7,6% 2026-10-02 high
LMArena text/longer_query 1 474 ±2,68 1 469 ±2 3,9% 2026-10-02 high
LMArena text/multi_turn 1 482 ±3,36 1 473 ±3 3,9% 2026-10-02 high
Epoch AI simpleqa_verified wygaszanie ×0,61 0,45 ±0,02 1 439 ±5 3,8% 2026-08-27 xhigh
Epoch AI gpqa_diamond wygaszanie ×0,26 0,93 ±0,02 1 474 ±8 1,4% 2026-03-06 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 434 [1 431–1 438] Percentyl 86 · #40 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 497 ±2,96 1 467 ±3 39,0% 2026-10-02 high
LMArena webdev/overall 1 465 ±9,63 1 440 ±3 38,8% 2026-10-01 high-codex-harness
Epoch AI swe_bench_verified wygaszanie ×0,37 0,77 ±0,02 1 468 ±10 13,8% 2026-03-06 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Agenci 1 447 [1 442–1 452] Percentyl 65 · #21 · składniki: 2
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena agent/overall 0,01 ±0,00 1 461 ±2 66,5% 2026-10-02 high
τ²-bench (Sierra) tau2/banking_knowledge wygaszanie ×0,76 0,39 ±0,05 1 479 ±8 26,4% 2026-05-06 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Matematyka 1 461 [1 454–1 467] Percentyl 95 · #14 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 488 ±5,40 1 478 ±5 52,6% 2026-10-02 high
Epoch AI frontiermath_t1_3 wygaszanie ×0,86 0,79 ±0,02 1 491 ±5 30,2% 2026-06-11 xhigh
Epoch AI frontiermath_t4 wygaszanie ×0,86 0,49 ±0,08 1 471 ±13 9,8% 2026-06-11 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Obraz 1 462 [1 459–1 466] Percentyl 91 · #11 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 302 ±2,98 1 477 ±3 62,9% 2026-10-02 high
LMArena vision/ocr 1 311 ±2,95 1 482 ±3 15,7% 2026-10-02 high
LMArena vision/diagram 1 326 ±4,22 1 487 ±4 15,3% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Pisanie 1 452 [1 448–1 457] Percentyl 87 · #35 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 439 ±3,51 1 468 ±4 62,0% 2026-10-02 high
LMArena text/longer_query 1 474 ±2,68 1 469 ±2 31,9% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 繁體中文 1 452 [1 445–1 460] Percentyl 90 · #23 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 520 ±5,07 1 469 ±4 93,7% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Deutsch 1 445 [1 430–1 460] Percentyl 90 · #15 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 472 ±9,53 1 464 ±8 92,5% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 443 [1 438–1 448] Percentyl 88 · #35 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 467 ±2,51 1 458 ±3 94,0% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Español 1 431 [1 419–1 444] Percentyl 77 · #35 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 454 ±7,25 1 448 ±7 93,0% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Français 1 453 [1 441–1 465] Percentyl 91 · #13 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 493 ±7,17 1 472 ±7 93,1% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 日本語 1 466 [1 449–1 483] Percentyl 92 · #11 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 483 ±13 1 489 ±10 92,0% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 한국어 1 453 [1 440–1 467] Percentyl 91 · #13 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 450 ±9,98 1 473 ±8 92,7% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Polski 1 449 [1 436–1 462] Percentyl 89 · #15 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 471 ±8,48 1 468 ±7 92,9% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Русский 1 462 [1 455–1 469] Percentyl 93 · #17 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 480 ±3,98 1 479 ±4 93,8% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
GPT-5.4 1 459 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: GPT-5.4

Dane CC BY 4.0: zachowaj link do fedi.software.