Naar de inhoud
fedi.software

GPT-5.4 in fedi-index

De score in elke doorsnede, waaruit die bestaat, prijs-kwaliteit, lokaal draaien en geschiedenis.

fedi-index · Algemeen

A 1.459 ±5

Percentiel 94 · #20

Mensen kiezen / Lost taken op

1.457 / 1.462

Menselijke stemmen tegenover benchmarks, Elo-eq

Prijs-kwaliteit

+39

US$ 5,62 per 1M tokens, mediaan van 35 aanbieders · maker US$ 5,62

Op je eigen hardware

Gesloten gewichten: alleen in de cloud.

Opbouw van de score

A Algemeen 1.459 [1.454–1.464] Percentiel 94 · #20 · onderdelen: 9
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
Epoch AI eci 157 ±1,01 1.492 ±8 33,0% 2026-03-05 —
LMArena text/overall 1.469 ±1,91 1.469 ±2 15,8% 2026-10-02 high
LMArena text/hard_prompts 1.485 ±2,29 1.472 ±2 15,8% 2026-10-02 high
LMArena text/instruction_following 1.469 ±2,78 1.479 ±3 7,8% 2026-10-02 high
LMArena text/expert 1.507 ±4,23 1.482 ±4 7,6% 2026-10-02 high
LMArena text/longer_query 1.474 ±2,68 1.469 ±2 3,9% 2026-10-02 high
LMArena text/multi_turn 1.482 ±3,36 1.473 ±3 3,9% 2026-10-02 high
Epoch AI simpleqa_verified verval ×0,61 0,45 ±0,02 1.439 ±5 3,9% 2026-08-27 xhigh
Epoch AI gpqa_diamond verval ×0,26 0,93 ±0,02 1.474 ±8 1,4% 2026-03-06 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Coderen 1.434 [1.431–1.438] Percentiel 86 · #40 · onderdelen: 3
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/coding 1.497 ±2,96 1.467 ±3 38,9% 2026-10-02 high
LMArena webdev/overall 1.465 ±9,63 1.440 ±3 38,8% 2026-10-01 high-codex-harness
Epoch AI swe_bench_verified verval ×0,37 0,77 ±0,02 1.468 ±10 13,9% 2026-03-06 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Agents 1.447 [1.442–1.452] Percentiel 65 · #21 · onderdelen: 2
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena agent/overall 0,01 ±0,00 1.461 ±2 66,5% 2026-10-02 high
τ²-bench (Sierra) tau2/banking_knowledge verval ×0,76 0,39 ±0,05 1.479 ±8 26,4% 2026-05-06 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Wiskunde 1.461 [1.454–1.467] Percentiel 95 · #14 · onderdelen: 3
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/math 1.488 ±5,40 1.478 ±5 52,6% 2026-10-02 high
Epoch AI frontiermath_t1_3 verval ×0,86 0,79 ±0,02 1.491 ±5 30,2% 2026-06-11 xhigh
Epoch AI frontiermath_t4 verval ×0,86 0,49 ±0,08 1.471 ±13 9,8% 2026-06-11 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Beeld 1.462 [1.459–1.466] Percentiel 91 · #11 · onderdelen: 3 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena vision/overall 1.302 ±2,98 1.477 ±3 62,9% 2026-10-02 high
LMArena vision/ocr 1.311 ±2,95 1.482 ±3 15,7% 2026-10-02 high
LMArena vision/diagram 1.326 ±4,22 1.487 ±4 15,3% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Schrijven 1.452 [1.448–1.457] Percentiel 87 · #35 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/creative_writing 1.439 ±3,51 1.468 ±4 62,0% 2026-10-02 high
LMArena text/longer_query 1.474 ±2,68 1.469 ±2 31,9% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: 繁體中文 1.452 [1.445–1.460] Percentiel 90 · #23 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/chinese 1.520 ±5,07 1.469 ±4 93,7% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Deutsch 1.445 [1.430–1.460] Percentiel 90 · #15 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/german 1.472 ±9,53 1.464 ±8 92,5% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: English 1.443 [1.438–1.448] Percentiel 88 · #35 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/english 1.467 ±2,51 1.458 ±3 94,0% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Español 1.431 [1.419–1.444] Percentiel 77 · #35 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/spanish 1.454 ±7,25 1.448 ±7 93,0% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Français 1.453 [1.441–1.465] Percentiel 91 · #13 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/french 1.493 ±7,17 1.472 ±7 93,1% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: 日本語 1.466 [1.449–1.483] Percentiel 92 · #11 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/japanese 1.483 ±13 1.489 ±10 92,0% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: 한국어 1.453 [1.440–1.467] Percentiel 91 · #13 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/korean 1.450 ±9,98 1.473 ±8 92,7% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Polski 1.449 [1.436–1.462] Percentiel 89 · #15 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/polish 1.471 ±8,48 1.468 ±7 92,9% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Русский 1.462 [1.455–1.469] Percentiel 93 · #17 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/russian 1.480 ±3,98 1.479 ±4 93,8% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

Geschiedenis

fedi-index per maand
Hetzelfde in een tabel
Model 2026-10
GPT-5.4 1.459 A

Badge

Toon de fedi-index van het model op je site of in een README. De badge werkt zichzelf bij en linkt naar deze pagina.

fedi-index: GPT-5.4

Data CC BY 4.0: behoud de link naar fedi.software.