Zum Inhalt springen
fedi.software

GPT-5.4 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1’459 ±5

Perzentil 94 · #20

Menschen bevorzugen / Löst Aufgaben

1’457 / 1’462

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+39

$ 5.62 pro 1 Mio. Tokens, Median von 35 Anbietern · beim Hersteller $ 5.62

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

A Allgemein 1’459 [1’454–1’464] Perzentil 94 · #20 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 157 ±1.01 1’492 ±8 33.0% 2026-03-05 —
LMArena text/overall 1’469 ±1.91 1’469 ±2 15.8% 2026-10-02 high
LMArena text/hard_prompts 1’485 ±2.29 1’472 ±2 15.8% 2026-10-02 high
LMArena text/instruction_following 1’469 ±2.78 1’479 ±3 7.8% 2026-10-02 high
LMArena text/expert 1’507 ±4.23 1’482 ±4 7.6% 2026-10-02 high
LMArena text/longer_query 1’474 ±2.68 1’469 ±2 3.9% 2026-10-02 high
LMArena text/multi_turn 1’482 ±3.36 1’473 ±3 3.9% 2026-10-02 high
Epoch AI simpleqa_verified Alterung ×0.61 0.45 ±0.02 1’439 ±5 3.8% 2026-08-27 xhigh
Epoch AI gpqa_diamond Alterung ×0.26 0.93 ±0.02 1’474 ±8 1.4% 2026-03-06 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Code 1’434 [1’431–1’438] Perzentil 86 · #40 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’497 ±2.96 1’467 ±3 39.0% 2026-10-02 high
LMArena webdev/overall 1’465 ±9.63 1’440 ±3 38.8% 2026-10-01 high-codex-harness
Epoch AI swe_bench_verified Alterung ×0.37 0.77 ±0.02 1’468 ±10 13.8% 2026-03-06 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Agenten 1’447 [1’442–1’452] Perzentil 65 · #21 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena agent/overall 0.01 ±0.00 1’461 ±2 66.5% 2026-10-02 high
τ²-bench (Sierra) tau2/banking_knowledge Alterung ×0.76 0.39 ±0.05 1’479 ±8 26.4% 2026-05-06 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Mathematik 1’461 [1’454–1’467] Perzentil 95 · #14 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’488 ±5.40 1’478 ±5 52.6% 2026-10-02 high
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.79 ±0.02 1’491 ±5 30.2% 2026-06-11 xhigh
Epoch AI frontiermath_t4 Alterung ×0.86 0.49 ±0.08 1’471 ±13 9.8% 2026-06-11 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Vision 1’462 [1’459–1’466] Perzentil 91 · #11 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’302 ±2.98 1’477 ±3 62.9% 2026-10-02 high
LMArena vision/ocr 1’311 ±2.95 1’482 ±3 15.7% 2026-10-02 high
LMArena vision/diagram 1’326 ±4.22 1’487 ±4 15.3% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’452 [1’448–1’457] Perzentil 87 · #35 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’439 ±3.51 1’468 ±4 62.0% 2026-10-02 high
LMArena text/longer_query 1’474 ±2.68 1’469 ±2 31.9% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 繁體中文 1’452 [1’445–1’460] Perzentil 90 · #23 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’520 ±5.07 1’469 ±4 93.7% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Deutsch 1’445 [1’430–1’460] Perzentil 90 · #15 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’472 ±9.53 1’464 ±8 92.5% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1’443 [1’438–1’448] Perzentil 88 · #35 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’467 ±2.51 1’458 ±3 94.0% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1’431 [1’419–1’444] Perzentil 77 · #35 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’454 ±7.25 1’448 ±7 93.0% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Français 1’453 [1’441–1’465] Perzentil 91 · #13 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’493 ±7.17 1’472 ±7 93.1% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 日本語 1’466 [1’449–1’483] Perzentil 92 · #11 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’483 ±13 1’489 ±10 92.0% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 한국어 1’453 [1’440–1’467] Perzentil 91 · #13 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’450 ±9.98 1’473 ±8 92.7% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Polski 1’449 [1’436–1’462] Perzentil 89 · #15 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’471 ±8.48 1’468 ±7 92.9% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1’462 [1’455–1’469] Perzentil 93 · #17 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’480 ±3.98 1’479 ±4 93.8% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5.4 1’459 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5.4

Daten CC BY 4.0: Link zu fedi.software beibehalten.