Zum Inhalt springen
fedi.software

GPT-5.5 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

S 1’466 ±6

Perzentil 96 · #13

Menschen bevorzugen / Löst Aufgaben

1’460 / 1’476

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+29

$ 11.25 pro 1 Mio. Tokens, Median von 38 Anbietern · beim Hersteller $ 11.25

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

S Allgemein 1’466 [1’460–1’472] Perzentil 96 · #13 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 159 ±1.43 1’510 ±11 28.6% 2026-04-23 —
LMArena text/overall 1’471 ±1.89 1’471 ±2 16.8% 2026-10-02 high
LMArena text/hard_prompts 1’489 ±2.22 1’475 ±2 16.8% 2026-10-02 high
LMArena text/instruction_following 1’478 ±2.70 1’487 ±3 8.3% 2026-10-02 high
LMArena text/expert 1’508 ±3.96 1’482 ±3 8.2% 2026-10-02 high
LMArena text/longer_query 1’484 ±2.56 1’479 ±2 4.2% 2026-10-02 high
Epoch AI simpleqa_verified Alterung ×0.61 0.63 ±0.02 1’495 ±5 4.1% 2026-08-27 xhigh
LMArena text/multi_turn 1’476 ±3.42 1’468 ±3 4.1% 2026-10-02 high
Epoch AI gpqa_diamond Alterung ×0.26 0.91 ±0.02 1’461 ±8 1.5% 2026-05-05 low

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Code 1’435 [1’432–1’437] Perzentil 86 · #39 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’512 ±3.03 1’453 ±1 45.8% 2026-10-01 xhigh-codex-harness
LMArena text/coding 1’494 ±2.89 1’465 ±3 44.6% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Agenten 1’459 [1’454–1’465] Perzentil 81 · #12 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena agent/overall 0.04 ±0.01 1’475 ±2 66.5% 2026-10-02 xhigh
τ²-bench (Sierra) tau2/banking_knowledge Alterung ×0.76 0.45 ±0.05 1’488 ±8 26.3% 2026-07-22 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

S Mathematik 1’469 [1’462–1’475] Perzentil 97 · #8 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’486 ±5.35 1’476 ±5 51.7% 2026-10-02 —
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.85 ±0.02 1’506 ±5 30.5% 2026-06-11 xhigh
Epoch AI frontiermath_t4 Alterung ×0.86 0.72 ±0.07 1’508 ±11 10.5% 2026-06-11 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Vision 1’459 [1’455–1’463] Perzentil 87 · #16 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’297 ±3.01 1’472 ±3 63.0% 2026-10-02 —
LMArena vision/ocr 1’308 ±3.02 1’479 ±3 15.7% 2026-10-02 —
LMArena vision/diagram 1’326 ±4.28 1’486 ±4 15.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’466 [1’461–1’470] Perzentil 93 · #20 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’455 ±3.33 1’485 ±3 62.1% 2026-10-02 high
LMArena text/longer_query 1’484 ±2.56 1’479 ±2 31.8% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 繁體中文 1’464 [1’456–1’471] Perzentil 96 · #10 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’535 ±4.97 1’481 ±4 93.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Deutsch 1’451 [1’436–1’467] Perzentil 94 · #10 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’481 ±9.72 1’472 ±8 92.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1’446 [1’442–1’451] Perzentil 89 · #32 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’470 ±2.44 1’462 ±3 94.0% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Español 1’443 [1’431–1’455] Perzentil 88 · #19 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’468 ±7.36 1’461 ±7 93.0% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Français 1’447 [1’436–1’459] Perzentil 85 · #21 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’486 ±7.07 1’466 ±6 93.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 日本語 1’477 [1’462–1’492] Perzentil 97 · #5 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’497 ±11 1’499 ±8 92.5% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 한국어 1’462 [1’449–1’475] Perzentil 96 · #7 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’461 ±9.38 1’482 ±7 92.9% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Polski 1’444 [1’430–1’457] Perzentil 85 · #20 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’465 ±8.93 1’462 ±8 92.7% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1’456 [1’449–1’462] Perzentil 91 · #22 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’473 ±3.91 1’472 ±4 93.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5.5 1’466 S

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5.5

Daten CC BY 4.0: Link zu fedi.software beibehalten.