Zum Inhalt springen
fedi.software

GPT-5.6 Sol im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

S 1’469 ±7

Perzentil 97 · #11

Menschen bevorzugen / Löst Aufgaben

1’454 / 1’493

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+40

$ 8 pro 1 Mio. Tokens, Median von 34 Anbietern · beim Hersteller $ 8

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

S Allgemein 1’469 [1’462–1’476] Perzentil 97 · #11 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 162 ±1.49 1’530 ±12 28.2% 2026-07-09 —
LMArena text/overall 1’456 ±2.26 1’456 ±2 16.9% 2026-10-02 xhigh
LMArena text/hard_prompts 1’482 ±2.62 1’469 ±2 16.9% 2026-10-02 xhigh
LMArena text/instruction_following 1’482 ±3.23 1’490 ±3 8.3% 2026-10-02 xhigh
LMArena text/expert 1’518 ±5.00 1’491 ±4 8.1% 2026-10-02 xhigh
Epoch AI simpleqa_verified Alterung ×0.61 0.70 ±0.01 1’516 ±5 4.2% 2026-08-10 max
LMArena text/longer_query 1’480 ±3.01 1’475 ±3 4.2% 2026-10-02 xhigh
LMArena text/multi_turn 1’459 ±4.27 1’452 ±4 4.1% 2026-10-02 xhigh
Epoch AI gpqa_diamond Alterung ×0.26 0.93 ±0.02 1’475 ±7 1.6% 2026-07-09 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Code 1’449 [1’446–1’452] Perzentil 92 · #22 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’620 ±3.06 1’484 ±1 46.1% 2026-10-01 xhigh-codex-harness
LMArena text/coding 1’496 ±3.51 1’467 ±3 44.3% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Agenten 1’467 [1’461–1’473] Perzentil 86 · #9 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena agent/overall 0.06 ±0.01 1’486 ±3 66.2% 2026-10-02 xhigh
τ²-bench (Sierra) tau2/banking_knowledge Alterung ×0.76 0.47 ±0.05 1’492 ±8 26.6% 2026-07-22 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

S Mathematik 1’467 [1’460–1’474] Perzentil 96 · #10 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’472 ±7.30 1’462 ±7 48.6% 2026-10-02 xhigh
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.89 ±0.02 1’514 ±4 31.8% 2026-07-09 max
Epoch AI frontiermath_t4 Alterung ×0.86 0.83 ±0.06 1’525 ±10 12.2% 2026-07-09 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Vision 1’442 [1’438–1’447] Perzentil 76 · #28 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’279 ±3.84 1’456 ±4 63.4% 2026-10-02 xhigh
LMArena vision/ocr 1’289 ±4.11 1’460 ±4 15.6% 2026-10-02 xhigh
LMArena vision/diagram 1’303 ±6.29 1’466 ±6 14.7% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Suche 1’482 [1’475–1’490] Perzentil 100 · #1 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena search/overall 1’257 ±3.81 1’501 ±4 93.7% 2026-08-24 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’460 [1’454–1’465] Perzentil 92 · #23 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’448 ±4.05 1’478 ±4 61.7% 2026-10-02 xhigh
LMArena text/longer_query 1’480 ±3.01 1’475 ±3 32.1% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 繁體中文 1’454 [1’445–1’463] Perzentil 91 · #20 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’523 ±6.03 1’471 ±5 93.6% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Deutsch 1’441 [1’422–1’460] Perzentil 86 · #21 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’471 ±13 1’464 ±11 91.3% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1’434 [1’428–1’439] Perzentil 85 · #43 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’457 ±3.01 1’449 ±3 93.9% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1’423 [1’407–1’439] Perzentil 70 · #45 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’446 ±9.54 1’441 ±9 92.2% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1’436 [1’420–1’452] Perzentil 79 · #29 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’475 ±9.74 1’456 ±9 92.2% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 日本語 1’456 [1’437–1’475] Perzentil 89 · #15 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’471 ±14 1’480 ±11 91.4% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 한국어 1’442 [1’426–1’458] Perzentil 86 · #20 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’436 ±12 1’462 ±9 92.2% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Polski 1’437 [1’418–1’456] Perzentil 82 · #24 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’461 ±13 1’459 ±11 91.3% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1’451 [1’443–1’459] Perzentil 89 · #27 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’468 ±4.90 1’468 ±4 93.6% 2026-10-02 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5.6 Sol 1’469 S

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5.6 Sol

Daten CC BY 4.0: Link zu fedi.software beibehalten.