Zum Inhalt springen
fedi.software

GPT-5 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1.404 ±6

Perzentil 70 · #87

Menschen bevorzugen / Löst Aufgaben

1.395 / 1.417

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-4

3,44 $ pro 1 Mio. Tokens, Median von 27 Anbietern · beim Hersteller 3,44 $

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1.404 [1.397–1.410] Perzentil 70 · #87 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 150 1.438 ±11 29,9% 2025-08-07 —
LMArena text/overall 1.406 ±2,26 1.406 ±2 16,8% 2026-10-02 high
LMArena text/hard_prompts 1.415 ±2,93 1.409 ±3 16,7% 2026-10-02 high
LMArena text/instruction_following 1.388 ±3,62 1.402 ±3 8,2% 2026-10-02 high
LMArena text/expert 1.420 ±7,62 1.411 ±6 7,3% 2026-10-02 high
Epoch AI simpleqa_verified Alterung ×0,61 0,50 ±0,02 1.455 ±5 4,1% 2026-08-27 high
LMArena text/longer_query 1.399 ±3,83 1.400 ±4 4,1% 2026-10-02 —
LMArena text/multi_turn 1.426 ±4,24 1.423 ±4 4,0% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0,26 0,86 ±0,02 1.441 ±10 1,4% 2025-10-29 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.406 [1.401–1.410] Perzentil 70 · #83 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1.417 ±7,92 1.426 ±2 39,6% 2026-10-01 medium
LMArena text/coding 1.436 ±4,04 1.413 ±4 38,3% 2026-10-02 high
Epoch AI swe_bench_verified Alterung ×0,37 0,74 ±0,02 1.450 ±10 13,6% 2026-02-06 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1.400 [1.392–1.408] Perzentil 71 · #74 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.406 ±7,02 1.399 ±7 50,8% 2026-10-02 —
Epoch AI frontiermath_t1_3 Alterung ×0,86 0,55 ±0,03 1.441 ±6 29,7% 2026-06-10 high
Epoch AI frontiermath_t4 Alterung ×0,86 0,22 ±0,07 1.428 ±10 11,8% 2026-06-11 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1.402 [1.398–1.407] Perzentil 46 · #61 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1.232 ±3,59 1.413 ±3 63,9% 2026-10-02 —
LMArena vision/ocr 1.245 ±4,61 1.419 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1.252 ±6,78 1.421 ±6 14,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.383 [1.377–1.389] Perzentil 58 · #114 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.365 ±4,87 1.393 ±5 61,4% 2026-10-02 —
LMArena text/longer_query 1.399 ±3,83 1.400 ±4 32,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1.380 [1.371–1.389] Perzentil 48 · #117 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.423 ±6,34 1.392 ±5 93,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1.397 [1.380–1.415] Perzentil 56 · #64 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.414 ±11 1.415 ±10 91,8% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.385 [1.380–1.391] Perzentil 58 · #115 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.409 ±2,99 1.397 ±3 93,9% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1.382 [1.364–1.399] Perzentil 35 · #97 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.399 ±10 1.397 ±10 91,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Français 1.375 [1.351–1.399] Perzentil 32 · #92 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.409 ±15 1.395 ±14 89,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1.415 [1.397–1.434] Perzentil 66 · #44 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1.411 ±14 1.435 ±10 91,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1.390 [1.375–1.406] Perzentil 47 · #73 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.361 ±11 1.406 ±8 92,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1.418 [1.406–1.429] Perzentil 63 · #49 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.431 ±7,44 1.434 ±6 93,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1.399 [1.388–1.409] Perzentil 60 · #94 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.407 ±6,34 1.413 ±6 93,3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5 1.404 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5

Daten CC BY 4.0: Link zu fedi.software beibehalten.