Zum Inhalt springen
fedi.software

GPT-5 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’404 ±6

Perzentil 70 · #87

Menschen bevorzugen / Löst Aufgaben

1’395 / 1’417

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-4

$ 3.44 pro 1 Mio. Tokens, Median von 27 Anbietern · beim Hersteller $ 3.44

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’404 [1’397–1’410] Perzentil 70 · #87 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 150 1’438 ±11 29.8% 2025-08-07 —
LMArena text/overall 1’406 ±2.26 1’406 ±2 16.8% 2026-10-02 high
LMArena text/hard_prompts 1’415 ±2.93 1’409 ±3 16.7% 2026-10-02 high
LMArena text/instruction_following 1’388 ±3.62 1’402 ±3 8.2% 2026-10-02 high
LMArena text/expert 1’420 ±7.62 1’411 ±6 7.3% 2026-10-02 high
Epoch AI simpleqa_verified Alterung ×0.61 0.50 ±0.02 1’455 ±5 4.1% 2026-08-27 high
LMArena text/longer_query 1’399 ±3.83 1’400 ±4 4.1% 2026-10-02 —
LMArena text/multi_turn 1’426 ±4.24 1’423 ±4 4.0% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0.26 0.86 ±0.02 1’441 ±10 1.4% 2025-10-29 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’406 [1’401–1’410] Perzentil 70 · #83 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’417 ±7.92 1’426 ±2 39.6% 2026-10-01 medium
LMArena text/coding 1’436 ±4.04 1’413 ±4 38.3% 2026-10-02 high
Epoch AI swe_bench_verified Alterung ×0.37 0.74 ±0.02 1’450 ±10 13.6% 2026-02-06 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1’400 [1’392–1’408] Perzentil 71 · #74 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’406 ±7.02 1’399 ±7 50.8% 2026-10-02 —
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.55 ±0.03 1’441 ±6 29.7% 2026-06-10 high
Epoch AI frontiermath_t4 Alterung ×0.86 0.22 ±0.07 1’428 ±10 11.8% 2026-06-11 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1’402 [1’398–1’407] Perzentil 46 · #61 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’232 ±3.59 1’413 ±3 63.9% 2026-10-02 —
LMArena vision/ocr 1’245 ±4.61 1’419 ±4 15.4% 2026-10-02 —
LMArena vision/diagram 1’252 ±6.78 1’421 ±6 14.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’383 [1’377–1’389] Perzentil 58 · #114 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’365 ±4.87 1’393 ±5 61.4% 2026-10-02 —
LMArena text/longer_query 1’399 ±3.83 1’400 ±4 32.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1’380 [1’371–1’389] Perzentil 48 · #117 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’423 ±6.34 1’392 ±5 93.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1’397 [1’380–1’415] Perzentil 56 · #64 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’414 ±11 1’415 ±10 91.8% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’385 [1’380–1’391] Perzentil 58 · #115 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’409 ±2.99 1’397 ±3 93.9% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1’382 [1’364–1’399] Perzentil 35 · #97 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’399 ±10 1’397 ±10 91.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Français 1’375 [1’351–1’399] Perzentil 32 · #92 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’409 ±15 1’395 ±14 89.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1’415 [1’397–1’434] Perzentil 66 · #44 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’411 ±14 1’435 ±10 91.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1’390 [1’375–1’406] Perzentil 47 · #73 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’361 ±11 1’406 ±8 92.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1’418 [1’406–1’429] Perzentil 63 · #49 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’431 ±7.44 1’434 ±6 93.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’399 [1’388–1’409] Perzentil 60 · #94 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’407 ±6.34 1’413 ±6 93.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5 1’404 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5

Daten CC BY 4.0: Link zu fedi.software beibehalten.