Zum Inhalt springen
fedi.software

GPT-5.1 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1’426 ±4

Perzentil 82 · #55

Menschen bevorzugen / Löst Aufgaben

1’432 / 1’418

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+18

$ 3.44 pro 1 Mio. Tokens, Median von 26 Anbietern · beim Hersteller $ 3.44

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

A Allgemein 1’426 [1’422–1’430] Perzentil 82 · #55 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 150 ±0.72 1’435 ±6 35.7% 2025-11-13 —
LMArena text/overall 1’443 ±1.88 1’443 ±2 15.3% 2026-10-02 high
LMArena text/hard_prompts 1’457 ±2.45 1’446 ±2 15.2% 2026-10-02 high
LMArena text/instruction_following 1’443 ±3.20 1’454 ±3 7.5% 2026-10-02 high
LMArena text/expert 1’470 ±6.01 1’452 ±5 7.0% 2026-10-02 high
LMArena text/longer_query 1’448 ±3.22 1’445 ±3 3.7% 2026-10-02 high
Epoch AI simpleqa_verified Alterung ×0.61 0.48 ±0.02 1’448 ±5 3.7% 2026-08-27 high
LMArena text/multi_turn 1’450 ±3.83 1’444 ±4 3.7% 2026-10-02 high
Epoch AI gpqa_diamond Alterung ×0.26 0.88 ±0.02 1’447 ±9 1.4% 2025-11-13 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’405 [1’402–1’409] Perzentil 70 · #84 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’395 ±5.86 1’420 ±2 39.9% 2026-10-01 medium
LMArena text/coding 1’454 ±3.51 1’429 ±3 38.7% 2026-10-02 high
Epoch AI swe_bench_verified Alterung ×0.37 0.68 ±0.02 1’422 ±11 13.0% 2026-02-18 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1’408 [1’398–1’418] Perzentil 76 · #62 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’446 ±5.91 1’438 ±6 87.5% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Vision 1’415 [1’410–1’420] Perzentil 56 · #50 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’250 ±3.98 1’429 ±4 63.5% 2026-10-02 high
LMArena vision/ocr 1’255 ±4.47 1’428 ±4 15.5% 2026-10-02 high
LMArena vision/diagram 1’265 ±6.41 1’432 ±6 14.7% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’437 [1’431–1’442] Perzentil 81 · #51 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’427 ±4.10 1’456 ±4 61.8% 2026-10-02 high
LMArena text/longer_query 1’448 ±3.22 1’445 ±3 32.0% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 繁體中文 1’434 [1’426–1’441] Perzentil 81 · #44 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’495 ±5.26 1’449 ±4 93.7% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1’417 [1’400–1’434] Perzentil 66 · #49 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’439 ±11 1’436 ±10 91.9% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’427 [1’422–1’432] Perzentil 79 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’451 ±2.74 1’442 ±3 93.9% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1’410 [1’395–1’425] Perzentil 53 · #71 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’431 ±8.85 1’427 ±8 92.5% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1’415 [1’398–1’432] Perzentil 57 · #59 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’450 ±10 1’433 ±9 92.0% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 日本語 1’444 [1’425–1’463] Perzentil 87 · #18 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’453 ±14 1’466 ±11 91.4% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1’418 [1’401–1’434] Perzentil 67 · #45 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’401 ±12 1’436 ±9 92.2% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1’424 [1’411–1’438] Perzentil 68 · #42 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’440 ±8.62 1’442 ±7 92.8% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’424 [1’417–1’431] Perzentil 76 · #58 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’435 ±4.22 1’439 ±4 93.8% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5.1 1’426 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5.1

Daten CC BY 4.0: Link zu fedi.software beibehalten.