Zum Inhalt springen
fedi.software

GPT-4.1 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

C 1’353 ±6

Perzentil 48 · #154

Menschen bevorzugen / Löst Aufgaben

1’370 / 1’324

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-56

$ 3.50 pro 1 Mio. Tokens, Median von 23 Anbietern · beim Hersteller $ 3.50

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

C Allgemein 1’353 [1’346–1’359] Perzentil 48 · #154 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 137 ±1.27 1’333 ±10 31.2% 2025-04-14 —
LMArena text/overall 1’383 ±1.89 1’383 ±2 16.9% 2026-10-02 —
LMArena text/hard_prompts 1’384 ±2.49 1’380 ±2 16.8% 2026-10-02 —
LMArena text/instruction_following 1’367 ±2.93 1’382 ±3 8.3% 2026-10-02 —
LMArena text/expert 1’364 ±5.94 1’365 ±5 7.8% 2026-10-02 —
LMArena text/longer_query 1’385 ±3.26 1’387 ±3 4.1% 2026-10-02 —
LMArena text/multi_turn 1’398 ±3.49 1’397 ±3 4.1% 2026-10-02 —
Epoch AI simpleqa_verified Ausreisser Alterung ×0.61 0.31 ±0.01 1’395 ±5 2.1% 2026-08-31 —
Epoch AI gpqa_diamond Alterung ×0.26 0.67 ±0.03 1’351 ±13 1.1% 2025-04-14 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Code 1’352 [1’346–1’358] Perzentil 46 · #152 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’391 ±3.37 1’373 ±3 78.9% 2026-10-02 —
Epoch AI swe_bench_verified Alterung ×0.37 0.49 ±0.02 1’322 ±12 12.6% 2026-02-08 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1’340 [1’334–1’345] Perzentil 43 · #146 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’369 ±5.23 1’364 ±5 48.5% 2026-10-02 —
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.06 ±0.01 1’334 ±3 44.7% 2026-08-27 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1’381 [1’376–1’385] Perzentil 41 · #67 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’210 ±3.40 1’394 ±3 64.0% 2026-10-02 —
LMArena vision/ocr 1’218 ±4.54 1’392 ±4 15.4% 2026-10-02 —
LMArena vision/diagram 1’215 ±6.62 1’388 ±6 14.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’378 [1’373–1’383] Perzentil 57 · #117 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’364 ±3.92 1’391 ±4 61.9% 2026-10-02 —
LMArena text/longer_query 1’385 ±3.26 1’387 ±3 31.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1’350 [1’342–1’358] Perzentil 38 · #139 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’382 ±5.41 1’360 ±4 93.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Deutsch 1’372 [1’359–1’385] Perzentil 42 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’380 ±8.47 1’385 ±7 92.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’369 [1’364–1’374] Perzentil 54 · #126 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’392 ±2.46 1’380 ±3 94.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1’363 [1’347–1’378] Perzentil 28 · #108 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’376 ±9.28 1’376 ±9 92.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Français 1’356 [1’338–1’375] Perzentil 25 · #101 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’382 ±11 1’371 ±10 91.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 日本語 1’355 [1’342–1’368] Perzentil 32 · #88 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’319 ±9.56 1’366 ±7 92.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1’376 [1’362–1’389] Perzentil 36 · #87 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’339 ±9.65 1’389 ±7 92.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Polski 1’385 [1’376–1’394] Perzentil 35 · #85 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’389 ±5.88 1’398 ±5 93.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Русский 1’374 [1’366–1’382] Perzentil 48 · #123 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’377 ±4.80 1’386 ±4 93.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-4.1 1’353 C

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-4.1

Daten CC BY 4.0: Link zu fedi.software beibehalten.