Zum Inhalt springen
fedi.software

GPT-4.1 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

C 1.353 ±6

Perzentil 48 · #154

Menschen bevorzugen / Löst Aufgaben

1.370 / 1.324

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-56

3,50 $ pro 1 Mio. Tokens, Median von 23 Anbietern · beim Hersteller 3,50 $

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

C Allgemein 1.353 [1.346–1.359] Perzentil 48 · #154 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 137 ±1,27 1.333 ±10 31,2% 2025-04-14 —
LMArena text/overall 1.383 ±1,89 1.383 ±2 16,9% 2026-10-02 —
LMArena text/hard_prompts 1.384 ±2,49 1.380 ±2 16,8% 2026-10-02 —
LMArena text/instruction_following 1.367 ±2,93 1.382 ±3 8,3% 2026-10-02 —
LMArena text/expert 1.364 ±5,94 1.365 ±5 7,8% 2026-10-02 —
LMArena text/longer_query 1.385 ±3,26 1.387 ±3 4,1% 2026-10-02 —
LMArena text/multi_turn 1.398 ±3,49 1.397 ±3 4,1% 2026-10-02 —
Epoch AI simpleqa_verified Ausreißer Alterung ×0,61 0,31 ±0,01 1.395 ±5 2,1% 2026-08-31 —
Epoch AI gpqa_diamond Alterung ×0,26 0,67 ±0,03 1.351 ±13 1,1% 2025-04-14 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Code 1.352 [1.346–1.358] Perzentil 46 · #152 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.391 ±3,37 1.373 ±3 78,9% 2026-10-02 —
Epoch AI swe_bench_verified Alterung ×0,37 0,49 ±0,02 1.322 ±12 12,6% 2026-02-08 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1.340 [1.334–1.345] Perzentil 43 · #146 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.369 ±5,23 1.364 ±5 48,5% 2026-10-02 —
Epoch AI frontiermath_t1_3 Alterung ×0,86 0,06 ±0,01 1.334 ±3 44,7% 2026-08-27 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1.381 [1.376–1.385] Perzentil 41 · #67 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1.210 ±3,40 1.394 ±3 64,0% 2026-10-02 —
LMArena vision/ocr 1.218 ±4,54 1.392 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1.215 ±6,62 1.388 ±6 14,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.378 [1.373–1.383] Perzentil 57 · #117 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.364 ±3,92 1.391 ±4 61,9% 2026-10-02 —
LMArena text/longer_query 1.385 ±3,26 1.387 ±3 31,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1.350 [1.342–1.358] Perzentil 38 · #139 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.382 ±5,41 1.360 ±4 93,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Deutsch 1.372 [1.359–1.385] Perzentil 42 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.380 ±8,47 1.385 ±7 92,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.369 [1.364–1.374] Perzentil 54 · #126 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.392 ±2,46 1.380 ±3 94,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1.363 [1.347–1.378] Perzentil 28 · #108 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.376 ±9,28 1.376 ±9 92,3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Français 1.356 [1.338–1.375] Perzentil 25 · #101 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.382 ±11 1.371 ±10 91,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 日本語 1.355 [1.342–1.368] Perzentil 32 · #88 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1.319 ±9,56 1.366 ±7 92,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1.376 [1.362–1.389] Perzentil 36 · #87 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.339 ±9,65 1.389 ±7 92,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Polski 1.385 [1.376–1.394] Perzentil 35 · #85 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.389 ±5,88 1.398 ±5 93,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Русский 1.374 [1.366–1.382] Perzentil 48 · #123 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.377 ±4,80 1.386 ±4 93,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-4.1 1.353 C

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-4.1

Daten CC BY 4.0: Link zu fedi.software beibehalten.