Zum Inhalt springen
fedi.software

Grok 4.20 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1.425 ±8

Perzentil 81 · #56

Menschen bevorzugen / Löst Aufgaben

1.419 / 1.432

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+33

1,77 $ pro 1 Mio. Tokens, Median von 3 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

A Allgemein 1.425 [1.417–1.433] Perzentil 81 · #56 · Komponenten: 7
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 152 ±1,30 1.453 ±10 38,7% 2026-02-17 —
LMArena text/overall 1.444 ±2,32 1.444 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1.441 ±2,78 1.432 ±2 15,8% 2026-10-02 —
LMArena text/instruction_following 1.415 ±3,55 1.427 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.428 ±6,29 1.418 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1.427 ±3,45 1.426 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1.451 ±4,77 1.445 ±4 3,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.401 [1.395–1.407] Perzentil 68 · #90 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.447 ±3,83 1.423 ±3 90,1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1.396 [1.384–1.408] Perzentil 68 · #83 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.433 ±7,35 1.425 ±7 86,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Suche 1.417 [1.411–1.423] Perzentil 47 · #18 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena search/overall 1.189 ±3,08 1.431 ±3 93,9% 2026-08-24 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1.437 [1.430–1.443] Perzentil 82 · #49 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.438 ±4,92 1.467 ±5 61,1% 2026-10-02 —
LMArena text/longer_query 1.427 ±3,45 1.426 ±3 32,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1.418 [1.407–1.429] Perzentil 71 · #66 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.475 ±7,46 1.434 ±6 93,3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Deutsch 1.433 [1.412–1.454] Perzentil 82 · #27 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.463 ±14 1.457 ±12 90,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1.427 [1.421–1.433] Perzentil 80 · #55 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.451 ±3,09 1.442 ±3 93,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1.416 [1.400–1.433] Perzentil 62 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.439 ±9,94 1.434 ±9 92,1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1.418 [1.400–1.436] Perzentil 59 · #56 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.455 ±11 1.438 ±10 91,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1.426 [1.407–1.446] Perzentil 73 · #37 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.416 ±14 1.448 ±11 91,3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1.415 [1.396–1.433] Perzentil 57 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.432 ±12 1.434 ±10 91,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1.434 [1.425–1.443] Perzentil 81 · #45 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.448 ±5,42 1.450 ±5 93,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
Grok 4.20 1.425 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: Grok 4.20

Daten CC BY 4.0: Link zu fedi.software beibehalten.