Zum Inhalt springen
fedi.software

Grok 4.20 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1’425 ±8

Perzentil 81 · #56

Menschen bevorzugen / Löst Aufgaben

1’419 / 1’432

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+33

$ 1.77 pro 1 Mio. Tokens, Median von 3 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

A Allgemein 1’425 [1’417–1’433] Perzentil 81 · #56 · Komponenten: 7
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 152 ±1.30 1’453 ±10 38.7% 2026-02-17 —
LMArena text/overall 1’444 ±2.32 1’444 ±2 15.8% 2026-10-02 —
LMArena text/hard_prompts 1’441 ±2.78 1’432 ±2 15.8% 2026-10-02 —
LMArena text/instruction_following 1’415 ±3.55 1’427 ±3 7.7% 2026-10-02 —
LMArena text/expert 1’428 ±6.29 1’418 ±5 7.3% 2026-10-02 —
LMArena text/longer_query 1’427 ±3.45 1’426 ±3 3.9% 2026-10-02 —
LMArena text/multi_turn 1’451 ±4.77 1’445 ±4 3.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’401 [1’395–1’407] Perzentil 68 · #90 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’447 ±3.83 1’423 ±3 90.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1’396 [1’384–1’408] Perzentil 68 · #83 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’433 ±7.35 1’425 ±7 86.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Suche 1’417 [1’411–1’423] Perzentil 47 · #18 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena search/overall 1’189 ±3.08 1’431 ±3 93.9% 2026-08-24 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’437 [1’430–1’443] Perzentil 82 · #49 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’438 ±4.92 1’467 ±5 61.1% 2026-10-02 —
LMArena text/longer_query 1’427 ±3.45 1’426 ±3 32.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1’418 [1’407–1’429] Perzentil 71 · #66 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’475 ±7.46 1’434 ±6 93.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Deutsch 1’433 [1’412–1’454] Perzentil 82 · #27 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’463 ±14 1’457 ±12 90.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1’427 [1’421–1’433] Perzentil 80 · #55 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’451 ±3.09 1’442 ±3 93.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1’416 [1’400–1’433] Perzentil 62 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’439 ±9.94 1’434 ±9 92.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1’418 [1’400–1’436] Perzentil 59 · #56 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’455 ±11 1’438 ±10 91.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1’426 [1’407–1’446] Perzentil 73 · #37 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’416 ±14 1’448 ±11 91.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1’415 [1’396–1’433] Perzentil 57 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’432 ±12 1’434 ±10 91.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1’434 [1’425–1’443] Perzentil 81 · #45 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’448 ±5.42 1’450 ±5 93.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
Grok 4.20 1’425 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: Grok 4.20

Daten CC BY 4.0: Link zu fedi.software beibehalten.