Zum Inhalt springen
fedi.software

Grok 4.20 (Reasoning) im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’414 ±2

Perzentil 76 · #70

Menschen bevorzugen / Löst Aufgaben

1’426 / 1’374

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+26

$ 1.56 pro 1 Mio. Tokens, Median von 13 Anbietern · beim Hersteller $ 1.56

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’414 [1’412–1’417] Perzentil 76 · #70 · Komponenten: 8
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1’451 ±1.87 1’451 ±2 21.0% 2026-10-02 —
LMArena text/hard_prompts 1’451 ±2.25 1’441 ±2 21.0% 2026-10-02 —
Epoch AI simpleqa_verified Ausreisser Alterung ×0.61 0.30 ±0.01 1’392 ±5 10.4% 2026-08-27 —
LMArena text/instruction_following 1’420 ±2.71 1’432 ±3 10.4% 2026-10-02 —
LMArena text/expert 1’440 ±4.12 1’427 ±3 10.2% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0.26 0.89 ±0.02 1’455 ±9 7.4% 2026-07-13 —
LMArena text/longer_query 1’436 ±2.62 1’434 ±2 5.2% 2026-10-02 —
LMArena text/multi_turn 1’456 ±3.33 1’450 ±3 5.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’402 [1’400–1’405] Perzentil 69 · #87 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’374 ±3.09 1’414 ±1 45.8% 2026-10-01 —
LMArena text/coding 1’459 ±2.93 1’434 ±3 44.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Mathematik 1’417 [1’411–1’424] Perzentil 82 · #47 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’455 ±5.33 1’446 ±5 52.3% 2026-10-02 —
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.45 ±0.03 1’418 ±6 28.4% 2026-07-13 —
Epoch AI frontiermath_t4 Alterung ×0.86 0.17 ±0.06 1’420 ±10 12.0% 2026-07-13 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Vision 1’425 [1’421–1’429] Perzentil 62 · #44 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’263 ±3.11 1’441 ±3 63.0% 2026-10-02 —
LMArena vision/ocr 1’266 ±3.11 1’439 ±3 15.7% 2026-10-02 —
LMArena vision/diagram 1’266 ±4.36 1’433 ±4 15.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’437 [1’432–1’441] Perzentil 82 · #50 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’432 ±3.44 1’461 ±4 62.0% 2026-10-02 —
LMArena text/longer_query 1’436 ±2.62 1’434 ±2 31.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1’424 [1’417–1’431] Perzentil 75 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’481 ±4.99 1’439 ±4 93.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1’420 [1’404–1’435] Perzentil 68 · #47 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’441 ±9.76 1’437 ±8 92.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1’433 [1’429–1’438] Perzentil 84 · #44 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’457 ±2.47 1’448 ±3 94.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1’423 [1’410–1’435] Perzentil 70 · #46 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’444 ±7.18 1’439 ±7 93.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Français 1’439 [1’427–1’451] Perzentil 81 · #26 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’476 ±7.34 1’457 ±7 93.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1’418 [1’402–1’434] Perzentil 70 · #39 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’413 ±12 1’436 ±9 92.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1’430 [1’416–1’444] Perzentil 78 · #31 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’416 ±10 1’448 ±8 92.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1’433 [1’420–1’446] Perzentil 79 · #28 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’451 ±8.56 1’451 ±7 92.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1’443 [1’436–1’449] Perzentil 86 · #33 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’458 ±3.91 1’459 ±4 93.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
Grok 4.20 (Reasoning) 1’414 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: Grok 4.20 (Reasoning)

Daten CC BY 4.0: Link zu fedi.software beibehalten.