Grok 4.20 (Reasoning) im fedi-index
Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.
fedi-index · Allgemein
B 1’414 ±2
Perzentil 76 · #70
Menschen bevorzugen / Löst Aufgaben
1’426 / 1’374
Menschliche Stimmen vs. Benchmarks, Elo-eq
Preis-Leistung
+26
$ 1.56 pro 1 Mio. Tokens, Median von 13 Anbietern · beim Hersteller $ 1.56
Auf deiner Hardware
Geschlossene Gewichte: nur Cloud.
Aufschlüsselung des Werts
B Allgemein 1’414 [1’412–1’417] Perzentil 76 · #70 · Komponenten: 8
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1’451 ±1.87 | 1’451 ±2 | 21.0% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1’451 ±2.25 | 1’441 ±2 | 21.0% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
Ausreisser Alterung ×0.61 |
0.30 ±0.01 | 1’392 ±5 | 10.4% | 2026-08-27 | — |
| LMArena |
text/instruction_following
|
1’420 ±2.71 | 1’432 ±3 | 10.4% | 2026-10-02 | — |
| LMArena |
text/expert
|
1’440 ±4.12 | 1’427 ±3 | 10.2% | 2026-10-02 | — |
| Epoch AI |
gpqa_diamond
Alterung ×0.26 |
0.89 ±0.02 | 1’455 ±9 | 7.4% | 2026-07-13 | — |
| LMArena |
text/longer_query
|
1’436 ±2.62 | 1’434 ±2 | 5.2% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1’456 ±3.33 | 1’450 ±3 | 5.1% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Code 1’402 [1’400–1’405] Perzentil 69 · #87 · Komponenten: 2 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1’374 ±3.09 | 1’414 ±1 | 45.8% | 2026-10-01 | — |
| LMArena |
text/coding
|
1’459 ±2.93 | 1’434 ±3 | 44.6% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
A Mathematik 1’417 [1’411–1’424] Perzentil 82 · #47 · Komponenten: 3
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1’455 ±5.33 | 1’446 ±5 | 52.3% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
Alterung ×0.86 |
0.45 ±0.03 | 1’418 ±6 | 28.4% | 2026-07-13 | — |
| Epoch AI |
frontiermath_t4
Alterung ×0.86 |
0.17 ±0.06 | 1’420 ±10 | 12.0% | 2026-07-13 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Vision 1’425 [1’421–1’429] Perzentil 62 · #44 · Komponenten: 3 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1’263 ±3.11 | 1’441 ±3 | 63.0% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1’266 ±3.11 | 1’439 ±3 | 15.7% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1’266 ±4.36 | 1’433 ±4 | 15.3% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
A Schreiben 1’437 [1’432–1’441] Perzentil 82 · #50 · Komponenten: 2 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1’432 ±3.44 | 1’461 ±4 | 62.0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1’436 ±2.62 | 1’434 ±2 | 31.9% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Sprache: 繁體中文 1’424 [1’417–1’431] Perzentil 75 · #57 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1’481 ±4.99 | 1’439 ±4 | 93.7% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Sprache: Deutsch 1’420 [1’404–1’435] Perzentil 68 · #47 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1’441 ±9.76 | 1’437 ±8 | 92.4% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
A Sprache: English 1’433 [1’429–1’438] Perzentil 84 · #44 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1’457 ±2.47 | 1’448 ±3 | 94.0% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Sprache: Español 1’423 [1’410–1’435] Perzentil 70 · #46 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1’444 ±7.18 | 1’439 ±7 | 93.0% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
A Sprache: Français 1’439 [1’427–1’451] Perzentil 81 · #26 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1’476 ±7.34 | 1’457 ±7 | 93.0% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Sprache: 日本語 1’418 [1’402–1’434] Perzentil 70 · #39 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1’413 ±12 | 1’436 ±9 | 92.2% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Sprache: 한국어 1’430 [1’416–1’444] Perzentil 78 · #31 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1’416 ±10 | 1’448 ±8 | 92.7% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
B Sprache: Polski 1’433 [1’420–1’446] Perzentil 79 · #28 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1’451 ±8.56 | 1’451 ±7 | 92.8% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
A Sprache: Русский 1’443 [1’436–1’449] Perzentil 86 · #33 · Komponenten: 1 vorläufig
| Quelle | Komponente | Wert | Elo-eq | Gewicht | Gemessen | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1’458 ±3.91 | 1’459 ±4 | 93.8% | 2026-10-02 | — |
Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik
Verlauf
Dasselbe als Tabelle
| Modell | 2026-10 |
|---|---|
| Grok 4.20 (Reasoning) | 1’414 B |
Badge
Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.
Daten CC BY 4.0: Link zu fedi.software beibehalten.