Zum Inhalt springen
fedi.software

grok-4.1-thinking im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’400 ±2

Perzentil 68 · #95 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1’411 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-12

$ 4 pro 1 Mio. Tokens, Median von 1 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’400 [1’398–1’401] Perzentil 68 · #95 · Komponenten: 6 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1’437 ±1.61 1’437 ±2 25.6% 2026-10-02 thinking
LMArena text/hard_prompts 1’435 ±2.02 1’427 ±2 25.6% 2026-10-02 —
LMArena text/instruction_following 1’400 ±2.57 1’413 ±2 12.6% 2026-10-02 —
LMArena text/expert 1’417 ±4.45 1’409 ±4 12.2% 2026-10-02 thinking
LMArena text/longer_query 1’416 ±2.54 1’415 ±2 6.3% 2026-10-02 —
LMArena text/multi_turn 1’438 ±3.15 1’433 ±3 6.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’380 [1’377–1’382] Perzentil 57 · #120 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’241 ±5.65 1’376 ±2 45.6% 2026-10-01 fast-reasoning
LMArena text/coding 1’445 ±2.80 1’422 ±2 44.8% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1’389 [1’381–1’397] Perzentil 62 · #98 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’422 ±4.91 1’414 ±5 87.9% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1’371 [1’367–1’376] Perzentil 38 · #70 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’201 ±3.54 1’385 ±3 63.3% 2026-10-02 fast-reasoning
LMArena vision/ocr 1’195 ±3.78 1’370 ±4 15.6% 2026-10-02 fast-reasoning
LMArena vision/diagram 1’210 ±5.59 1’384 ±5 14.9% 2026-10-02 fast-reasoning

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’418 [1’413–1’422] Perzentil 73 · #72 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’411 ±3.37 1’440 ±3 62.0% 2026-10-02 —
LMArena text/longer_query 1’416 ±2.54 1’415 ±2 31.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1’411 [1’405–1’418] Perzentil 67 · #74 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’464 ±4.42 1’425 ±4 93.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1’425 [1’411–1’439] Perzentil 74 · #38 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’446 ±9.00 1’442 ±8 92.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’423 [1’419–1’427] Perzentil 75 · #69 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’447 ±2.24 1’437 ±2 94.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1’418 [1’406–1’430] Perzentil 64 · #55 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’438 ±7.27 1’434 ±7 93.0% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1’414 [1’401–1’427] Perzentil 55 · #61 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’448 ±7.97 1’430 ±7 92.8% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1’407 [1’391–1’422] Perzentil 58 · #54 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’396 ±11 1’424 ±8 92.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1’423 [1’410–1’436] Perzentil 72 · #39 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’407 ±9.39 1’440 ±7 92.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Polski 1’437 [1’426–1’448] Perzentil 82 · #25 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’455 ±7.00 1’454 ±6 93.3% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’423 [1’417–1’429] Perzentil 75 · #60 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’434 ±3.63 1’437 ±3 93.9% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
grok-4.1-thinking 1’400 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: grok-4.1-thinking

Daten CC BY 4.0: Link zu fedi.software beibehalten.