Zum Inhalt springen
fedi.software

grok-4.1-thinking im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1.400 ±2

Perzentil 68 · #95 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1.411 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-12

4 $ pro 1 Mio. Tokens, Median von 1 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1.400 [1.398–1.401] Perzentil 68 · #95 · Komponenten: 6 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1.437 ±1,61 1.437 ±2 25,6% 2026-10-02 thinking
LMArena text/hard_prompts 1.435 ±2,02 1.427 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1.400 ±2,57 1.413 ±2 12,6% 2026-10-02 —
LMArena text/expert 1.417 ±4,45 1.409 ±4 12,2% 2026-10-02 thinking
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1.438 ±3,15 1.433 ±3 6,3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.380 [1.377–1.382] Perzentil 57 · #120 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1.241 ±5,65 1.376 ±2 45,6% 2026-10-01 fast-reasoning
LMArena text/coding 1.445 ±2,80 1.422 ±2 44,8% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1.389 [1.381–1.397] Perzentil 62 · #98 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.422 ±4,91 1.414 ±5 87,9% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1.371 [1.367–1.376] Perzentil 38 · #70 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1.201 ±3,54 1.385 ±3 63,3% 2026-10-02 fast-reasoning
LMArena vision/ocr 1.195 ±3,78 1.370 ±4 15,6% 2026-10-02 fast-reasoning
LMArena vision/diagram 1.210 ±5,59 1.384 ±5 14,9% 2026-10-02 fast-reasoning

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.418 [1.413–1.422] Perzentil 73 · #72 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.411 ±3,37 1.440 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 31,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1.411 [1.405–1.418] Perzentil 67 · #74 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.464 ±4,42 1.425 ±4 93,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1.425 [1.411–1.439] Perzentil 74 · #38 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.446 ±9,00 1.442 ±8 92,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.423 [1.419–1.427] Perzentil 75 · #69 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.447 ±2,24 1.437 ±2 94,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1.418 [1.406–1.430] Perzentil 64 · #55 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.438 ±7,27 1.434 ±7 93,0% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1.414 [1.401–1.427] Perzentil 55 · #61 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.448 ±7,97 1.430 ±7 92,8% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1.407 [1.391–1.422] Perzentil 58 · #54 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1.396 ±11 1.424 ±8 92,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1.423 [1.410–1.436] Perzentil 72 · #39 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.407 ±9,39 1.440 ±7 92,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Polski 1.437 [1.426–1.448] Perzentil 82 · #25 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.455 ±7,00 1.454 ±6 93,3% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1.423 [1.417–1.429] Perzentil 75 · #60 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.434 ±3,63 1.437 ±3 93,9% 2026-10-02 thinking

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
grok-4.1-thinking 1.400 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: grok-4.1-thinking

Daten CC BY 4.0: Link zu fedi.software beibehalten.