Zum Inhalt springen
fedi.software

grok-3-preview-02-24 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1.398 ±3

Perzentil 66 · #99 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1.410 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-24

6 $ pro 1 Mio. Tokens, Median von 1 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1.398 [1.395–1.400] Perzentil 66 · #99 · Komponenten: 6 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1.426 ±2,20 1.426 ±2 26,1% 2026-10-02 —
LMArena text/hard_prompts 1.433 ±3,24 1.425 ±3 25,7% 2026-10-02 —
LMArena text/instruction_following 1.409 ±3,36 1.421 ±3 12,8% 2026-10-02 —
LMArena text/expert 1.420 ±7,68 1.411 ±6 11,4% 2026-10-02 —
LMArena text/longer_query 1.439 ±4,42 1.437 ±4 6,2% 2026-10-02 —
LMArena text/multi_turn 1.424 ±4,58 1.421 ±4 6,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.389 [1.382–1.396] Perzentil 62 · #102 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.432 ±4,24 1.410 ±4 90,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1.361 [1.352–1.371] Perzentil 49 · #130 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.390 ±5,66 1.384 ±5 87,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.426 [1.419–1.432] Perzentil 77 · #62 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.414 ±4,66 1.443 ±5 61,9% 2026-10-02 —
LMArena text/longer_query 1.439 ±4,42 1.437 ±4 31,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1.398 [1.388–1.408] Perzentil 55 · #100 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.448 ±6,96 1.412 ±6 93,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1.411 [1.394–1.428] Perzentil 65 · #51 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.431 ±11 1.429 ±10 92,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.414 [1.409–1.420] Perzentil 69 · #85 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.438 ±2,78 1.428 ±3 93,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1.392 [1.367–1.417] Perzentil 44 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.417 ±15 1.414 ±14 89,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1.416 [1.391–1.442] Perzentil 58 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.460 ±16 1.442 ±14 89,3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1.402 [1.387–1.416] Perzentil 54 · #60 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1.388 ±11 1.418 ±8 92,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1.397 [1.378–1.416] Perzentil 51 · #67 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.374 ±14 1.416 ±11 91,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1.419 [1.407–1.431] Perzentil 65 · #46 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.433 ±7,86 1.435 ±7 93,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1.407 [1.398–1.416] Perzentil 64 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.416 ±5,67 1.421 ±5 93,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
grok-3-preview-02-24 1.398 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: grok-3-preview-02-24

Daten CC BY 4.0: Link zu fedi.software beibehalten.