Zum Inhalt springen
fedi.software

grok-3-preview-02-24 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’398 ±3

Perzentil 66 · #99 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1’410 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-24

$ 6 pro 1 Mio. Tokens, Median von 1 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’398 [1’395–1’400] Perzentil 66 · #99 · Komponenten: 6 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1’426 ±2.20 1’426 ±2 26.1% 2026-10-02 —
LMArena text/hard_prompts 1’433 ±3.24 1’425 ±3 25.7% 2026-10-02 —
LMArena text/instruction_following 1’409 ±3.36 1’421 ±3 12.8% 2026-10-02 —
LMArena text/expert 1’420 ±7.68 1’411 ±6 11.4% 2026-10-02 —
LMArena text/longer_query 1’439 ±4.42 1’437 ±4 6.2% 2026-10-02 —
LMArena text/multi_turn 1’424 ±4.58 1’421 ±4 6.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’389 [1’382–1’396] Perzentil 62 · #107 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’432 ±4.24 1’410 ±4 90.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1’361 [1’352–1’371] Perzentil 49 · #130 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’390 ±5.66 1’384 ±5 87.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’426 [1’419–1’432] Perzentil 77 · #62 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’414 ±4.66 1’443 ±5 61.9% 2026-10-02 —
LMArena text/longer_query 1’439 ±4.42 1’437 ±4 31.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1’398 [1’388–1’408] Perzentil 55 · #100 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’448 ±6.96 1’412 ±6 93.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1’411 [1’394–1’428] Perzentil 65 · #51 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’431 ±11 1’429 ±10 92.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’414 [1’409–1’420] Perzentil 69 · #85 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’438 ±2.78 1’428 ±3 93.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1’392 [1’367–1’417] Perzentil 44 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’417 ±15 1’414 ±14 89.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1’416 [1’391–1’442] Perzentil 58 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’460 ±16 1’442 ±14 89.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1’402 [1’387–1’416] Perzentil 54 · #60 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’388 ±11 1’418 ±8 92.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1’397 [1’378–1’416] Perzentil 51 · #67 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’374 ±14 1’416 ±11 91.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1’419 [1’407–1’431] Perzentil 65 · #46 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’433 ±7.86 1’435 ±7 93.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’407 [1’398–1’416] Perzentil 64 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’416 ±5.67 1’421 ±5 93.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
grok-3-preview-02-24 1’398 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: grok-3-preview-02-24

Daten CC BY 4.0: Link zu fedi.software beibehalten.