Zum Inhalt springen
fedi.software

muse-glimmer im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’365 ±5

Perzentil 52 · #142 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1’376 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

—

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’365 [1’360–1’370] Perzentil 52 · #142 · Komponenten: 6 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1’389 ±4.92 1’390 ±5 27.4% 2026-10-02 —
LMArena text/hard_prompts 1’397 ±6.08 1’392 ±6 26.8% 2026-10-02 —
LMArena text/instruction_following 1’374 ±8.26 1’389 ±8 12.0% 2026-10-02 —
LMArena text/expert 1’387 ±14 1’384 ±12 9.4% 2026-10-02 —
LMArena text/longer_query 1’382 ±7.40 1’384 ±7 6.3% 2026-10-02 —
LMArena text/multi_turn 1’400 ±12 1’399 ±11 4.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’382 [1’375–1’388] Perzentil 58 · #117 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’355 ±7.94 1’408 ±2 50.0% 2026-10-01 —
LMArena text/coding 1’417 ±9.16 1’397 ±8 39.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’359 [1’345–1’373] Perzentil 51 · #132 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’339 ±12 1’366 ±12 55.0% 2026-10-02 —
LMArena text/longer_query 1’382 ±7.40 1’384 ±7 36.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1’366 [1’343–1’388] Perzentil 43 · #127 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’412 ±16 1’383 ±13 90.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’361 [1’347–1’376] Perzentil 50 · #136 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’387 ±7.65 1’374 ±8 92.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Русский 1’380 [1’357–1’403] Perzentil 49 · #119 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’392 ±15 1’400 ±13 90.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
muse-glimmer 1’365 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: muse-glimmer

Daten CC BY 4.0: Link zu fedi.software beibehalten.