Zum Inhalt springen
fedi.software

muse-spark im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1’439 ±8

Perzentil 87 · #40

Menschen bevorzugen / Löst Aufgaben

1’445 / 1’430

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

—

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

A Allgemein 1’439 [1’432–1’447] Perzentil 87 · #40 · Komponenten: 8
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 152 ±1.37 1’454 ±11 34.4% 2026-04-08 —
LMArena text/overall 1’474 ±2.92 1’474 ±3 16.8% 2026-10-02 —
LMArena text/hard_prompts 1’475 ±3.49 1’462 ±3 16.7% 2026-10-02 —
LMArena text/instruction_following 1’443 ±4.58 1’454 ±4 8.0% 2026-10-02 —
LMArena text/expert 1’458 ±8.16 1’442 ±7 7.3% 2026-10-02 —
LMArena text/longer_query 1’452 ±4.35 1’448 ±4 4.0% 2026-10-02 —
LMArena text/multi_turn 1’478 ±6.68 1’469 ±6 3.7% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0.26 0.90 ±0.02 1’457 ±10 1.6% 2026-04-08 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Code 1’429 [1’421–1’437] Perzentil 82 · #50 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’482 ±5.03 1’455 ±4 89.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1’410 [1’394–1’426] Perzentil 77 · #59 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’455 ±9.95 1’446 ±10 85.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Vision 1’460 [1’454–1’466] Perzentil 90 · #12 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’305 ±4.64 1’480 ±4 63.8% 2026-10-02 —
LMArena vision/ocr 1’306 ±5.06 1’478 ±5 15.6% 2026-10-02 —
LMArena vision/diagram 1’309 ±7.74 1’471 ±7 14.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’456 [1’448–1’465] Perzentil 90 · #27 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’460 ±6.95 1’490 ±7 59.4% 2026-10-02 —
LMArena text/longer_query 1’452 ±4.35 1’448 ±4 33.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 繁體中文 1’441 [1’426–1’455] Perzentil 84 · #37 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’508 ±10 1’460 ±8 92.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1’456 [1’448–1’464] Perzentil 93 · #19 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’480 ±3.90 1’473 ±4 93.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Español 1’439 [1’417–1’461] Perzentil 82 · #27 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’471 ±13 1’464 ±12 90.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Français 1’448 [1’425–1’471] Perzentil 87 · #19 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’497 ±14 1’475 ±13 90.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Polski 1’441 [1’416–1’466] Perzentil 85 · #21 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’473 ±17 1’470 ±14 89.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1’449 [1’436–1’461] Perzentil 88 · #30 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’467 ±7.72 1’467 ±7 93.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
muse-spark 1’439 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: muse-spark

Daten CC BY 4.0: Link zu fedi.software beibehalten.