Zum Inhalt springen
fedi.software

llama-3.1-tulu-3-8b im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

D 1’194 ±7

Perzentil 22 · #228 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1’193 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

—

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

D Allgemein 1’194 [1’187–1’200] Perzentil 22 · #228 · Komponenten: 5 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1’193 ±5.35 1’193 ±5 32.8% 2026-10-02 —
LMArena text/hard_prompts 1’174 ±9.98 1’191 ±9 27.2% 2026-10-02 —
LMArena text/instruction_following 1’174 ±7.87 1’199 ±8 14.8% 2026-10-02 —
LMArena text/multi_turn 1’154 ±13 1’175 ±12 5.8% 2026-10-02 —
LMArena text/longer_query 1’181 ±13 1’196 ±12 5.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Code 1’190 [1’172–1’209] Perzentil 21 · #220 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’183 ±12 1’188 ±11 86.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Mathematik 1’197 [1’177–1’218] Perzentil 24 · #195 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’195 ±13 1’196 ±12 82.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Schreiben 1’202 [1’185–1’219] Perzentil 23 · #206 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’182 ±13 1’205 ±13 58.9% 2026-10-02 —
LMArena text/longer_query 1’181 ±13 1’196 ±12 31.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: English 1’193 [1’180–1’206] Perzentil 25 · #206 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’215 ±6.94 1’192 ±7 92.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Русский 1’219 [1’199–1’239] Perzentil 16 · #196 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’193 ±13 1’221 ±11 91.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
llama-3.1-tulu-3-8b 1’194 D

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: llama-3.1-tulu-3-8b

Daten CC BY 4.0: Link zu fedi.software beibehalten.