Zum Inhalt springen
fedi.software

llama-3.1-tulu-3-8b im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

D 1.194 ±7

Perzentil 22 · #228 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1.193 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

—

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

D Allgemein 1.194 [1.187–1.200] Perzentil 22 · #228 · Komponenten: 5 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1.193 ±5,35 1.193 ±5 32,8% 2026-10-02 —
LMArena text/hard_prompts 1.174 ±9,98 1.191 ±9 27,2% 2026-10-02 —
LMArena text/instruction_following 1.174 ±7,87 1.199 ±8 14,8% 2026-10-02 —
LMArena text/multi_turn 1.154 ±13 1.175 ±12 5,8% 2026-10-02 —
LMArena text/longer_query 1.181 ±13 1.196 ±12 5,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Code 1.190 [1.172–1.209] Perzentil 21 · #220 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.183 ±12 1.188 ±11 86,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Mathematik 1.197 [1.177–1.218] Perzentil 24 · #195 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.195 ±13 1.196 ±12 82,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Schreiben 1.202 [1.185–1.219] Perzentil 23 · #206 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.182 ±13 1.205 ±13 58,9% 2026-10-02 —
LMArena text/longer_query 1.181 ±13 1.196 ±12 31,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: English 1.193 [1.180–1.206] Perzentil 25 · #206 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.215 ±6,94 1.192 ±7 92,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Русский 1.219 [1.199–1.239] Perzentil 16 · #196 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.193 ±13 1.221 ±11 91,1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
llama-3.1-tulu-3-8b 1.194 D

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: llama-3.1-tulu-3-8b

Daten CC BY 4.0: Link zu fedi.software beibehalten.