Zum Inhalt springen
fedi.software

gpt-oss-120b im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

C 1’344 ±8

Perzentil 45 · #161

Menschen bevorzugen / Löst Aufgaben

1’345 / 1’341

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-2

$ 0.2625 pro 1 Mio. Tokens, Median von 52 Anbietern

Auf deiner Hardware

  • GPU 12 GB #8 · MXFP4 · ≈19 Tok./s
  • GPU 24 GB #12 · MXFP4 · ≈25 Tok./s
  • 128 GB Unified Memory #17 · MXFP4 · ≈44 Tok./s

Aufschlüsselung des Werts

C Allgemein 1’344 [1’335–1’352] Perzentil 45 · #161 · Komponenten: 8
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 140 ±1.93 1’358 ±15 27.9% 2025-08-05 —
LMArena text/overall 1’365 ±2.23 1’365 ±2 18.4% 2026-10-02 —
LMArena text/hard_prompts 1’364 ±2.88 1’362 ±3 18.3% 2026-10-02 —
LMArena text/instruction_following 1’318 ±3.60 1’335 ±3 9.0% 2026-10-02 —
LMArena text/expert 1’356 ±8.15 1’358 ±7 7.9% 2026-10-02 —
LMArena text/longer_query 1’319 ±3.92 1’325 ±4 4.4% 2026-10-02 —
LMArena text/multi_turn 1’340 ±4.45 1’344 ±4 4.4% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0.26 0.76 ±0.03 1’392 ±13 1.5% 2025-12-11 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Code 1’348 [1’341–1’354] Perzentil 43 · #158 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’380 ±3.95 1’364 ±4 90.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1’359 [1’347–1’370] Perzentil 48 · #134 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’388 ±7.07 1’382 ±7 86.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Schreiben 1’301 [1’295–1’308] Perzentil 38 · #166 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’274 ±4.99 1’300 ±5 61.3% 2026-10-02 —
LMArena text/longer_query 1’319 ±3.92 1’325 ±4 32.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1’351 [1’342–1’360] Perzentil 39 · #137 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’384 ±6.47 1’362 ±5 93.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Deutsch 1’349 [1’331–1’367] Perzentil 34 · #95 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’354 ±12 1’362 ±10 91.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: English 1’352 [1’346–1’357] Perzentil 46 · #148 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’375 ±3.00 1’361 ±3 93.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1’372 [1’354–1’390] Perzentil 30 · #105 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’388 ±11 1’388 ±10 91.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Français 1’343 [1’320–1’367] Perzentil 22 · #106 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’370 ±14 1’359 ±13 90.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 日本語 1’362 [1’344–1’379] Perzentil 33 · #86 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’332 ±13 1’376 ±10 91.8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: 한국어 1’335 [1’318–1’352] Perzentil 23 · #105 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’283 ±12 1’346 ±9 92.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Polski 1’357 [1’345–1’368] Perzentil 19 · #106 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’354 ±7.40 1’368 ±6 93.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Русский 1’345 [1’335–1’356] Perzentil 40 · #140 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’343 ±6.40 1’355 ±6 93.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
gpt-oss-120b 1’344 C

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: gpt-oss-120b

Daten CC BY 4.0: Link zu fedi.software beibehalten.