Zum Inhalt springen
fedi.software

claude-opus-4-20250514-thinking-16k im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’374 ±6

Perzentil 55 · #132

Menschen bevorzugen / Löst Aufgaben

1’381 / 1’365

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-86

$ 30 pro 1 Mio. Tokens, Median von 9 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’374 [1’368–1’381] Perzentil 55 · #132 · Komponenten: 8
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 143 ±1.08 1’380 ±8 37.2% 2025-05-22 —
LMArena text/overall 1’377 ±2.27 1’377 ±2 16.0% 2026-10-02 thinking-16k
LMArena text/hard_prompts 1’399 ±2.89 1’394 ±3 15.9% 2026-10-02 thinking-16k
LMArena text/instruction_following 1’406 ±3.52 1’419 ±3 7.8% 2026-10-02 thinking-16k
LMArena text/expert 1’384 ±7.33 1’381 ±6 7.1% 2026-10-02 thinking-16k
LMArena text/longer_query 1’422 ±3.91 1’421 ±4 3.9% 2026-10-02 thinking-16k
LMArena text/multi_turn 1’396 ±4.19 1’395 ±4 3.8% 2026-10-02 thinking-16k
Epoch AI gpqa_diamond Alterung ×0.26 0.76 ±0.03 1’394 ±14 1.2% 2025-05-22 16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’402 [1’396–1’408] Perzentil 69 · #88 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’442 ±4.01 1’418 ±4 77.9% 2026-10-02 thinking-16k
Epoch AI swe_bench_verified Alterung ×0.37 0.71 ±0.02 1’436 ±11 13.5% 2026-02-06 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1’361 [1’351–1’372] Perzentil 49 · #131 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’391 ±6.29 1’384 ±6 87.3% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1’363 [1’352–1’375] Perzentil 34 · #75 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’192 ±8.15 1’377 ±7 76.1% 2026-10-02 thinking-16k
LMArena vision/ocr 1’197 ±10 1’372 ±10 16.5% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’403 [1’397–1’409] Perzentil 65 · #94 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’386 ±4.76 1’414 ±5 61.5% 2026-10-02 thinking-16k
LMArena text/longer_query 1’422 ±3.91 1’421 ±4 32.1% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1’353 [1’343–1’362] Perzentil 39 · #136 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’386 ±6.31 1’363 ±5 93.5% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Deutsch 1’379 [1’363–1’395] Perzentil 45 · #80 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’390 ±10 1’394 ±9 92.3% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’362 [1’356–1’368] Perzentil 52 · #133 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’385 ±2.94 1’373 ±3 93.9% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1’373 [1’355–1’390] Perzentil 30 · #104 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’388 ±10 1’388 ±10 91.9% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Français 1’344 [1’321–1’366] Perzentil 22 · #105 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’369 ±14 1’359 ±13 90.4% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 日本語 1’363 [1’348–1’378] Perzentil 35 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’332 ±11 1’376 ±8 92.4% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1’360 [1’344–1’375] Perzentil 32 · #93 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’317 ±11 1’372 ±9 92.3% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Polski 1’359 [1’350–1’368] Perzentil 21 · #104 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’356 ±5.57 1’370 ±5 93.6% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’387 [1’377–1’396] Perzentil 54 · #109 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’392 ±5.88 1’400 ±5 93.4% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
claude-opus-4-20250514-thinking-16k 1’374 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: claude-opus-4-20250514-thinking-16k

Daten CC BY 4.0: Link zu fedi.software beibehalten.