Zum Inhalt springen
fedi.software

claude-opus-4-20250514-thinking-16k im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1.374 ±6

Perzentil 55 · #132

Menschen bevorzugen / Löst Aufgaben

1.381 / 1.365

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-86

30 $ pro 1 Mio. Tokens, Median von 9 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1.374 [1.368–1.381] Perzentil 55 · #132 · Komponenten: 8
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 143 ±1,08 1.380 ±8 37,2% 2025-05-22 —
LMArena text/overall 1.377 ±2,27 1.377 ±2 16,0% 2026-10-02 thinking-16k
LMArena text/hard_prompts 1.399 ±2,89 1.394 ±3 15,9% 2026-10-02 thinking-16k
LMArena text/instruction_following 1.406 ±3,52 1.419 ±3 7,8% 2026-10-02 thinking-16k
LMArena text/expert 1.384 ±7,33 1.381 ±6 7,1% 2026-10-02 thinking-16k
LMArena text/longer_query 1.422 ±3,91 1.421 ±4 3,9% 2026-10-02 thinking-16k
LMArena text/multi_turn 1.396 ±4,19 1.395 ±4 3,8% 2026-10-02 thinking-16k
Epoch AI gpqa_diamond Alterung ×0,26 0,76 ±0,03 1.394 ±14 1,2% 2025-05-22 16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.402 [1.396–1.408] Perzentil 69 · #88 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.442 ±4,01 1.418 ±4 77,9% 2026-10-02 thinking-16k
Epoch AI swe_bench_verified Alterung ×0,37 0,71 ±0,02 1.436 ±11 13,5% 2026-02-06 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1.361 [1.351–1.372] Perzentil 49 · #131 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.391 ±6,29 1.384 ±6 87,3% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1.363 [1.352–1.375] Perzentil 34 · #75 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1.192 ±8,15 1.377 ±7 76,1% 2026-10-02 thinking-16k
LMArena vision/ocr 1.197 ±10 1.372 ±10 16,5% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.403 [1.397–1.409] Perzentil 65 · #94 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.386 ±4,76 1.414 ±5 61,5% 2026-10-02 thinking-16k
LMArena text/longer_query 1.422 ±3,91 1.421 ±4 32,1% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1.353 [1.343–1.362] Perzentil 39 · #136 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.386 ±6,31 1.363 ±5 93,5% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Deutsch 1.379 [1.363–1.395] Perzentil 45 · #80 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.390 ±10 1.394 ±9 92,3% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.362 [1.356–1.368] Perzentil 52 · #133 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.385 ±2,94 1.373 ±3 93,9% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1.373 [1.355–1.390] Perzentil 30 · #104 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.388 ±10 1.388 ±10 91,9% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Français 1.344 [1.321–1.366] Perzentil 22 · #105 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.369 ±14 1.359 ±13 90,4% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 日本語 1.363 [1.348–1.378] Perzentil 35 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1.332 ±11 1.376 ±8 92,4% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1.360 [1.344–1.375] Perzentil 32 · #93 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.317 ±11 1.372 ±9 92,3% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Polski 1.359 [1.350–1.368] Perzentil 21 · #104 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.356 ±5,57 1.370 ±5 93,6% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1.387 [1.377–1.396] Perzentil 54 · #109 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.392 ±5,88 1.400 ±5 93,4% 2026-10-02 thinking-16k

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
claude-opus-4-20250514-thinking-16k 1.374 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: claude-opus-4-20250514-thinking-16k

Daten CC BY 4.0: Link zu fedi.software beibehalten.