Naar de inhoud
fedi.software

claude-opus-4-20250514-thinking-16k in fedi-index

De score in elke doorsnede, waaruit die bestaat, prijs-kwaliteit, lokaal draaien en geschiedenis.

fedi-index · Algemeen

B 1.374 ±6

Percentiel 55 · #132

Mensen kiezen / Lost taken op

1.381 / 1.365

Menselijke stemmen tegenover benchmarks, Elo-eq

Prijs-kwaliteit

-86

US$ 30 per 1M tokens, mediaan van 9 aanbieders

Op je eigen hardware

Gesloten gewichten: alleen in de cloud.

Opbouw van de score

B Algemeen 1.374 [1.368–1.381] Percentiel 55 · #132 · onderdelen: 8
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
Epoch AI eci 143 ±1,08 1.380 ±8 37,2% 2025-05-22 —
LMArena text/overall 1.377 ±2,27 1.377 ±2 16,0% 2026-10-02 thinking-16k
LMArena text/hard_prompts 1.399 ±2,89 1.394 ±3 15,9% 2026-10-02 thinking-16k
LMArena text/instruction_following 1.406 ±3,52 1.419 ±3 7,8% 2026-10-02 thinking-16k
LMArena text/expert 1.384 ±7,33 1.381 ±6 7,1% 2026-10-02 thinking-16k
LMArena text/longer_query 1.422 ±3,91 1.421 ±4 3,9% 2026-10-02 thinking-16k
LMArena text/multi_turn 1.396 ±4,19 1.395 ±4 3,8% 2026-10-02 thinking-16k
Epoch AI gpqa_diamond verval ×0,26 0,76 ±0,03 1.394 ±14 1,2% 2025-05-22 16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Coderen 1.402 [1.396–1.408] Percentiel 69 · #88 · onderdelen: 2
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/coding 1.442 ±4,01 1.418 ±4 77,9% 2026-10-02 thinking-16k
Epoch AI swe_bench_verified verval ×0,37 0,71 ±0,02 1.436 ±11 13,5% 2026-02-06 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Wiskunde 1.361 [1.351–1.372] Percentiel 49 · #131 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/math 1.391 ±6,29 1.384 ±6 87,3% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Beeld 1.363 [1.352–1.375] Percentiel 34 · #75 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena vision/overall 1.192 ±8,15 1.377 ±7 76,1% 2026-10-02 thinking-16k
LMArena vision/ocr 1.197 ±10 1.372 ±10 16,5% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Schrijven 1.403 [1.397–1.409] Percentiel 65 · #94 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/creative_writing 1.386 ±4,76 1.414 ±5 61,5% 2026-10-02 thinking-16k
LMArena text/longer_query 1.422 ±3,91 1.421 ±4 32,1% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Taal: 繁體中文 1.353 [1.343–1.362] Percentiel 39 · #136 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/chinese 1.386 ±6,31 1.363 ±5 93,5% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Taal: Deutsch 1.379 [1.363–1.395] Percentiel 45 · #80 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/german 1.390 ±10 1.394 ±9 92,3% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: English 1.362 [1.356–1.368] Percentiel 52 · #133 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/english 1.385 ±2,94 1.373 ±3 93,9% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Taal: Español 1.373 [1.355–1.390] Percentiel 30 · #104 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/spanish 1.388 ±10 1.388 ±10 91,9% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

D Taal: Français 1.344 [1.321–1.366] Percentiel 22 · #105 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/french 1.369 ±14 1.359 ±13 90,4% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Taal: 日本語 1.363 [1.348–1.378] Percentiel 35 · #84 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/japanese 1.332 ±11 1.376 ±8 92,4% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Taal: 한국어 1.360 [1.344–1.375] Percentiel 32 · #93 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/korean 1.317 ±11 1.372 ±9 92,3% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

D Taal: Polski 1.359 [1.350–1.368] Percentiel 21 · #104 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/polish 1.356 ±5,57 1.370 ±5 93,6% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Русский 1.387 [1.377–1.396] Percentiel 54 · #109 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/russian 1.392 ±5,88 1.400 ±5 93,4% 2026-10-02 thinking-16k

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

Geschiedenis

fedi-index per maand
Hetzelfde in een tabel
Model 2026-10
claude-opus-4-20250514-thinking-16k 1.374 B

Badge

Toon de fedi-index van het model op je site of in een README. De badge werkt zichzelf bij en linkt naar deze pagina.

fedi-index: claude-opus-4-20250514-thinking-16k

Data CC BY 4.0: behoud de link naar fedi.software.