claude-opus-4-20250514-thinking-16k nel fedi-index
Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.
fedi-index · Generale
B 1.374 ±6
Percentile 55 · #132
Preferito dalle persone / Risolve compiti
1.381 / 1.365
Voti umani e benchmark, Elo-eq
Qualità-prezzo
-86
30 USD per 1 M di token, mediana di 9 provider
Sul tuo hardware
Pesi chiusi: solo cloud.
Scomposizione del punteggio
B Generale 1.374 [1.368–1.381] Percentile 55 · #132 · componenti: 8
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
143 ±1,08 | 1.380 ±8 | 37,2% | 2025-05-22 | — |
| LMArena |
text/overall
|
1.377 ±2,27 | 1.377 ±2 | 16,0% | 2026-10-02 | thinking-16k |
| LMArena |
text/hard_prompts
|
1.399 ±2,89 | 1.394 ±3 | 15,9% | 2026-10-02 | thinking-16k |
| LMArena |
text/instruction_following
|
1.406 ±3,52 | 1.419 ±3 | 7,8% | 2026-10-02 | thinking-16k |
| LMArena |
text/expert
|
1.384 ±7,33 | 1.381 ±6 | 7,1% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1.422 ±3,91 | 1.421 ±4 | 3,9% | 2026-10-02 | thinking-16k |
| LMArena |
text/multi_turn
|
1.396 ±4,19 | 1.395 ±4 | 3,8% | 2026-10-02 | thinking-16k |
| Epoch AI |
gpqa_diamond
obsolescenza ×0,26 |
0,76 ±0,03 | 1.394 ±14 | 1,2% | 2025-05-22 | 16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Codice 1.402 [1.396–1.408] Percentile 69 · #88 · componenti: 2
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.442 ±4,01 | 1.418 ±4 | 77,9% | 2026-10-02 | thinking-16k |
| Epoch AI |
swe_bench_verified
obsolescenza ×0,37 |
0,71 ±0,02 | 1.436 ±11 | 13,5% | 2026-02-06 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Matematica 1.361 [1.351–1.372] Percentile 49 · #131 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.391 ±6,29 | 1.384 ±6 | 87,3% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Visione 1.363 [1.352–1.375] Percentile 34 · #75 · componenti: 2 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1.192 ±8,15 | 1.377 ±7 | 76,1% | 2026-10-02 | thinking-16k |
| LMArena |
vision/ocr
|
1.197 ±10 | 1.372 ±10 | 16,5% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Scrittura 1.403 [1.397–1.409] Percentile 65 · #94 · componenti: 2 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.386 ±4,76 | 1.414 ±5 | 61,5% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1.422 ±3,91 | 1.421 ±4 | 32,1% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: 繁體中文 1.353 [1.343–1.362] Percentile 39 · #136 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.386 ±6,31 | 1.363 ±5 | 93,5% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: Deutsch 1.379 [1.363–1.395] Percentile 45 · #80 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1.390 ±10 | 1.394 ±9 | 92,3% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: English 1.362 [1.356–1.368] Percentile 52 · #133 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.385 ±2,94 | 1.373 ±3 | 93,9% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: Español 1.373 [1.355–1.390] Percentile 30 · #104 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.388 ±10 | 1.388 ±10 | 91,9% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
D Lingua: Français 1.344 [1.321–1.366] Percentile 22 · #105 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1.369 ±14 | 1.359 ±13 | 90,4% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: 日本語 1.363 [1.348–1.378] Percentile 35 · #84 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1.332 ±11 | 1.376 ±8 | 92,4% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: 한국어 1.360 [1.344–1.375] Percentile 32 · #93 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1.317 ±11 | 1.372 ±9 | 92,3% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
D Lingua: Polski 1.359 [1.350–1.368] Percentile 21 · #104 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1.356 ±5,57 | 1.370 ±5 | 93,6% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: Русский 1.387 [1.377–1.396] Percentile 54 · #109 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.392 ±5,88 | 1.400 ±5 | 93,4% | 2026-10-02 | thinking-16k |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
Storico
Gli stessi dati in tabella
| Modello | 2026-10 |
|---|---|
| claude-opus-4-20250514-thinking-16k | 1.374 B |
Badge
Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.
Dati CC BY 4.0: mantieni il link a fedi.software.