claude-opus-4-20250514-thinking-16k no fedi-index
A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.
fedi-index · Geral
B 1.374 ±6
Percentil 55 · #132
Preferido por pessoas / Resolve tarefas
1.381 / 1.365
Votos humanos vs. benchmarks, Elo-eq
Custo-benefício
-86
US$ 30 por 1 mi de tokens, mediana de 9 provedores
No seu hardware
Pesos fechados: apenas na nuvem.
Decomposição da pontuação
B Geral 1.374 [1.368–1.381] Percentil 55 · #132 · componentes: 8
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
143 ±1,08 | 1.380 ±8 | 37,2% | 2025-05-22 | — |
| LMArena |
text/overall
|
1.377 ±2,27 | 1.377 ±2 | 16,0% | 2026-10-02 | thinking-16k |
| LMArena |
text/hard_prompts
|
1.399 ±2,89 | 1.394 ±3 | 15,9% | 2026-10-02 | thinking-16k |
| LMArena |
text/instruction_following
|
1.406 ±3,52 | 1.419 ±3 | 7,8% | 2026-10-02 | thinking-16k |
| LMArena |
text/expert
|
1.384 ±7,33 | 1.381 ±6 | 7,1% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1.422 ±3,91 | 1.421 ±4 | 3,9% | 2026-10-02 | thinking-16k |
| LMArena |
text/multi_turn
|
1.396 ±4,19 | 1.395 ±4 | 3,8% | 2026-10-02 | thinking-16k |
| Epoch AI |
gpqa_diamond
defasagem ×0,26 |
0,76 ±0,03 | 1.394 ±14 | 1,2% | 2025-05-22 | 16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Código 1.402 [1.396–1.408] Percentil 69 · #88 · componentes: 2
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.442 ±4,01 | 1.418 ±4 | 77,9% | 2026-10-02 | thinking-16k |
| Epoch AI |
swe_bench_verified
defasagem ×0,37 |
0,71 ±0,02 | 1.436 ±11 | 13,5% | 2026-02-06 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Matemática 1.361 [1.351–1.372] Percentil 49 · #131 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.391 ±6,29 | 1.384 ±6 | 87,3% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Visão 1.363 [1.352–1.375] Percentil 34 · #75 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1.192 ±8,15 | 1.377 ±7 | 76,1% | 2026-10-02 | thinking-16k |
| LMArena |
vision/ocr
|
1.197 ±10 | 1.372 ±10 | 16,5% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Escrita 1.403 [1.397–1.409] Percentil 65 · #94 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.386 ±4,76 | 1.414 ±5 | 61,5% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1.422 ±3,91 | 1.421 ±4 | 32,1% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: 繁體中文 1.353 [1.343–1.362] Percentil 39 · #136 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.386 ±6,31 | 1.363 ±5 | 93,5% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: Deutsch 1.379 [1.363–1.395] Percentil 45 · #80 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1.390 ±10 | 1.394 ±9 | 92,3% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: English 1.362 [1.356–1.368] Percentil 52 · #133 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.385 ±2,94 | 1.373 ±3 | 93,9% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: Español 1.373 [1.355–1.390] Percentil 30 · #104 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.388 ±10 | 1.388 ±10 | 91,9% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Idioma: Français 1.344 [1.321–1.366] Percentil 22 · #105 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1.369 ±14 | 1.359 ±13 | 90,4% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: 日本語 1.363 [1.348–1.378] Percentil 35 · #84 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1.332 ±11 | 1.376 ±8 | 92,4% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: 한국어 1.360 [1.344–1.375] Percentil 32 · #93 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1.317 ±11 | 1.372 ±9 | 92,3% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Idioma: Polski 1.359 [1.350–1.368] Percentil 21 · #104 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1.356 ±5,57 | 1.370 ±5 | 93,6% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: Русский 1.387 [1.377–1.396] Percentil 54 · #109 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.392 ±5,88 | 1.400 ±5 | 93,4% | 2026-10-02 | thinking-16k |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
Histórico
O mesmo em tabela
| Modelo | 2026-10 |
|---|---|
| claude-opus-4-20250514-thinking-16k | 1.374 B |
Selo
Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.
Dados CC BY 4.0: mantenha o link para fedi.software.