Ir para o conteúdo
fedi.software

Claude Sonnet 4.6 no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

A 1.443 ±6

Percentil 88 · #35

Preferido por pessoas / Resolve tarefas

1.453 / 1.428

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+21

US$ 6 por 1 mi de tokens, mediana de 42 provedores · fabricante US$ 6

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

A Geral 1.443 [1.437–1.449] Percentil 88 · #35 · componentes: 9
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 152 ±1,17 1.455 ±9 31,3% 2026-02-17 —
LMArena text/overall 1.458 ±1,79 1.458 ±2 16,2% 2026-10-02 —
LMArena text/hard_prompts 1.484 ±2,17 1.471 ±2 16,2% 2026-10-02 —
LMArena text/instruction_following 1.475 ±2,64 1.484 ±2 8,0% 2026-10-02 —
LMArena text/expert 1.500 ±3,99 1.476 ±3 7,8% 2026-10-02 —
LMArena text/longer_query 1.479 ±2,53 1.474 ±2 4,0% 2026-10-02 —
Epoch AI simpleqa_verified defasagem ×0,61 0,36 ±0,02 1.409 ±5 4,0% 2026-08-10 high
LMArena text/multi_turn 1.464 ±3,27 1.457 ±3 4,0% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,87 ±0,02 1.446 ±9 1,4% 2026-02-20 32k

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Código 1.442 [1.439–1.446] Percentil 91 · #26 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena webdev/overall 1.521 ±2,62 1.456 ±1 39,6% 2026-10-01 —
LMArena text/coding 1.504 ±2,83 1.474 ±2 38,6% 2026-10-02 —
Epoch AI swe_bench_verified defasagem ×0,37 0,75 ±0,02 1.459 ±10 13,5% 2026-02-21 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Matemática 1.423 [1.415–1.432] Percentil 83 · #44 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.463 ±5,12 1.454 ±5 87,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Visão 1.446 [1.442–1.450] Percentil 80 · #23 · componentes: 3 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena vision/overall 1.283 ±3,14 1.459 ±3 62,9% 2026-10-02 —
LMArena vision/ocr 1.296 ±3,13 1.467 ±3 15,7% 2026-10-02 —
LMArena vision/diagram 1.305 ±4,33 1.468 ±4 15,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Escrita 1.452 [1.447–1.456] Percentil 86 · #37 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.435 ±3,33 1.464 ±3 62,1% 2026-10-02 —
LMArena text/longer_query 1.479 ±2,53 1.474 ±2 31,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 繁體中文 1.431 [1.424–1.438] Percentil 78 · #49 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.491 ±4,83 1.446 ±4 93,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Deutsch 1.410 [1.396–1.424] Percentil 63 · #54 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.428 ±9,11 1.426 ±8 92,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: English 1.448 [1.444–1.453] Percentil 89 · #31 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.472 ±2,39 1.464 ±2 94,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Español 1.440 [1.428–1.452] Percentil 84 · #25 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.464 ±7,08 1.457 ±7 93,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Français 1.430 [1.418–1.442] Percentil 72 · #39 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.465 ±7,23 1.447 ±7 93,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 日本語 1.423 [1.407–1.438] Percentil 75 · #33 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.419 ±11 1.441 ±9 92,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 한국어 1.426 [1.413–1.440] Percentil 74 · #36 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.411 ±9,52 1.444 ±7 92,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Polski 1.426 [1.414–1.439] Percentil 72 · #37 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.442 ±8,07 1.443 ±7 93,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Русский 1.428 [1.422–1.434] Percentil 79 · #50 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.440 ±3,76 1.443 ±3 93,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
Claude Sonnet 4.6 1.443 A

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: Claude Sonnet 4.6

Dados CC BY 4.0: mantenha o link para fedi.software.