Ir para o conteúdo
fedi.software

Claude Haiku 4.5 no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

B 1.383 ±6

Percentil 60 · #119

Preferido por pessoas / Resolve tarefas

1.400 / 1.358

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

-12

US$ 2 por 1 mi de tokens, mediana de 39 provedores · fabricante US$ 2

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

B Geral 1.383 [1.378–1.389] Percentil 60 · #119 · componentes: 9
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 142 ±1,19 1.378 ±9 31,0% 2025-10-15 —
LMArena text/overall 1.396 ±1,24 1.396 ±1 16,3% 2026-10-02 —
LMArena text/hard_prompts 1.420 ±1,55 1.412 ±1 16,3% 2026-10-02 —
LMArena text/instruction_following 1.414 ±1,91 1.426 ±2 8,1% 2026-10-02 —
LMArena text/expert 1.442 ±3,06 1.429 ±2 8,0% 2026-10-02 —
Epoch AI simpleqa_verified defasagem ×0,61 0,13 ±0,01 1.339 ±3 4,2% 2026-08-10 —
LMArena text/longer_query 1.427 ±1,91 1.426 ±2 4,0% 2026-10-02 —
LMArena text/multi_turn 1.409 ±2,35 1.407 ±2 4,0% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,71 ±0,03 1.371 ±15 1,0% 2025-10-22 32k

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Código 1.395 [1.393–1.396] Percentil 66 · #95 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena webdev/overall 1.329 ±2,49 1.401 ±1 45,5% 2026-10-01 —
LMArena text/coding 1.453 ±2,07 1.429 ±2 45,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Matemática 1.367 [1.361–1.373] Percentil 52 · #122 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.395 ±3,65 1.389 ±4 88,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Escrita 1.396 [1.393–1.399] Percentil 63 · #99 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.372 ±2,43 1.399 ±2 62,4% 2026-10-02 —
LMArena text/longer_query 1.427 ±1,91 1.426 ±2 31,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 繁體中文 1.376 [1.371–1.380] Percentil 47 · #119 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.416 ±3,34 1.387 ±3 94,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Deutsch 1.370 [1.359–1.380] Percentil 41 · #86 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.376 ±6,85 1.382 ±6 93,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: English 1.390 [1.387–1.394] Percentil 60 · #110 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.413 ±1,70 1.402 ±2 94,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Español 1.403 [1.394–1.412] Percentil 49 · #76 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.420 ±5,38 1.417 ±5 93,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Français 1.382 [1.372–1.392] Percentil 34 · #89 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.408 ±5,83 1.394 ±5 93,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 日本語 1.369 [1.357–1.381] Percentil 38 · #80 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.339 ±8,60 1.382 ±6 93,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 한국어 1.381 [1.371–1.391] Percentil 38 · #84 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.346 ±7,12 1.394 ±5 93,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Polski 1.348 [1.340–1.356] Percentil 17 · #109 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.342 ±5,49 1.358 ±5 93,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Русский 1.378 [1.373–1.382] Percentil 48 · #121 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.380 ±2,71 1.389 ±2 94,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
Claude Haiku 4.5 1.383 B

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: Claude Haiku 4.5

Dados CC BY 4.0: mantenha o link para fedi.software.