Ir para o conteúdo
fedi.software

ibm-granite-h-small no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

C 1.241 ±5

Percentil 27 · #213 · provisório

Preferido por pessoas / Resolve tarefas

1.243 / —

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

—

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

C Geral 1.241 [1.236–1.246] Percentil 27 · #213 · componentes: 5 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/overall 1.241 ±4,33 1.241 ±4 31,2% 2026-10-02 —
LMArena text/hard_prompts 1.240 ±5,81 1.250 ±5 30,1% 2026-10-02 —
LMArena text/instruction_following 1.220 ±7,87 1.243 ±8 13,5% 2026-10-02 —
LMArena text/longer_query 1.240 ±8,75 1.251 ±8 6,5% 2026-10-02 —
LMArena text/multi_turn 1.243 ±10 1.256 ±9 6,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Código 1.240 [1.226–1.254] Percentil 27 · #192 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.247 ±8,78 1.245 ±8 88,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Matemática 1.240 [1.216–1.264] Percentil 29 · #182 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.251 ±16 1.250 ±16 79,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Escrita 1.238 [1.224–1.252] Percentil 28 · #192 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.211 ±12 1.235 ±12 55,7% 2026-10-02 —
LMArena text/longer_query 1.240 ±8,75 1.251 ±8 35,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: 繁體中文 1.250 [1.227–1.273] Percentil 23 · #171 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.251 ±17 1.255 ±13 90,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: English 1.244 [1.231–1.256] Percentil 28 · #195 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.266 ±6,33 1.247 ±7 93,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Русский 1.223 [1.199–1.246] Percentil 18 · #192 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.198 ±15 1.225 ±13 90,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
ibm-granite-h-small 1.241 C

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: ibm-granite-h-small

Dados CC BY 4.0: mantenha o link para fedi.software.