Ir para o conteúdo
fedi.software

wizardlm-70b no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

D 1.128 ±6

Percentil 15 · #248 · provisório

Preferido por pessoas / Resolve tarefas

1.122 / —

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

—

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

D Geral 1.128 [1.122–1.133] Percentil 15 · #248 · componentes: 5 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/overall 1.119 ±4,76 1.120 ±5 32,0% 2026-10-02 —
LMArena text/hard_prompts 1.079 ±7,71 1.105 ±7 29,0% 2026-10-02 —
LMArena text/instruction_following 1.093 ±6,78 1.122 ±6 14,9% 2026-10-02 —
LMArena text/multi_turn 1.108 ±9,88 1.134 ±9 6,5% 2026-10-02 —
LMArena text/longer_query 1.097 ±16 1.118 ±15 4,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Código 1.110 [1.095–1.126] Percentil 10 · #250 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.081 ±10 1.097 ±9 87,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Matemática 1.133 [1.117–1.148] Percentil 14 · #220 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.116 ±9,74 1.121 ±9 85,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Escrita 1.162 [1.149–1.176] Percentil 21 · #213 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.149 ±8,54 1.172 ±9 68,4% 2026-10-02 —
LMArena text/longer_query 1.097 ±16 1.118 ±15 23,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: 繁體中文 1.108 [1.085–1.131] Percentil 7 · #208 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.052 ±16 1.098 ±13 90,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: English 1.130 [1.119–1.140] Percentil 17 · #226 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.150 ±5,20 1.124 ±6 93,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
wizardlm-70b 1.128 D

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: wizardlm-70b

Dados CC BY 4.0: mantenha o link para fedi.software.