llama2-70b-steerlm-chat no fedi-index
A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.
fedi-index · Geral
D 1.105 ±8
Percentil 11 · #262 · provisório
Preferido por pessoas / Resolve tarefas
1.097 / —
Votos humanos vs. benchmarks, Elo-eq
Custo-benefício
—
No seu hardware
Pesos fechados: apenas na nuvem.
Decomposição da pontuação
D Geral 1.105 [1.097–1.112] Percentil 11 · #262 · componentes: 4 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1.098 ±6,35 | 1.098 ±6 | 34,9% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.047 ±10 | 1.076 ±9 | 29,6% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.061 ±9,15 | 1.091 ±9 | 15,4% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.058 ±14 | 1.088 ±13 | 5,9% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Código 1.070 [1.049–1.092] Percentil 5 · #263 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.025 ±14 | 1.047 ±13 | 84,8% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Matemática 1.101 [1.080–1.122] Percentil 9 · #232 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.072 ±14 | 1.078 ±13 | 82,0% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Escrita 1.121 [1.098–1.144] Percentil 13 · #233 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.091 ±12 | 1.112 ±13 | 90,3% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Idioma: English 1.100 [1.087–1.113] Percentil 12 · #240 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.120 ±6,99 | 1.092 ±7 | 92,8% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
Histórico
O mesmo em tabela
| Modelo | 2026-10 |
|---|---|
| llama2-70b-steerlm-chat | 1.105 D |
Selo
Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.
Dados CC BY 4.0: mantenha o link para fedi.software.