llama-3.1-tulu-3-8b no fedi-index
A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.
fedi-index · Geral
D 1.194 ±7
Percentil 22 · #228 · provisório
Preferido por pessoas / Resolve tarefas
1.193 / —
Votos humanos vs. benchmarks, Elo-eq
Custo-benefício
—
No seu hardware
Pesos fechados: apenas na nuvem.
Decomposição da pontuação
D Geral 1.194 [1.187–1.200] Percentil 22 · #228 · componentes: 5 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1.193 ±5,35 | 1.193 ±5 | 32,8% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.174 ±9,98 | 1.191 ±9 | 27,2% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.174 ±7,87 | 1.199 ±8 | 14,8% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.154 ±13 | 1.175 ±12 | 5,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.181 ±13 | 1.196 ±12 | 5,6% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Código 1.190 [1.172–1.209] Percentil 21 · #220 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.183 ±12 | 1.188 ±11 | 86,2% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Matemática 1.197 [1.177–1.218] Percentil 24 · #195 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.195 ±13 | 1.196 ±12 | 82,6% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Escrita 1.202 [1.185–1.219] Percentil 23 · #206 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.182 ±13 | 1.205 ±13 | 58,9% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.181 ±13 | 1.196 ±12 | 31,4% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Idioma: English 1.193 [1.180–1.206] Percentil 25 · #206 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.215 ±6,94 | 1.192 ±7 | 92,8% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Idioma: Русский 1.219 [1.199–1.239] Percentil 16 · #196 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.193 ±13 | 1.221 ±11 | 91,1% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
Histórico
O mesmo em tabela
| Modelo | 2026-10 |
|---|---|
| llama-3.1-tulu-3-8b | 1.194 D |
Selo
Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.
Dados CC BY 4.0: mantenha o link para fedi.software.