llama-3.1-tulu-3-70b no fedi-index
A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.
fedi-index · Geral
C 1.241 ±6
Percentil 27 · #213 · provisório
Preferido por pessoas / Resolve tarefas
1.244 / —
Votos humanos vs. benchmarks, Elo-eq
Custo-benefício
—
No seu hardware
Pesos fechados: apenas na nuvem.
Decomposição da pontuação
C Geral 1.241 [1.235–1.248] Percentil 27 · #213 · componentes: 5 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1.256 ±5,33 | 1.256 ±5 | 32,4% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.220 ±9,41 | 1.232 ±8 | 27,6% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.233 ±7,88 | 1.254 ±8 | 14,6% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.252 ±12 | 1.264 ±11 | 6,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.224 ±13 | 1.236 ±12 | 5,7% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Código 1.230 [1.212–1.248] Percentil 25 · #208 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.235 ±12 | 1.235 ±11 | 86,4% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Matemática 1.235 [1.215–1.254] Percentil 28 · #184 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.242 ±12 | 1.242 ±12 | 83,0% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Escrita 1.245 [1.228–1.261] Percentil 29 · #190 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.231 ±12 | 1.256 ±13 | 59,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.224 ±13 | 1.236 ±12 | 31,4% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: English 1.250 [1.237–1.263] Percentil 29 · #193 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.273 ±6,77 | 1.254 ±7 | 92,9% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
D Idioma: Русский 1.262 [1.240–1.284] Percentil 23 · #181 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.246 ±14 | 1.268 ±12 | 90,5% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
Histórico
O mesmo em tabela
| Modelo | 2026-10 |
|---|---|
| llama-3.1-tulu-3-70b | 1.241 C |
Selo
Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.
Dados CC BY 4.0: mantenha o link para fedi.software.