Ir para o conteúdo
fedi.software

llama-3.1-tulu-3-8b no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

D 1.194 ±7

Percentil 22 · #228 · provisório

Preferido por pessoas / Resolve tarefas

1.193 / —

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

—

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

D Geral 1.194 [1.187–1.200] Percentil 22 · #228 · componentes: 5 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/overall 1.193 ±5,35 1.193 ±5 32,8% 2026-10-02 —
LMArena text/hard_prompts 1.174 ±9,98 1.191 ±9 27,2% 2026-10-02 —
LMArena text/instruction_following 1.174 ±7,87 1.199 ±8 14,8% 2026-10-02 —
LMArena text/multi_turn 1.154 ±13 1.175 ±12 5,8% 2026-10-02 —
LMArena text/longer_query 1.181 ±13 1.196 ±12 5,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Código 1.190 [1.172–1.209] Percentil 21 · #220 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.183 ±12 1.188 ±11 86,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Matemática 1.197 [1.177–1.218] Percentil 24 · #195 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.195 ±13 1.196 ±12 82,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Escrita 1.202 [1.185–1.219] Percentil 23 · #206 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.182 ±13 1.205 ±13 58,9% 2026-10-02 —
LMArena text/longer_query 1.181 ±13 1.196 ±12 31,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: English 1.193 [1.180–1.206] Percentil 25 · #206 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.215 ±6,94 1.192 ±7 92,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Русский 1.219 [1.199–1.239] Percentil 16 · #196 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.193 ±13 1.221 ±11 91,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
llama-3.1-tulu-3-8b 1.194 D

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: llama-3.1-tulu-3-8b

Dados CC BY 4.0: mantenha o link para fedi.software.