Ir para o conteúdo
fedi.software

llama-3.1-nemotron-51b-instruct no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

C 1.222 ±6

Percentil 26 · #218 · provisório

Preferido por pessoas / Resolve tarefas

1.223 / —

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

—

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

C Geral 1.222 [1.216–1.227] Percentil 26 · #218 · componentes: 5 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/overall 1.228 ±5,07 1.228 ±5 31,9% 2026-10-02 —
LMArena text/hard_prompts 1.203 ±8,74 1.217 ±8 27,9% 2026-10-02 —
LMArena text/instruction_following 1.201 ±7,38 1.224 ±7 14,6% 2026-10-02 —
LMArena text/multi_turn 1.227 ±10 1.242 ±9 6,4% 2026-10-02 —
LMArena text/longer_query 1.205 ±12 1.218 ±11 5,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Código 1.221 [1.204–1.237] Percentil 24 · #212 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.223 ±11 1.224 ±10 87,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Matemática 1.226 [1.208–1.244] Percentil 27 · #187 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.230 ±11 1.230 ±11 83,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Escrita 1.228 [1.212–1.244] Percentil 26 · #198 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.213 ±13 1.238 ±13 57,2% 2026-10-02 —
LMArena text/longer_query 1.205 ±12 1.218 ±11 33,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: 繁體中文 1.199 [1.179–1.219] Percentil 15 · #189 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.179 ±14 1.199 ±11 91,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: English 1.244 [1.231–1.258] Percentil 29 · #194 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.267 ±6,90 1.248 ±7 92,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Русский 1.214 [1.196–1.232] Percentil 15 · #199 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.186 ±11 1.215 ±10 91,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
llama-3.1-nemotron-51b-instruct 1.222 C

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: llama-3.1-nemotron-51b-instruct

Dados CC BY 4.0: mantenha o link para fedi.software.