Ir para o conteúdo
fedi.software

Grok 4.20 no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

A 1.425 ±8

Percentil 81 · #56

Preferido por pessoas / Resolve tarefas

1.419 / 1.432

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+33

US$ 1,77 por 1 mi de tokens, mediana de 3 provedores

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

A Geral 1.425 [1.417–1.433] Percentil 81 · #56 · componentes: 7
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 152 ±1,30 1.453 ±10 38,7% 2026-02-17 —
LMArena text/overall 1.444 ±2,32 1.444 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1.441 ±2,78 1.432 ±2 15,8% 2026-10-02 —
LMArena text/instruction_following 1.415 ±3,55 1.427 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.428 ±6,29 1.418 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1.427 ±3,45 1.426 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1.451 ±4,77 1.445 ±4 3,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Código 1.401 [1.395–1.407] Percentil 68 · #90 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.447 ±3,83 1.423 ±3 90,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Matemática 1.396 [1.384–1.408] Percentil 68 · #83 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.433 ±7,35 1.425 ±7 86,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Busca 1.417 [1.411–1.423] Percentil 47 · #18 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena search/overall 1.189 ±3,08 1.431 ±3 93,9% 2026-08-24 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Escrita 1.437 [1.430–1.443] Percentil 82 · #49 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.438 ±4,92 1.467 ±5 61,1% 2026-10-02 —
LMArena text/longer_query 1.427 ±3,45 1.426 ±3 32,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 繁體中文 1.418 [1.407–1.429] Percentil 71 · #66 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.475 ±7,46 1.434 ±6 93,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Deutsch 1.433 [1.412–1.454] Percentil 82 · #27 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.463 ±14 1.457 ±12 90,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: English 1.427 [1.421–1.433] Percentil 80 · #55 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.451 ±3,09 1.442 ±3 93,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Español 1.416 [1.400–1.433] Percentil 62 · #57 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.439 ±9,94 1.434 ±9 92,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Français 1.418 [1.400–1.436] Percentil 59 · #56 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.455 ±11 1.438 ±10 91,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 한국어 1.426 [1.407–1.446] Percentil 73 · #37 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.416 ±14 1.448 ±11 91,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Polski 1.415 [1.396–1.433] Percentil 57 · #57 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.432 ±12 1.434 ±10 91,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Русский 1.434 [1.425–1.443] Percentil 81 · #45 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.448 ±5,42 1.450 ±5 93,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
Grok 4.20 1.425 A

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: Grok 4.20

Dados CC BY 4.0: mantenha o link para fedi.software.