Grok 4.20 no fedi-index
A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.
fedi-index · Geral
A 1.425 ±8
Percentil 81 · #56
Preferido por pessoas / Resolve tarefas
1.419 / 1.432
Votos humanos vs. benchmarks, Elo-eq
Custo-benefício
+33
US$ 1,77 por 1 mi de tokens, mediana de 3 provedores
No seu hardware
Pesos fechados: apenas na nuvem.
Decomposição da pontuação
A Geral 1.425 [1.417–1.433] Percentil 81 · #56 · componentes: 7
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
152 ±1,30 | 1.453 ±10 | 38,7% | 2026-02-17 | — |
| LMArena |
text/overall
|
1.444 ±2,32 | 1.444 ±2 | 15,8% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.441 ±2,78 | 1.432 ±2 | 15,8% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.415 ±3,55 | 1.427 ±3 | 7,7% | 2026-10-02 | — |
| LMArena |
text/expert
|
1.428 ±6,29 | 1.418 ±5 | 7,3% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.427 ±3,45 | 1.426 ±3 | 3,9% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.451 ±4,77 | 1.445 ±4 | 3,7% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Código 1.401 [1.395–1.407] Percentil 68 · #90 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.447 ±3,83 | 1.423 ±3 | 90,1% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Matemática 1.396 [1.384–1.408] Percentil 68 · #83 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.433 ±7,35 | 1.425 ±7 | 86,8% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Busca 1.417 [1.411–1.423] Percentil 47 · #18 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
search/overall
|
1.189 ±3,08 | 1.431 ±3 | 93,9% | 2026-08-24 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Escrita 1.437 [1.430–1.443] Percentil 82 · #49 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.438 ±4,92 | 1.467 ±5 | 61,1% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.427 ±3,45 | 1.426 ±3 | 32,5% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: 繁體中文 1.418 [1.407–1.429] Percentil 71 · #66 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.475 ±7,46 | 1.434 ±6 | 93,3% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: Deutsch 1.433 [1.412–1.454] Percentil 82 · #27 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1.463 ±14 | 1.457 ±12 | 90,7% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: English 1.427 [1.421–1.433] Percentil 80 · #55 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.451 ±3,09 | 1.442 ±3 | 93,9% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: Español 1.416 [1.400–1.433] Percentil 62 · #57 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.439 ±9,94 | 1.434 ±9 | 92,1% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: Français 1.418 [1.400–1.436] Percentil 59 · #56 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1.455 ±11 | 1.438 ±10 | 91,7% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: 한국어 1.426 [1.407–1.446] Percentil 73 · #37 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1.416 ±14 | 1.448 ±11 | 91,3% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: Polski 1.415 [1.396–1.433] Percentil 57 · #57 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1.432 ±12 | 1.434 ±10 | 91,6% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: Русский 1.434 [1.425–1.443] Percentil 81 · #45 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.448 ±5,42 | 1.450 ±5 | 93,5% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
Histórico
O mesmo em tabela
| Modelo | 2026-10 |
|---|---|
| Grok 4.20 | 1.425 A |
Selo
Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.
Dados CC BY 4.0: mantenha o link para fedi.software.