Grok 4.20 (Reasoning) nel fedi-index
Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.
fedi-index · Generale
B 1.414 ±2
Percentile 76 · #70
Preferito dalle persone / Risolve compiti
1.426 / 1.374
Voti umani e benchmark, Elo-eq
Qualità-prezzo
+26
1,56 USD per 1 M di token, mediana di 13 provider · produttore 1,56 USD
Sul tuo hardware
Pesi chiusi: solo cloud.
Scomposizione del punteggio
B Generale 1.414 [1.412–1.417] Percentile 76 · #70 · componenti: 8
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1.451 ±1,87 | 1.451 ±2 | 21,0% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.451 ±2,25 | 1.441 ±2 | 21,0% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
anomalo obsolescenza ×0,61 |
0,30 ±0,01 | 1.392 ±5 | 10,4% | 2026-08-27 | — |
| LMArena |
text/instruction_following
|
1.420 ±2,71 | 1.432 ±3 | 10,4% | 2026-10-02 | — |
| LMArena |
text/expert
|
1.440 ±4,12 | 1.427 ±3 | 10,2% | 2026-10-02 | — |
| Epoch AI |
gpqa_diamond
obsolescenza ×0,26 |
0,89 ±0,02 | 1.455 ±9 | 7,4% | 2026-07-13 | — |
| LMArena |
text/longer_query
|
1.436 ±2,62 | 1.434 ±2 | 5,2% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.456 ±3,33 | 1.450 ±3 | 5,1% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Codice 1.402 [1.400–1.405] Percentile 69 · #87 · componenti: 2 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1.374 ±3,09 | 1.414 ±1 | 45,8% | 2026-10-01 | — |
| LMArena |
text/coding
|
1.459 ±2,93 | 1.434 ±3 | 44,6% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
A Matematica 1.417 [1.411–1.424] Percentile 82 · #47 · componenti: 3
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.455 ±5,33 | 1.446 ±5 | 52,3% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
obsolescenza ×0,86 |
0,45 ±0,03 | 1.418 ±6 | 28,4% | 2026-07-13 | — |
| Epoch AI |
frontiermath_t4
obsolescenza ×0,86 |
0,17 ±0,06 | 1.420 ±10 | 12,0% | 2026-07-13 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Visione 1.425 [1.421–1.429] Percentile 62 · #44 · componenti: 3 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1.263 ±3,11 | 1.441 ±3 | 63,0% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1.266 ±3,11 | 1.439 ±3 | 15,7% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1.266 ±4,36 | 1.433 ±4 | 15,3% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
A Scrittura 1.437 [1.432–1.441] Percentile 82 · #50 · componenti: 2 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.432 ±3,44 | 1.461 ±4 | 62,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.436 ±2,62 | 1.434 ±2 | 31,9% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: 繁體中文 1.424 [1.417–1.431] Percentile 75 · #57 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.481 ±4,99 | 1.439 ±4 | 93,7% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: Deutsch 1.420 [1.404–1.435] Percentile 68 · #47 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1.441 ±9,76 | 1.437 ±8 | 92,4% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
A Lingua: English 1.433 [1.429–1.438] Percentile 84 · #44 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.457 ±2,47 | 1.448 ±3 | 94,0% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: Español 1.423 [1.410–1.435] Percentile 70 · #46 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.444 ±7,18 | 1.439 ±7 | 93,0% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
A Lingua: Français 1.439 [1.427–1.451] Percentile 81 · #26 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1.476 ±7,34 | 1.457 ±7 | 93,0% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: 日本語 1.418 [1.402–1.434] Percentile 70 · #39 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1.413 ±12 | 1.436 ±9 | 92,2% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: 한국어 1.430 [1.416–1.444] Percentile 78 · #31 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1.416 ±10 | 1.448 ±8 | 92,7% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
B Lingua: Polski 1.433 [1.420–1.446] Percentile 79 · #28 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1.451 ±8,56 | 1.451 ±7 | 92,8% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
A Lingua: Русский 1.443 [1.436–1.449] Percentile 86 · #33 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.458 ±3,91 | 1.459 ±4 | 93,8% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
Storico
Gli stessi dati in tabella
| Modello | 2026-10 |
|---|---|
| Grok 4.20 (Reasoning) | 1.414 B |
Badge
Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.
Dati CC BY 4.0: mantieni il link a fedi.software.