Vai al contenuto
fedi.software

Grok 4.20 nel fedi-index

Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.

fedi-index · Generale

A 1.425 ±8

Percentile 81 · #56

Preferito dalle persone / Risolve compiti

1.419 / 1.432

Voti umani e benchmark, Elo-eq

Qualità-prezzo

+33

1,77 USD per 1 M di token, mediana di 3 provider

Sul tuo hardware

Pesi chiusi: solo cloud.

Scomposizione del punteggio

A Generale 1.425 [1.417–1.433] Percentile 81 · #56 · componenti: 7
Fonte Componente Valore Elo-eq Peso Misurato Variante
Epoch AI eci 152 ±1,30 1.453 ±10 38,7% 2026-02-17 —
LMArena text/overall 1.444 ±2,32 1.444 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1.441 ±2,78 1.432 ±2 15,8% 2026-10-02 —
LMArena text/instruction_following 1.415 ±3,55 1.427 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.428 ±6,29 1.418 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1.427 ±3,45 1.426 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1.451 ±4,77 1.445 ±4 3,7% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Codice 1.401 [1.395–1.407] Percentile 68 · #90 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/coding 1.447 ±3,83 1.423 ±3 90,1% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Matematica 1.396 [1.384–1.408] Percentile 68 · #83 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/math 1.433 ±7,35 1.425 ±7 86,8% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Ricerca 1.417 [1.411–1.423] Percentile 47 · #18 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena search/overall 1.189 ±3,08 1.431 ±3 93,9% 2026-08-24 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Scrittura 1.437 [1.430–1.443] Percentile 82 · #49 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/creative_writing 1.438 ±4,92 1.467 ±5 61,1% 2026-10-02 —
LMArena text/longer_query 1.427 ±3,45 1.426 ±3 32,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 繁體中文 1.418 [1.407–1.429] Percentile 71 · #66 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/chinese 1.475 ±7,46 1.434 ±6 93,3% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Lingua: Deutsch 1.433 [1.412–1.454] Percentile 82 · #27 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/german 1.463 ±14 1.457 ±12 90,7% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Lingua: English 1.427 [1.421–1.433] Percentile 80 · #55 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/english 1.451 ±3,09 1.442 ±3 93,9% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Español 1.416 [1.400–1.433] Percentile 62 · #57 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/spanish 1.439 ±9,94 1.434 ±9 92,1% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Français 1.418 [1.400–1.436] Percentile 59 · #56 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/french 1.455 ±11 1.438 ±10 91,7% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 한국어 1.426 [1.407–1.446] Percentile 73 · #37 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/korean 1.416 ±14 1.448 ±11 91,3% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Polski 1.415 [1.396–1.433] Percentile 57 · #57 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/polish 1.432 ±12 1.434 ±10 91,6% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Lingua: Русский 1.434 [1.425–1.443] Percentile 81 · #45 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/russian 1.448 ±5,42 1.450 ±5 93,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

Storico

fedi-index per mese
Gli stessi dati in tabella
Modello 2026-10
Grok 4.20 1.425 A

Badge

Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.

fedi-index: Grok 4.20

Dati CC BY 4.0: mantieni il link a fedi.software.