Vai al contenuto
fedi.software

grok-4-0709 nel fedi-index

Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.

fedi-index · Generale

B 1.395 ±6

Percentile 65 · #103

Preferito dalle persone / Risolve compiti

1.395 / 1.395

Voti umani e benchmark, Elo-eq

Qualità-prezzo

-27

6 USD per 1 M di token, mediana di 6 provider

Sul tuo hardware

Pesi chiusi: solo cloud.

Scomposizione del punteggio

B Generale 1.395 [1.389–1.401] Percentile 65 · #103 · componenti: 8
Fonte Componente Valore Elo-eq Peso Misurato Variante
Epoch AI eci 146 ±0,88 1.410 ±7 40,0% 2025-07-09 —
LMArena text/overall 1.411 ±2,01 1.411 ±2 15,9% 2026-10-02 —
LMArena text/hard_prompts 1.413 ±5,45 1.406 ±5 14,6% 2026-10-02 fast
LMArena text/expert 1.417 ±6,75 1.408 ±6 7,1% 2026-10-02 —
LMArena text/instruction_following 1.388 ±7,44 1.401 ±7 6,6% 2026-10-02 fast
LMArena text/multi_turn 1.416 ±3,96 1.414 ±4 3,8% 2026-10-02 —
LMArena text/longer_query 1.414 ±7,98 1.414 ±8 3,2% 2026-10-02 fast
Epoch AI gpqa_diamond obsolescenza ×0,26 0,87 ±0,02 1.444 ±9 1,6% 2025-07-09 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Codice 1.347 [1.340–1.353] Percentile 43 · #160 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena webdev/overall 1.159 ±14 1.353 ±4 60,7% 2026-10-01 fast-reasoning
LMArena text/coding anomalo 1.430 ±8,53 1.408 ±8 25,8% 2026-10-02 fast

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Matematica 1.388 [1.378–1.398] Percentile 61 · #99 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/math 1.423 ±6,33 1.415 ±6 87,3% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Visione 1.376 [1.371–1.381] Percentile 40 · #68 · componenti: 3 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena vision/overall 1.210 ±3,72 1.394 ±3 63,9% 2026-10-02 —
LMArena vision/ocr 1.195 ±4,63 1.370 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1.204 ±6,85 1.378 ±6 14,4% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Scrittura 1.408 [1.401–1.415] Percentile 68 · #86 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/creative_writing 1.397 ±4,32 1.426 ±4 65,0% 2026-10-02 —
LMArena text/longer_query 1.414 ±7,98 1.414 ±8 28,3% 2026-10-02 fast

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 繁體中文 1.400 [1.380–1.421] Percentile 57 · #96 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/chinese 1.458 ±15 1.420 ±12 91,0% 2026-10-02 fast

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Deutsch 1.409 [1.393–1.425] Percentile 62 · #55 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/german 1.428 ±10 1.426 ±9 92,2% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: English 1.394 [1.389–1.400] Percentile 61 · #107 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/english 1.418 ±2,65 1.407 ±3 93,9% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Lingua: Español 1.399 [1.383–1.416] Percentile 45 · #82 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/spanish 1.419 ±9,78 1.416 ±9 92,2% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 日本語 1.408 [1.393–1.422] Percentile 61 · #51 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/japanese 1.396 ±11 1.424 ±8 92,6% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 한국어 1.401 [1.386–1.416] Percentile 53 · #64 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/korean 1.376 ±11 1.417 ±8 92,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Polski 1.417 [1.407–1.426] Percentile 59 · #54 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/polish 1.429 ±6,02 1.432 ±5 93,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Русский 1.401 [1.392–1.411] Percentile 61 · #91 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/russian 1.409 ±5,58 1.415 ±5 93,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

Storico

fedi-index per mese
Gli stessi dati in tabella
Modello 2026-10
grok-4-0709 1.395 B

Badge

Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.

fedi-index: grok-4-0709

Dati CC BY 4.0: mantieni il link a fedi.software.