Vai al contenuto
fedi.software

Grok 4.7 nel fedi-index

Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.

fedi-index · Generale

B 1.416 ±6

Percentile 77 · #67

Preferito dalle persone / Risolve compiti

1.393 / 1.444

Voti umani e benchmark, Elo-eq

Qualità-prezzo

+11

3 USD per 1 M di token, mediana di 17 provider · produttore 3 USD

Sul tuo hardware

Pesi chiusi: solo cloud.

Scomposizione del punteggio

B Generale 1.416 [1.410–1.422] Percentile 77 · #67 · componenti: 9
Fonte Componente Valore Elo-eq Peso Misurato Variante
Epoch AI eci 154 ±1,02 1.466 ±8 34,8% 2026-09-21 —
LMArena text/overall 1.400 ±3,96 1.400 ±4 16,0% 2026-10-02 xhigh
LMArena text/hard_prompts 1.413 ±4,98 1.406 ±4 15,7% 2026-10-02 xhigh
LMArena text/instruction_following 1.409 ±6,58 1.422 ±6 7,3% 2026-10-02 xhigh
LMArena text/expert 1.414 ±12 1.406 ±10 6,1% 2026-10-02 xhigh
Epoch AI simpleqa_verified obsolescenza ×0,61 0,56 ±0,02 1.473 ±5 4,1% 2026-09-22 xhigh
LMArena text/longer_query 1.417 ±6,07 1.416 ±6 3,7% 2026-10-02 xhigh
LMArena text/multi_turn 1.396 ±9,81 1.396 ±9 3,2% 2026-10-02 xhigh
Epoch AI gpqa_diamond obsolescenza ×0,26 0,93 ±0,02 1.471 ±7 1,6% 2026-09-22 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Codice 1.430 [1.425–1.434] Percentile 83 · #49 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena webdev/overall 1.638 ±6,00 1.489 ±2 61,7% 2026-10-01 xhigh
LMArena text/coding anomalo 1.423 ±8,21 1.402 ±7 25,2% 2026-10-02 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Agenti 1.448 [1.441–1.454] Percentile 67 · #20 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena agent/overall 0,04 ±0,01 1.475 ±4 90,0% 2026-10-02 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Matematica 1.400 [1.387–1.413] Percentile 72 · #73 · componenti: 3
Fonte Componente Valore Elo-eq Peso Misurato Variante
Epoch AI frontiermath_t1_3 obsolescenza ×0,86 0,53 ±0,03 1.436 ±6 37,9% 2026-09-22 xhigh
LMArena text/math 1.415 ±17 1.407 ±16 36,4% 2026-10-02 xhigh
Epoch AI frontiermath_t4 obsolescenza ×0,86 0,17 ±0,06 1.420 ±10 16,0% 2026-09-22 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Scrittura 1.408 [1.397–1.418] Percentile 68 · #85 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/creative_writing 1.400 ±8,24 1.428 ±8 58,9% 2026-10-02 xhigh
LMArena text/longer_query 1.417 ±6,07 1.416 ±6 33,9% 2026-10-02 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 繁體中文 1.402 [1.384–1.421] Percentile 58 · #94 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/chinese 1.459 ±13 1.421 ±10 91,6% 2026-10-02 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: English 1.379 [1.368–1.391] Percentile 56 · #120 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/english 1.404 ±6,11 1.392 ±6 93,1% 2026-10-02 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Русский 1.393 [1.377–1.410] Percentile 58 · #100 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/russian 1.403 ±10 1.410 ±9 92,2% 2026-10-02 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

Storico

fedi-index per mese
Gli stessi dati in tabella
Modello 2026-10
Grok 4.7 1.416 B

Badge

Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.

fedi-index: Grok 4.7

Dati CC BY 4.0: mantieni il link a fedi.software.