Vai al contenuto
fedi.software

grok-3-preview-02-24 nel fedi-index

Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.

fedi-index · Generale

B 1.398 ±3

Percentile 66 · #99 · provvisorio

Preferito dalle persone / Risolve compiti

1.410 / —

Voti umani e benchmark, Elo-eq

Qualità-prezzo

-24

6 USD per 1 M di token, mediana di 1 provider

Sul tuo hardware

Pesi chiusi: solo cloud.

Scomposizione del punteggio

B Generale 1.398 [1.395–1.400] Percentile 66 · #99 · componenti: 6 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/overall 1.426 ±2,20 1.426 ±2 26,1% 2026-10-02 —
LMArena text/hard_prompts 1.433 ±3,24 1.425 ±3 25,7% 2026-10-02 —
LMArena text/instruction_following 1.409 ±3,36 1.421 ±3 12,8% 2026-10-02 —
LMArena text/expert 1.420 ±7,68 1.411 ±6 11,4% 2026-10-02 —
LMArena text/longer_query 1.439 ±4,42 1.437 ±4 6,2% 2026-10-02 —
LMArena text/multi_turn 1.424 ±4,58 1.421 ±4 6,2% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Codice 1.389 [1.382–1.396] Percentile 62 · #107 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/coding 1.432 ±4,24 1.410 ±4 90,0% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Matematica 1.361 [1.352–1.371] Percentile 49 · #130 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/math 1.390 ±5,66 1.384 ±5 87,6% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Scrittura 1.426 [1.419–1.432] Percentile 77 · #62 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/creative_writing 1.414 ±4,66 1.443 ±5 61,9% 2026-10-02 —
LMArena text/longer_query 1.439 ±4,42 1.437 ±4 31,7% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 繁體中文 1.398 [1.388–1.408] Percentile 55 · #100 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/chinese 1.448 ±6,96 1.412 ±6 93,4% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Deutsch 1.411 [1.394–1.428] Percentile 65 · #51 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/german 1.431 ±11 1.429 ±10 92,0% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: English 1.414 [1.409–1.420] Percentile 69 · #85 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/english 1.438 ±2,78 1.428 ±3 93,9% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Lingua: Español 1.392 [1.367–1.417] Percentile 44 · #84 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/spanish 1.417 ±15 1.414 ±14 89,4% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Français 1.416 [1.391–1.442] Percentile 58 · #57 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/french 1.460 ±16 1.442 ±14 89,3% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 日本語 1.402 [1.387–1.416] Percentile 54 · #60 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/japanese 1.388 ±11 1.418 ±8 92,6% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 한국어 1.397 [1.378–1.416] Percentile 51 · #67 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/korean 1.374 ±14 1.416 ±11 91,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Polski 1.419 [1.407–1.431] Percentile 65 · #46 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/polish 1.433 ±7,86 1.435 ±7 93,0% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Русский 1.407 [1.398–1.416] Percentile 64 · #84 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/russian 1.416 ±5,67 1.421 ±5 93,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

Storico

fedi-index per mese
Gli stessi dati in tabella
Modello 2026-10
grok-3-preview-02-24 1.398 B

Badge

Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.

fedi-index: grok-3-preview-02-24

Dati CC BY 4.0: mantieni il link a fedi.software.