Vai al contenuto
fedi.software

grok-4.1-thinking nel fedi-index

Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.

fedi-index · Generale

B 1.400 ±2

Percentile 68 · #95 · provvisorio

Preferito dalle persone / Risolve compiti

1.411 / —

Voti umani e benchmark, Elo-eq

Qualità-prezzo

-12

4 USD per 1 M di token, mediana di 1 provider

Sul tuo hardware

Pesi chiusi: solo cloud.

Scomposizione del punteggio

B Generale 1.400 [1.398–1.401] Percentile 68 · #95 · componenti: 6 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/overall 1.437 ±1,61 1.437 ±2 25,6% 2026-10-02 thinking
LMArena text/hard_prompts 1.435 ±2,02 1.427 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1.400 ±2,57 1.413 ±2 12,6% 2026-10-02 —
LMArena text/expert 1.417 ±4,45 1.409 ±4 12,2% 2026-10-02 thinking
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1.438 ±3,15 1.433 ±3 6,3% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Codice 1.380 [1.377–1.382] Percentile 57 · #120 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena webdev/overall 1.241 ±5,65 1.376 ±2 45,6% 2026-10-01 fast-reasoning
LMArena text/coding 1.445 ±2,80 1.422 ±2 44,8% 2026-10-02 thinking

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Matematica 1.389 [1.381–1.397] Percentile 62 · #98 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/math 1.422 ±4,91 1.414 ±5 87,9% 2026-10-02 thinking

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Visione 1.371 [1.367–1.376] Percentile 38 · #70 · componenti: 3 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena vision/overall 1.201 ±3,54 1.385 ±3 63,3% 2026-10-02 fast-reasoning
LMArena vision/ocr 1.195 ±3,78 1.370 ±4 15,6% 2026-10-02 fast-reasoning
LMArena vision/diagram 1.210 ±5,59 1.384 ±5 14,9% 2026-10-02 fast-reasoning

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Scrittura 1.418 [1.413–1.422] Percentile 73 · #72 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/creative_writing 1.411 ±3,37 1.440 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 31,8% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 繁體中文 1.411 [1.405–1.418] Percentile 67 · #74 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/chinese 1.464 ±4,42 1.425 ±4 93,8% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Deutsch 1.425 [1.411–1.439] Percentile 74 · #38 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/german 1.446 ±9,00 1.442 ±8 92,7% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: English 1.423 [1.419–1.427] Percentile 75 · #69 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/english 1.447 ±2,24 1.437 ±2 94,0% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Español 1.418 [1.406–1.430] Percentile 64 · #55 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/spanish 1.438 ±7,27 1.434 ±7 93,0% 2026-10-02 thinking

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Français 1.414 [1.401–1.427] Percentile 55 · #61 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/french 1.448 ±7,97 1.430 ±7 92,8% 2026-10-02 thinking

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 日本語 1.407 [1.391–1.422] Percentile 58 · #54 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/japanese 1.396 ±11 1.424 ±8 92,4% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 한국어 1.423 [1.410–1.436] Percentile 72 · #39 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/korean 1.407 ±9,39 1.440 ±7 92,9% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Lingua: Polski 1.437 [1.426–1.448] Percentile 82 · #25 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/polish 1.455 ±7,00 1.454 ±6 93,3% 2026-10-02 thinking

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Русский 1.423 [1.417–1.429] Percentile 75 · #60 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/russian 1.434 ±3,63 1.437 ±3 93,9% 2026-10-02 thinking

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

Storico

fedi-index per mese
Gli stessi dati in tabella
Modello 2026-10
grok-4.1-thinking 1.400 B

Badge

Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.

fedi-index: grok-4.1-thinking

Dati CC BY 4.0: mantieni il link a fedi.software.