Aller au contenu
fedi.software

Grok 4.20 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 425 ±8

Percentile 81 · #56

Préféré par les humains / Résout des tâches

1 419 / 1 432

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+33

1,77 $US par million de tokens, médiane de 3 fournisseurs

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 425 [1 417–1 433] Percentile 81 · #56 · composantes : 7
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 152 ±1,30 1 453 ±10 38,7% 2026-02-17 —
LMArena text/overall 1 444 ±2,32 1 444 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1 441 ±2,78 1 432 ±2 15,8% 2026-10-02 —
LMArena text/instruction_following 1 415 ±3,55 1 427 ±3 7,7% 2026-10-02 —
LMArena text/expert 1 428 ±6,29 1 418 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1 427 ±3,45 1 426 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1 451 ±4,77 1 445 ±4 3,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Code 1 401 [1 395–1 407] Percentile 68 · #90 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 447 ±3,83 1 423 ±3 90,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Maths 1 396 [1 384–1 408] Percentile 68 · #83 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 433 ±7,35 1 425 ±7 86,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Recherche 1 417 [1 411–1 423] Percentile 47 · #18 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena search/overall 1 189 ±3,08 1 431 ±3 93,9% 2026-08-24 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 437 [1 430–1 443] Percentile 82 · #49 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 438 ±4,92 1 467 ±5 61,1% 2026-10-02 —
LMArena text/longer_query 1 427 ±3,45 1 426 ±3 32,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 繁體中文 1 418 [1 407–1 429] Percentile 71 · #66 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 475 ±7,46 1 434 ±6 93,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Deutsch 1 433 [1 412–1 454] Percentile 82 · #27 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 463 ±14 1 457 ±12 90,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 427 [1 421–1 433] Percentile 80 · #55 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 451 ±3,09 1 442 ±3 93,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Español 1 416 [1 400–1 433] Percentile 62 · #57 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 439 ±9,94 1 434 ±9 92,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Français 1 418 [1 400–1 436] Percentile 59 · #56 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 455 ±11 1 438 ±10 91,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 한국어 1 426 [1 407–1 446] Percentile 73 · #37 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 416 ±14 1 448 ±11 91,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Polski 1 415 [1 396–1 433] Percentile 57 · #57 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 432 ±12 1 434 ±10 91,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Русский 1 434 [1 425–1 443] Percentile 81 · #45 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 448 ±5,42 1 450 ±5 93,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
Grok 4.20 1 425 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: Grok 4.20

Données CC BY 4.0 : conservez le lien vers fedi.software.