Aller au contenu
fedi.software

Grok 4.5 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 440 ±5

Percentile 87 · #38

Préféré par les humains / Résout des tâches

1 436 / 1 446

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+35

3 $US par million de tokens, médiane de 23 fournisseurs · éditeur 3 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 440 [1 435–1 445] Percentile 87 · #38 · composantes : 9
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 154 ±0,87 1 469 ±7 34,3% 2026-07-08 —
LMArena text/overall 1 448 ±2,21 1 448 ±2 15,5% 2026-10-02 —
LMArena text/hard_prompts 1 462 ±2,57 1 451 ±2 15,4% 2026-10-02 —
LMArena text/instruction_following 1 445 ±3,11 1 456 ±3 7,6% 2026-10-02 —
LMArena text/expert 1 466 ±4,73 1 449 ±4 7,4% 2026-10-02 —
LMArena text/longer_query 1 462 ±2,90 1 459 ±3 3,8% 2026-10-02 —
Epoch AI simpleqa_verified ancienneté ×0,61 0,48 ±0,02 1 449 ±5 3,8% 2026-08-27 high
LMArena text/multi_turn 1 456 ±4,11 1 450 ±4 3,7% 2026-10-02 —
Epoch AI gpqa_diamond ancienneté ×0,26 0,93 ±0,01 1 474 ±7 1,5% 2026-07-08 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 432 [1 429–1 434] Percentile 84 · #46 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 552 ±3,38 1 464 ±1 46,0% 2026-10-01 —
LMArena text/coding 1 474 ±3,40 1 448 ±3 44,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Agents 1 451 [1 446–1 457] Percentile 75 · #15 · composantes : 2
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena agent/overall 0,01 ±0,01 1 461 ±2 66,6% 2026-10-02 —
τ²-bench (Sierra) tau2/banking_knowledge ancienneté ×0,76 0,48 ±0,05 1 494 ±8 26,3% 2026-07-24 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Maths 1 427 [1 419–1 436] Percentile 84 · #41 · composantes : 3
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 459 ±7,25 1 450 ±7 50,6% 2026-10-02 —
Epoch AI frontiermath_t1_3 ancienneté ×0,86 0,57 ±0,03 1 445 ±6 30,0% 2026-07-09 high
Epoch AI frontiermath_t4 ancienneté ×0,86 0,24 ±0,07 1 432 ±11 11,6% 2026-07-09 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Vision 1 449 [1 444–1 453] Percentile 82 · #21 · composantes : 3 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena vision/overall 1 288 ±3,74 1 464 ±3 63,4% 2026-10-02 —
LMArena vision/ocr 1 295 ±4,00 1 466 ±4 15,6% 2026-10-02 —
LMArena vision/diagram 1 307 ±5,96 1 470 ±5 14,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Recherche 1 439 [1 433–1 446] Percentile 78 · #8 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena search/overall 1 213 ±3,50 1 455 ±4 93,8% 2026-08-24 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 450 [1 445–1 455] Percentile 86 · #38 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 441 ±3,90 1 470 ±4 61,8% 2026-10-02 —
LMArena text/longer_query 1 462 ±2,90 1 459 ±3 32,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 繁體中文 1 434 [1 425–1 442] Percentile 80 · #45 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 495 ±5,77 1 449 ±5 93,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Deutsch 1 423 [1 405–1 442] Percentile 73 · #39 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 448 ±12 1 443 ±10 91,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 430 [1 424–1 436] Percentile 82 · #49 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 454 ±2,94 1 445 ±3 93,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Español 1 426 [1 410–1 442] Percentile 72 · #42 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 450 ±9,54 1 445 ±9 92,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Français 1 420 [1 404–1 435] Percentile 62 · #52 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 456 ±9,36 1 438 ±9 92,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 日本語 1 426 [1 407–1 445] Percentile 78 · #29 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 427 ±14 1 447 ±11 91,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 한국어 1 419 [1 403–1 435] Percentile 68 · #44 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 402 ±12 1 437 ±9 92,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Polski 1 418 [1 399–1 436] Percentile 62 · #51 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 435 ±12 1 437 ±10 91,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Русский 1 434 [1 426–1 442] Percentile 81 · #46 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 447 ±4,71 1 449 ±4 93,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
Grok 4.5 1 440 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: Grok 4.5

Données CC BY 4.0 : conservez le lien vers fedi.software.