Aller au contenu
fedi.software

GLM 5.1 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 432 ±5

Percentile 83 · #51

Préféré par les humains / Résout des tâches

1 445 / 1 415

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+36

2,14 $US par million de tokens, médiane de 42 fournisseurs · éditeur 2,15 $US

Sur votre matériel

Ne tient dans aucune configuration de référence.

Décomposition du score

A Général 1 432 [1 427–1 437] Percentile 83 · #51 · composantes : 9
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 150 ±0,90 1 436 ±7 33,9% 2026-04-07 —
LMArena text/overall 1 461 ±1,87 1 462 ±2 15,6% 2026-10-02 —
LMArena text/hard_prompts 1 472 ±2,17 1 459 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1 451 ±2,63 1 461 ±2 7,7% 2026-10-02 —
LMArena text/expert 1 476 ±4,14 1 457 ±3 7,5% 2026-10-02 —
LMArena text/longer_query 1 466 ±2,51 1 462 ±2 3,9% 2026-10-02 —
Epoch AI simpleqa_verified ancienneté ×0,61 0,34 ±0,01 1 404 ±5 3,8% 2026-08-27 —
LMArena text/multi_turn 1 472 ±3,51 1 464 ±3 3,8% 2026-10-02 —
Epoch AI gpqa_diamond ancienneté ×0,26 0,90 ±0,02 1 458 ±10 1,3% 2026-08-10 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 434 [1 430–1 437] Percentile 85 · #43 · composantes : 3
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 508 ±3,44 1 452 ±1 39,6% 2026-10-01 —
LMArena text/coding 1 486 ±2,86 1 458 ±3 38,7% 2026-10-02 —
Epoch AI swe_bench_verified ancienneté ×0,37 0,74 ±0,02 1 454 ±10 13,4% 2026-05-15 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Maths 1 418 [1 410–1 426] Percentile 82 · #46 · composantes : 2
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 473 ±5,85 1 463 ±6 50,4% 2026-10-02 —
Epoch AI frontiermath_t1_3 ancienneté ×0,86 0,37 ±0,03 1 401 ±6 42,4% 2026-08-29 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 459 [1 454–1 463] Percentile 91 · #24 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 452 ±3,37 1 482 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1 466 ±2,51 1 462 ±2 31,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 繁體中文 1 448 [1 441–1 456] Percentile 88 · #27 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 515 ±5,06 1 465 ±4 93,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Deutsch 1 437 [1 421–1 453] Percentile 85 · #23 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 464 ±10 1 457 ±9 92,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 452 [1 447–1 457] Percentile 91 · #26 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 476 ±2,42 1 468 ±3 94,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Español 1 443 [1 431–1 456] Percentile 88 · #18 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 468 ±7,36 1 461 ±7 93,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Français 1 438 [1 425–1 450] Percentile 81 · #27 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 475 ±7,56 1 456 ±7 93,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 日本語 1 432 [1 416–1 449] Percentile 80 · #26 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 434 ±12 1 452 ±9 92,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 한국어 1 432 [1 419–1 446] Percentile 80 · #28 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 420 ±9,72 1 450 ±7 92,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Polski 1 428 [1 414–1 442] Percentile 74 · #35 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 445 ±9,05 1 446 ±8 92,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Русский 1 439 [1 432–1 446] Percentile 84 · #38 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 453 ±3,92 1 455 ±4 93,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
GLM 5.1 1 432 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: GLM 5.1

Données CC BY 4.0 : conservez le lien vers fedi.software.