Aller au contenu
fedi.software

GPT-5.1 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 426 ±4

Percentile 82 · #55

Préféré par les humains / Résout des tâches

1 432 / 1 418

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+18

3,44 $US par million de tokens, médiane de 26 fournisseurs · éditeur 3,44 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 426 [1 422–1 430] Percentile 82 · #55 · composantes : 9
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 150 ±0,72 1 435 ±6 35,7% 2025-11-13 —
LMArena text/overall 1 443 ±1,88 1 443 ±2 15,3% 2026-10-02 high
LMArena text/hard_prompts 1 457 ±2,45 1 446 ±2 15,2% 2026-10-02 high
LMArena text/instruction_following 1 443 ±3,20 1 454 ±3 7,5% 2026-10-02 high
LMArena text/expert 1 470 ±6,01 1 452 ±5 7,0% 2026-10-02 high
LMArena text/longer_query 1 448 ±3,22 1 445 ±3 3,7% 2026-10-02 high
Epoch AI simpleqa_verified ancienneté ×0,61 0,48 ±0,02 1 448 ±5 3,7% 2026-08-27 high
LMArena text/multi_turn 1 450 ±3,83 1 444 ±4 3,7% 2026-10-02 high
Epoch AI gpqa_diamond ancienneté ×0,26 0,88 ±0,02 1 447 ±9 1,4% 2025-11-13 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Code 1 405 [1 402–1 409] Percentile 70 · #84 · composantes : 3
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 395 ±5,86 1 420 ±2 39,9% 2026-10-01 medium
LMArena text/coding 1 454 ±3,51 1 429 ±3 38,7% 2026-10-02 high
Epoch AI swe_bench_verified ancienneté ×0,37 0,68 ±0,02 1 422 ±11 13,0% 2026-02-18 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Maths 1 408 [1 398–1 418] Percentile 76 · #62 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 446 ±5,91 1 438 ±6 87,5% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Vision 1 415 [1 410–1 420] Percentile 56 · #50 · composantes : 3 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena vision/overall 1 250 ±3,98 1 429 ±4 63,5% 2026-10-02 high
LMArena vision/ocr 1 255 ±4,47 1 428 ±4 15,5% 2026-10-02 high
LMArena vision/diagram 1 265 ±6,41 1 432 ±6 14,7% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 437 [1 431–1 442] Percentile 81 · #51 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 427 ±4,10 1 456 ±4 61,8% 2026-10-02 high
LMArena text/longer_query 1 448 ±3,22 1 445 ±3 32,0% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 繁體中文 1 434 [1 426–1 441] Percentile 81 · #44 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 495 ±5,26 1 449 ±4 93,7% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Deutsch 1 417 [1 400–1 434] Percentile 66 · #49 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 439 ±11 1 436 ±10 91,9% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : English 1 427 [1 422–1 432] Percentile 79 · #57 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 451 ±2,74 1 442 ±3 93,9% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Español 1 410 [1 395–1 425] Percentile 53 · #71 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 431 ±8,85 1 427 ±8 92,5% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Français 1 415 [1 398–1 432] Percentile 57 · #59 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 450 ±10 1 433 ±9 92,0% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 日本語 1 444 [1 425–1 463] Percentile 87 · #18 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 453 ±14 1 466 ±11 91,4% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 한국어 1 418 [1 401–1 434] Percentile 67 · #45 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 401 ±12 1 436 ±9 92,2% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Polski 1 424 [1 411–1 438] Percentile 68 · #42 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 440 ±8,62 1 442 ±7 92,8% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Русский 1 424 [1 417–1 431] Percentile 76 · #58 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 435 ±4,22 1 439 ±4 93,8% 2026-10-02 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
GPT-5.1 1 426 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: GPT-5.1

Données CC BY 4.0 : conservez le lien vers fedi.software.