GPT-4.1 dans le fedi-index
Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.
fedi-index · Général
C 1 353 ±6
Percentile 48 · #154
Préféré par les humains / Résout des tâches
1 370 / 1 324
Votes humains et benchmarks, Elo-eq
Rapport qualité-prix
-56
3,50 $US par million de tokens, médiane de 23 fournisseurs · éditeur 3,50 $US
Sur votre matériel
Poids fermés : cloud uniquement.
Décomposition du score
C Général 1 353 [1 346–1 359] Percentile 48 · #154 · composantes : 9
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
137 ±1,27 | 1 333 ±10 | 31,2% | 2025-04-14 | — |
| LMArena |
text/overall
|
1 383 ±1,89 | 1 383 ±2 | 16,9% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 384 ±2,49 | 1 380 ±2 | 16,8% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1 367 ±2,93 | 1 382 ±3 | 8,3% | 2026-10-02 | — |
| LMArena |
text/expert
|
1 364 ±5,94 | 1 365 ±5 | 7,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 385 ±3,26 | 1 387 ±3 | 4,1% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 398 ±3,49 | 1 397 ±3 | 4,1% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
valeur aberrante ancienneté ×0,61 |
0,31 ±0,01 | 1 395 ±5 | 2,1% | 2026-08-31 | — |
| Epoch AI |
gpqa_diamond
ancienneté ×0,26 |
0,67 ±0,03 | 1 351 ±13 | 1,1% | 2025-04-14 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Code 1 352 [1 346–1 358] Percentile 46 · #152 · composantes : 2
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 391 ±3,37 | 1 373 ±3 | 78,9% | 2026-10-02 | — |
| Epoch AI |
swe_bench_verified
ancienneté ×0,37 |
0,49 ±0,02 | 1 322 ±12 | 12,6% | 2026-02-08 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Maths 1 340 [1 334–1 345] Percentile 43 · #146 · composantes : 2
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 369 ±5,23 | 1 364 ±5 | 48,5% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
ancienneté ×0,86 |
0,06 ±0,01 | 1 334 ±3 | 44,7% | 2026-08-27 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Vision 1 381 [1 376–1 385] Percentile 41 · #67 · composantes : 3 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 210 ±3,40 | 1 394 ±3 | 64,0% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1 218 ±4,54 | 1 392 ±4 | 15,4% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1 215 ±6,62 | 1 388 ±6 | 14,4% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
B Écriture 1 378 [1 373–1 383] Percentile 57 · #117 · composantes : 2 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 364 ±3,92 | 1 391 ±4 | 61,9% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 385 ±3,26 | 1 387 ±3 | 31,9% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : 繁體中文 1 350 [1 342–1 358] Percentile 38 · #139 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 382 ±5,41 | 1 360 ±4 | 93,7% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : Deutsch 1 372 [1 359–1 385] Percentile 42 · #84 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 380 ±8,47 | 1 385 ±7 | 92,8% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
B Langue : English 1 369 [1 364–1 374] Percentile 54 · #126 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 392 ±2,46 | 1 380 ±3 | 94,0% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : Español 1 363 [1 347–1 378] Percentile 28 · #108 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 376 ±9,28 | 1 376 ±9 | 92,3% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : Français 1 356 [1 338–1 375] Percentile 25 · #101 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 382 ±11 | 1 371 ±10 | 91,5% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : 日本語 1 355 [1 342–1 368] Percentile 32 · #88 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 319 ±9,56 | 1 366 ±7 | 92,9% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : 한국어 1 376 [1 362–1 389] Percentile 36 · #87 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 339 ±9,65 | 1 389 ±7 | 92,8% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : Polski 1 385 [1 376–1 394] Percentile 35 · #85 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 389 ±5,88 | 1 398 ±5 | 93,5% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : Русский 1 374 [1 366–1 382] Percentile 48 · #123 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 377 ±4,80 | 1 386 ±4 | 93,7% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
Historique
La même chose en tableau
| Modèle | 2026-10 |
|---|---|
| GPT-4.1 | 1 353 C |
Badge
Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.
Données CC BY 4.0 : conservez le lien vers fedi.software.