Aller au contenu
fedi.software

GPT-4.1 Mini dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

C 1 327 ±6

Percentile 40 · #175

Préféré par les humains / Résout des tâches

1 337 / 1 311

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

-42

0,70 $US par million de tokens, médiane de 23 fournisseurs · éditeur 0,70 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

C Général 1 327 [1 321–1 334] Percentile 40 · #175 · composantes : 9
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 135 ±1,37 1 320 ±11 29,6% 2025-04-14 —
LMArena text/overall 1 340 ±2,20 1 340 ±2 16,8% 2026-10-02 —
LMArena text/hard_prompts 1 349 ±2,88 1 348 ±3 16,7% 2026-10-02 —
LMArena text/instruction_following 1 332 ±3,31 1 349 ±3 8,2% 2026-10-02 —
LMArena text/expert 1 338 ±6,62 1 344 ±5 7,6% 2026-10-02 —
Epoch AI simpleqa_verified ancienneté ×0,61 0,13 ±0,01 1 337 ±3 4,4% 2026-08-31 —
LMArena text/multi_turn 1 354 ±3,88 1 357 ±4 4,1% 2026-10-02 —
LMArena text/longer_query 1 344 ±3,82 1 348 ±4 4,1% 2026-10-02 —
Epoch AI gpqa_diamond ancienneté ×0,26 0,66 ±0,03 1 346 ±13 1,2% 2025-04-14 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Code 1 337 [1 331–1 343] Percentile 38 · #172 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 367 ±3,83 1 352 ±3 90,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Maths 1 328 [1 322–1 334] Percentile 38 · #158 · composantes : 2
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 343 ±5,67 1 338 ±5 48,2% 2026-10-02 —
Epoch AI frontiermath_t1_3 ancienneté ×0,86 0,07 ±0,01 1 336 ±3 45,0% 2026-08-27 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Vision 1 355 [1 350–1 360] Percentile 30 · #79 · composantes : 3 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena vision/overall 1 181 ±3,81 1 368 ±3 63,9% 2026-10-02 —
LMArena vision/ocr 1 188 ±4,81 1 363 ±5 15,4% 2026-10-02 —
LMArena vision/diagram 1 182 ±6,95 1 359 ±6 14,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Écriture 1 325 [1 319–1 331] Percentile 44 · #151 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 300 ±4,45 1 326 ±4 61,8% 2026-10-02 —
LMArena text/longer_query 1 344 ±3,82 1 348 ±4 31,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 繁體中文 1 310 [1 301–1 319] Percentile 30 · #157 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 329 ±6,15 1 318 ±5 93,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Deutsch 1 347 [1 332–1 361] Percentile 32 · #98 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 349 ±9,36 1 358 ±8 92,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : English 1 333 [1 327–1 338] Percentile 40 · #164 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 356 ±2,76 1 341 ±3 93,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Español 1 314 [1 296–1 332] Percentile 13 · #130 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 320 ±11 1 324 ±10 91,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Français 1 334 [1 313–1 355] Percentile 16 · #114 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 357 ±13 1 347 ±12 90,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 日本語 1 335 [1 321–1 348] Percentile 25 · #96 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 291 ±10 1 345 ±8 92,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 한국어 1 346 [1 331–1 361] Percentile 25 · #102 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 298 ±11 1 357 ±8 92,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Polski 1 335 [1 326–1 345] Percentile 14 · #113 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 326 ±6,22 1 345 ±5 93,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Русский 1 330 [1 321–1 338] Percentile 34 · #155 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 324 ±5,38 1 338 ±5 93,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
GPT-4.1 Mini 1 327 C

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: GPT-4.1 Mini

Données CC BY 4.0 : conservez le lien vers fedi.software.