Aller au contenu
fedi.software

GPT-6 Sol dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 434 ±8

Percentile 84 · #49

Préféré par les humains / Résout des tâches

1 397 / 1 494

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+22

4 $US par million de tokens, médiane de 22 fournisseurs · éditeur 4 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 434 [1 426–1 441] Percentile 84 · #49 · composantes : 9
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 163 ±1,66 1 538 ±13 27,6% 2026-09-22 —
LMArena text/overall 1 395 ±3,54 1 395 ±4 17,5% 2026-10-02 max
LMArena text/hard_prompts 1 419 ±4,34 1 412 ±4 17,3% 2026-10-02 max
LMArena text/instruction_following 1 413 ±5,66 1 425 ±5 8,2% 2026-10-02 max
LMArena text/expert 1 439 ±9,92 1 426 ±8 7,2% 2026-10-02 max
Epoch AI simpleqa_verified ancienneté ×0,61 0,61 ±0,02 1 488 ±5 4,5% 2026-09-22 max
LMArena text/longer_query 1 414 ±5,24 1 413 ±5 4,2% 2026-10-02 max
LMArena text/multi_turn 1 413 ±8,43 1 411 ±8 3,7% 2026-10-02 max
Epoch AI gpqa_diamond ancienneté ×0,26 0,94 ±0,01 1 478 ±7 1,8% 2026-09-22 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 444 [1 440–1 448] Percentile 91 · #25 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 689 ±5,84 1 503 ±2 60,7% 2026-10-01 max
LMArena text/coding valeur aberrante 1 448 ±6,78 1 424 ±6 26,5% 2026-10-02 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Agents 1 470 [1 460–1 480] Percentile 90 · #7 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena agent/overall 0,10 ±0,01 1 502 ±6 89,3% 2026-10-02 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Maths 1 447 [1 436–1 458] Percentile 90 · #26 · composantes : 3
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 407 ±14 1 400 ±13 38,6% 2026-10-02 max
Epoch AI frontiermath_t1_3 ancienneté ×0,86 0,90 ±0,02 1 516 ±4 37,4% 2026-09-22 max
Epoch AI frontiermath_t4 ancienneté ×0,86 0,90 ±0,05 1 536 ±8 15,3% 2026-09-22 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Écriture 1 397 [1 388–1 406] Percentile 64 · #98 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 382 ±7,40 1 410 ±8 59,4% 2026-10-02 max
LMArena text/longer_query 1 414 ±5,24 1 413 ±5 33,7% 2026-10-02 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 繁體中文 1 362 [1 345–1 379] Percentile 42 · #130 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 403 ±12 1 376 ±9 92,0% 2026-10-02 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : English 1 374 [1 364–1 384] Percentile 55 · #123 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 398 ±5,37 1 386 ±6 93,3% 2026-10-02 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Español 1 361 [1 334–1 387] Percentile 26 · #111 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 381 ±17 1 381 ±15 88,7% 2026-10-02 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Русский 1 399 [1 385–1 414] Percentile 60 · #93 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 409 ±8,84 1 415 ±8 92,6% 2026-10-02 max

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
GPT-6 Sol 1 434 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: GPT-6 Sol

Données CC BY 4.0 : conservez le lien vers fedi.software.