Aller au contenu
fedi.software

GPT-5.3 Chat (latest) dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

B 1 372 ±2

Percentile 54 · #136 · provisoire

Préféré par les humains / Résout des tâches

1 382 / —

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

-45

4,81 $US par million de tokens, médiane de 6 fournisseurs · éditeur 4,81 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

B Général 1 372 [1 369–1 374] Percentile 54 · #136 · composantes : 6 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/overall 1 389 ±2,15 1 389 ±2 25,8% 2026-10-02 —
LMArena text/hard_prompts 1 399 ±2,64 1 394 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1 379 ±3,30 1 393 ±3 12,6% 2026-10-02 —
LMArena text/expert 1 397 ±5,70 1 392 ±5 12,0% 2026-10-02 —
LMArena text/longer_query 1 396 ±3,16 1 396 ±3 6,3% 2026-10-02 —
LMArena text/multi_turn 1 412 ±4,07 1 410 ±4 6,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Code 1 370 [1 364–1 375] Percentile 53 · #132 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 407 ±3,58 1 388 ±3 90,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Maths 1 359 [1 348–1 370] Percentile 48 · #133 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 389 ±6,64 1 382 ±6 87,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Écriture 1 376 [1 371–1 382] Percentile 56 · #118 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 356 ±4,42 1 384 ±4 61,5% 2026-10-02 —
LMArena text/longer_query 1 396 ±3,16 1 396 ±3 32,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 繁體中文 1 387 [1 378–1 397] Percentile 51 · #109 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 433 ±6,55 1 400 ±5 93,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Deutsch 1 372 [1 352–1 392] Percentile 41 · #85 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 384 ±13 1 388 ±11 91,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : English 1 367 [1 361–1 372] Percentile 53 · #130 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 390 ±2,95 1 377 ±3 93,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Español 1 358 [1 344–1 374] Percentile 24 · #113 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 370 ±8,96 1 371 ±8 92,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Français 1 370 [1 354–1 387] Percentile 29 · #96 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 398 ±9,95 1 384 ±9 92,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 한국어 1 379 [1 360–1 398] Percentile 37 · #86 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 348 ±14 1 395 ±10 91,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Polski 1 388 [1 371–1 405] Percentile 36 · #84 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 396 ±11 1 404 ±9 92,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Русский 1 394 [1 386–1 402] Percentile 58 · #99 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 400 ±4,92 1 407 ±4 93,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
GPT-5.3 Chat (latest) 1 372 B

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: GPT-5.3 Chat (latest)

Données CC BY 4.0 : conservez le lien vers fedi.software.