Claude Sonnet 4 dans le fedi-index
Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.
fedi-index · Général
B 1 359 ±6
Percentile 51 · #145
Préféré par les humains / Résout des tâches
1 359 / 1 359
Votes humains et benchmarks, Elo-eq
Rapport qualité-prix
-62
6 $US par million de tokens, médiane de 14 fournisseurs
Sur votre matériel
Poids fermés : cloud uniquement.
Décomposition du score
B Général 1 359 [1 353–1 366] Percentile 51 · #145 · composantes : 8
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
142 ±1,04 | 1 372 ±8 | 37,5% | 2025-05-22 | — |
| LMArena |
text/overall
|
1 351 ±2,30 | 1 351 ±2 | 15,9% | 2026-10-02 | thinking-32k |
| LMArena |
text/hard_prompts
|
1 372 ±2,93 | 1 370 ±3 | 15,8% | 2026-10-02 | thinking-32k |
| LMArena |
text/instruction_following
|
1 376 ±3,60 | 1 390 ±3 | 7,7% | 2026-10-02 | thinking-32k |
| LMArena |
text/expert
|
1 371 ±7,47 | 1 371 ±6 | 7,0% | 2026-10-02 | thinking-32k |
| LMArena |
text/longer_query
|
1 398 ±3,93 | 1 398 ±4 | 3,8% | 2026-10-02 | thinking-32k |
| LMArena |
text/multi_turn
|
1 376 ±4,27 | 1 378 ±4 | 3,8% | 2026-10-02 | thinking-32k |
| Epoch AI |
gpqa_diamond
ancienneté ×0,26 |
0,79 ±0,03 | 1 408 ±12 | 1,3% | 2025-05-26 | 59k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
B Code 1 375 [1 368–1 381] Percentile 54 · #127 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 414 ±4,03 | 1 394 ±4 | 90,1% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Maths 1 348 [1 337–1 358] Percentile 46 · #138 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 375 ±6,60 | 1 369 ±6 | 87,2% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Vision 1 362 [1 350–1 374] Percentile 33 · #76 · composantes : 2 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 191 ±8,64 | 1 376 ±8 | 76,2% | 2026-10-02 | thinking-32k |
| LMArena |
vision/ocr
|
1 196 ±11 | 1 371 ±11 | 16,2% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
B Écriture 1 370 [1 364–1 376] Percentile 54 · #123 · composantes : 2 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 345 ±4,86 | 1 372 ±5 | 61,4% | 2026-10-02 | thinking-32k |
| LMArena |
text/longer_query
|
1 398 ±3,93 | 1 398 ±4 | 32,2% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : 繁體中文 1 326 [1 317–1 336] Percentile 32 · #152 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 351 ±6,34 | 1 335 ±5 | 93,5% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : Deutsch 1 332 [1 317–1 347] Percentile 29 · #103 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 330 ±9,58 | 1 342 ±8 | 92,5% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : English 1 341 [1 335–1 347] Percentile 44 · #154 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 364 ±2,97 | 1 350 ±3 | 93,9% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
D Langue : Español 1 346 [1 327–1 364] Percentile 20 · #119 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 357 ±11 | 1 359 ±10 | 91,7% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
D Langue : Français 1 340 [1 318–1 361] Percentile 17 · #112 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 364 ±13 | 1 353 ±12 | 90,8% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : 日本語 1 342 [1 328–1 356] Percentile 28 · #93 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 301 ±10 | 1 353 ±8 | 92,7% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
D Langue : 한국어 1 342 [1 328–1 357] Percentile 24 · #104 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 292 ±11 | 1 353 ±8 | 92,6% | 2026-10-02 | — |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
D Langue : Polski 1 334 [1 325–1 343] Percentile 13 · #114 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 324 ±5,80 | 1 343 ±5 | 93,5% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
C Langue : Русский 1 356 [1 346–1 365] Percentile 41 · #138 · composantes : 1 provisoire
| Source | Composante | Valeur | Elo-eq | Poids | Mesuré le | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 355 ±6,06 | 1 366 ±5 | 93,4% | 2026-10-02 | thinking-32k |
Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie
Historique
La même chose en tableau
| Modèle | 2026-10 |
|---|---|
| Claude Sonnet 4 | 1 359 B |
Badge
Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.
Données CC BY 4.0 : conservez le lien vers fedi.software.