Aller au contenu
fedi.software

Claude Opus 4.5 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 436 ±6

Percentile 85 · #46

Préféré par les humains / Résout des tâches

1 448 / 1 417

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+2

10 $US par million de tokens, médiane de 34 fournisseurs · éditeur 10 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 436 [1 430–1 442] Percentile 85 · #46 · composantes : 9
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 150 ±1,21 1 438 ±10 30,9% 2025-11-24 —
LMArena text/overall 1 451 ±1,59 1 451 ±2 16,4% 2026-10-02 —
LMArena text/hard_prompts 1 476 ±2,01 1 463 ±2 16,3% 2026-10-02 —
LMArena text/instruction_following 1 477 ±3,38 1 486 ±3 7,9% 2026-10-02 high-32k
LMArena text/expert 1 487 ±4,22 1 466 ±4 7,9% 2026-10-02 —
LMArena text/longer_query 1 480 ±2,51 1 475 ±2 4,0% 2026-10-02 —
LMArena text/multi_turn 1 466 ±3,06 1 459 ±3 4,0% 2026-10-02 —
Epoch AI simpleqa_verified ancienneté ×0,61 0,46 ±0,02 1 441 ±5 4,0% 2026-08-27 32k
Epoch AI gpqa_diamond ancienneté ×0,26 0,86 ±0,02 1 440 ±10 1,4% 2025-11-24 32k

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 440 [1 436–1 443] Percentile 90 · #28 · composantes : 3
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 493 ±4,21 1 448 ±1 39,7% 2026-10-01 high-32k
LMArena text/coding 1 503 ±3,66 1 473 ±3 38,2% 2026-10-02 high-32k
Epoch AI swe_bench_verified ancienneté ×0,37 0,77 ±0,02 1 466 ±10 13,8% 2026-02-05 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Agents 1 404 [1 392–1 415] Percentile 21 · #46 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
τ²-bench (Sierra) tau2/banking_knowledge ancienneté ×0,76 0,25 ±0,04 1 455 ±7 79,7% 2026-05-05 high

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Maths 1 411 [1 404–1 418] Percentile 78 · #58 · composantes : 3
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 462 ±6,18 1 453 ±6 49,8% 2026-10-02 high-32k
Epoch AI frontiermath_t1_3 ancienneté ×0,86 0,34 ±0,03 1 396 ±6 28,4% 2026-06-11 32k
Epoch AI frontiermath_t4 ancienneté ×0,86 0,05 ±0,03 1 400 ±5 14,6% 2026-06-11 32k

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 458 [1 452–1 463] Percentile 91 · #25 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 445 ±4,21 1 474 ±4 61,4% 2026-10-02 high-32k
LMArena text/longer_query 1 480 ±2,51 1 475 ±2 32,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 繁體中文 1 416 [1 409–1 422] Percentile 70 · #68 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 470 ±4,35 1 430 ±4 93,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Deutsch 1 427 [1 412–1 441] Percentile 76 · #35 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 449 ±9,29 1 445 ±8 92,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 437 [1 433–1 441] Percentile 87 · #37 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 461 ±2,22 1 452 ±2 94,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Español 1 432 [1 417–1 448] Percentile 78 · #33 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 457 ±9,07 1 451 ±8 92,4% 2026-10-02 high-32k

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Français 1 434 [1 422–1 446] Percentile 76 · #33 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 471 ±7,47 1 452 ±7 93,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 日本語 1 416 [1 394–1 437] Percentile 67 · #43 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 415 ±16 1 438 ±12 90,6% 2026-10-02 high-32k

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 한국어 1 436 [1 423–1 449] Percentile 82 · #25 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 425 ±9,31 1 454 ±7 92,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Polski 1 425 [1 414–1 435] Percentile 71 · #39 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 439 ±6,93 1 441 ±6 93,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Русский 1 435 [1 429–1 440] Percentile 82 · #44 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 448 ±3,44 1 450 ±3 93,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
Claude Opus 4.5 1 436 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: Claude Opus 4.5

Données CC BY 4.0 : conservez le lien vers fedi.software.