Aller au contenu
fedi.software

Muse Spark 1.2 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 457 ±7

Percentile 92 · #23

Préféré par les humains / Résout des tâches

1 459 / 1 455

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+62

2 $US par million de tokens, médiane de 13 fournisseurs · éditeur 0,125 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 457 [1 450–1 464] Percentile 92 · #23 · composantes : 8
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 155 ±1,17 1 476 ±9 37,5% 2026-08-05 —
LMArena text/overall 1 483 ±4,65 1 483 ±5 15,7% 2026-10-02 xhigh
LMArena text/hard_prompts 1 489 ±5,71 1 475 ±5 15,4% 2026-10-02 xhigh
LMArena text/instruction_following 1 467 ±7,56 1 476 ±7 7,0% 2026-10-02 xhigh
LMArena text/expert 1 485 ±13 1 464 ±11 5,6% 2026-10-02 xhigh
Epoch AI simpleqa_verified ancienneté ×0,61 0,60 ±0,02 1 487 ±5 4,7% 2026-08-27 xhigh
LMArena text/longer_query 1 478 ±6,87 1 474 ±6 3,6% 2026-10-02 xhigh
LMArena text/multi_turn 1 509 ±12 1 497 ±11 2,9% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 434 [1 428–1 441] Percentile 86 · #41 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 532 ±6,93 1 459 ±2 49,6% 2026-10-01 xhigh
LMArena text/coding 1 494 ±8,71 1 465 ±8 39,8% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Agents 1 417 [1 414–1 420] Percentile 35 · #38 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena agent/overall -0,03 ±0,00 1 440 ±2 90,5% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Vision 1 459 [1 450–1 469] Percentile 88 · #15 · composantes : 3 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena vision/overall 1 305 ±7,27 1 479 ±7 65,6% 2026-10-02 xhigh
LMArena vision/ocr 1 313 ±8,56 1 484 ±8 15,0% 2026-10-02 xhigh
LMArena vision/diagram 1 317 ±13 1 478 ±12 12,1% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 455 [1 443–1 468] Percentile 89 · #30 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 450 ±11 1 480 ±11 56,0% 2026-10-02 xhigh
LMArena text/longer_query 1 478 ±6,87 1 474 ±6 36,0% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 繁體中文 1 445 [1 423–1 467] Percentile 87 · #30 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 522 ±16 1 471 ±12 90,5% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 462 [1 448–1 475] Percentile 96 · #12 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 489 ±6,97 1 482 ±7 92,8% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Русский 1 456 [1 435–1 477] Percentile 91 · #21 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 483 ±13 1 482 ±12 90,8% 2026-10-02 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
Muse Spark 1.2 1 457 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: Muse Spark 1.2

Données CC BY 4.0 : conservez le lien vers fedi.software.