Aller au contenu
fedi.software

Muse Spark 1.1 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 452 ±7

Percentile 91 · #28

Préféré par les humains / Résout des tâches

1 455 / 1 449

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+58

2 $US par million de tokens, médiane de 12 fournisseurs · éditeur 2 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 452 [1 446–1 459] Percentile 91 · #28 · composantes : 8
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 154 ±1,24 1 471 ±10 34,0% 2026-07-09 —
LMArena text/overall 1 479 ±2,23 1 479 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1 486 ±2,58 1 472 ±2 15,8% 2026-10-02 —
LMArena text/instruction_following 1 457 ±3,13 1 467 ±3 7,8% 2026-10-02 —
LMArena text/expert 1 479 ±4,81 1 459 ±4 7,6% 2026-10-02 —
Epoch AI simpleqa_verified ancienneté ×0,61 0,58 ±0,02 1 479 ±5 4,4% 2026-08-31 —
LMArena text/longer_query 1 463 ±2,94 1 459 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1 484 ±4,33 1 475 ±4 3,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 440 [1 437–1 442] Percentile 90 · #29 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 542 ±3,87 1 462 ±1 46,0% 2026-10-01 —
LMArena text/coding 1 497 ±3,39 1 468 ±3 44,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Agents 1 429 [1 424–1 433] Percentile 47 · #31 · composantes : 2
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena agent/overall -0,05 ±0,00 1 432 ±1 67,0% 2026-10-02 —
τ²-bench (Sierra) tau2/banking_knowledge ancienneté ×0,76 0,40 ±0,05 1 481 ±8 26,0% 2026-07-23 xhigh

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Maths 1 434 [1 422–1 447] Percentile 87 · #34 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 480 ±7,48 1 470 ±7 86,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Vision 1 454 [1 449–1 458] Percentile 83 · #20 · composantes : 3 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena vision/overall 1 294 ±3,67 1 469 ±3 63,3% 2026-10-02 —
LMArena vision/ocr 1 303 ±3,91 1 474 ±4 15,6% 2026-10-02 —
LMArena vision/diagram 1 308 ±5,83 1 470 ±5 14,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 449 [1 444–1 454] Percentile 85 · #40 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 439 ±3,93 1 468 ±4 61,8% 2026-10-02 —
LMArena text/longer_query 1 463 ±2,94 1 459 ±3 32,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 繁體中文 1 450 [1 442–1 459] Percentile 89 · #26 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 518 ±5,94 1 467 ±5 93,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Deutsch 1 437 [1 418–1 455] Percentile 84 · #24 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 465 ±12 1 458 ±10 91,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 455 [1 449–1 461] Percentile 93 · #20 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 479 ±2,95 1 471 ±3 93,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Español 1 440 [1 424–1 455] Percentile 83 · #26 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 466 ±9,36 1 459 ±9 92,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Français 1 454 [1 439–1 470] Percentile 92 · #11 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 497 ±9,38 1 475 ±9 92,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 日本語 1 443 [1 426–1 461] Percentile 85 · #20 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 451 ±13 1 465 ±10 91,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 한국어 1 460 [1 444–1 476] Percentile 93 · #10 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 461 ±12 1 481 ±9 92,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Polski 1 465 [1 446–1 485] Percentile 94 · #9 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 498 ±13 1 490 ±11 91,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Русский 1 464 [1 456–1 472] Percentile 94 · #15 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 483 ±4,86 1 481 ±4 93,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
Muse Spark 1.1 1 452 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: Muse Spark 1.1

Données CC BY 4.0 : conservez le lien vers fedi.software.