Przejdź do treści
fedi.software

Muse Spark 1.2 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 457 ±7

Percentyl 92 · #23

Ludzie wolą / Rozwiązuje zadania

1 459 / 1 455

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+62

2 USD za 1M tokenów, mediana dostawców: 13 · producent 0,125 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

A Ogólny 1 457 [1 450–1 464] Percentyl 92 · #23 · składniki: 8
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 155 ±1,17 1 476 ±9 37,5% 2026-08-05 —
LMArena text/overall 1 483 ±4,65 1 483 ±5 15,7% 2026-10-02 xhigh
LMArena text/hard_prompts 1 489 ±5,71 1 475 ±5 15,4% 2026-10-02 xhigh
LMArena text/instruction_following 1 467 ±7,56 1 476 ±7 7,0% 2026-10-02 xhigh
LMArena text/expert 1 485 ±13 1 464 ±11 5,6% 2026-10-02 xhigh
Epoch AI simpleqa_verified wygaszanie ×0,61 0,60 ±0,02 1 487 ±5 4,7% 2026-08-27 xhigh
LMArena text/longer_query 1 478 ±6,87 1 474 ±6 3,6% 2026-10-02 xhigh
LMArena text/multi_turn 1 509 ±12 1 497 ±11 2,9% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 434 [1 428–1 441] Percentyl 86 · #41 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 532 ±6,93 1 459 ±2 49,6% 2026-10-01 xhigh
LMArena text/coding 1 494 ±8,71 1 465 ±8 39,8% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Agenci 1 417 [1 414–1 420] Percentyl 35 · #38 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena agent/overall -0,03 ±0,00 1 440 ±2 90,5% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Obraz 1 459 [1 450–1 469] Percentyl 88 · #15 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 305 ±7,27 1 479 ±7 65,6% 2026-10-02 xhigh
LMArena vision/ocr 1 313 ±8,56 1 484 ±8 15,0% 2026-10-02 xhigh
LMArena vision/diagram 1 317 ±13 1 478 ±12 12,1% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Pisanie 1 455 [1 443–1 468] Percentyl 89 · #30 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 450 ±11 1 480 ±11 56,0% 2026-10-02 xhigh
LMArena text/longer_query 1 478 ±6,87 1 474 ±6 36,0% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 繁體中文 1 445 [1 423–1 467] Percentyl 87 · #30 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 522 ±16 1 471 ±12 90,5% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 462 [1 448–1 475] Percentyl 96 · #12 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 489 ±6,97 1 482 ±7 92,8% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Русский 1 456 [1 435–1 477] Percentyl 91 · #21 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 483 ±13 1 482 ±12 90,8% 2026-10-02 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Muse Spark 1.2 1 457 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Muse Spark 1.2

Dane CC BY 4.0: zachowaj link do fedi.software.