Przejdź do treści
fedi.software

Muse Spark 1.3 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

S 1 469 ±8

Percentyl 97 · #9

Ludzie wolą / Rozwiązuje zadania

1 470 / 1 468

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+74

2 USD za 1M tokenów, mediana dostawców: 10 · producent 0,125 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

S Ogólny 1 469 [1 462–1 477] Percentyl 97 · #9 · składniki: 7
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 157 ±1,16 1 491 ±9 41,0% 2026-09-02 —
LMArena text/overall 1 490 ±3,14 1 490 ±3 15,4% 2026-10-02 max
LMArena text/hard_prompts 1 504 ±3,71 1 488 ±3 15,3% 2026-10-02 max
LMArena text/instruction_following 1 480 ±4,71 1 489 ±4 7,4% 2026-10-02 max
LMArena text/expert 1 518 ±8,10 1 491 ±7 6,7% 2026-10-02 max
LMArena text/longer_query 1 491 ±4,36 1 486 ±4 3,8% 2026-10-02 max
LMArena text/multi_turn 1 486 ±7,13 1 477 ±6 3,4% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 461 [1 457–1 465] Percentyl 97 · #10 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 657 ±4,36 1 494 ±1 47,1% 2026-10-01 max
LMArena text/coding 1 515 ±5,39 1 484 ±5 43,0% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Agenci 1 449 [1 446–1 451] Percentyl 70 · #18 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena agent/overall 0,04 ±0,00 1 475 ±2 90,5% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Matematyka 1 460 [1 448–1 471] Percentyl 94 · #16 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 502 ±12 1 491 ±12 43,8% 2026-10-02 max
Epoch AI frontiermath_t1_3 wygaszanie ×0,86 0,74 ±0,03 1 482 ±6 35,5% 2026-09-16 xhigh
Epoch AI frontiermath_t4 wygaszanie ×0,86 0,46 ±0,08 1 466 ±13 11,9% 2026-09-18 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Obraz 1 467 [1 460–1 474] Percentyl 92 · #10 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 310 ±5,32 1 484 ±5 64,7% 2026-10-02 max
LMArena vision/ocr 1 319 ±6,11 1 490 ±6 15,4% 2026-10-02 max
LMArena vision/diagram 1 330 ±9,96 1 490 ±9 13,2% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Pisanie 1 468 [1 460–1 476] Percentyl 94 · #17 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 458 ±6,30 1 488 ±6 60,2% 2026-10-02 max
LMArena text/longer_query 1 491 ±4,36 1 486 ±4 33,2% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 繁體中文 1 456 [1 442–1 470] Percentyl 92 · #18 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 529 ±9,95 1 476 ±8 92,6% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 468 [1 459–1 476] Percentyl 97 · #10 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 492 ±4,46 1 486 ±5 93,6% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Español 1 448 [1 422–1 474] Percentyl 91 · #14 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 487 ±16 1 479 ±15 89,0% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Français 1 469 [1 442–1 496] Percentyl 98 · #3 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 528 ±17 1 504 ±16 88,5% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Русский 1 470 [1 458–1 483] Percentyl 95 · #13 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 493 ±7,66 1 490 ±7 93,0% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Muse Spark 1.3 1 469 S

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Muse Spark 1.3

Dane CC BY 4.0: zachowaj link do fedi.software.