Przejdź do treści
fedi.software

Muse Spark 1.1 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 452 ±7

Percentyl 91 · #28

Ludzie wolą / Rozwiązuje zadania

1 455 / 1 449

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+58

2 USD za 1M tokenów, mediana dostawców: 12 · producent 2 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

A Ogólny 1 452 [1 446–1 459] Percentyl 91 · #28 · składniki: 8
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 154 ±1,24 1 471 ±10 34,0% 2026-07-09 —
LMArena text/overall 1 479 ±2,23 1 479 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1 486 ±2,58 1 472 ±2 15,8% 2026-10-02 —
LMArena text/instruction_following 1 457 ±3,13 1 467 ±3 7,8% 2026-10-02 —
LMArena text/expert 1 479 ±4,81 1 459 ±4 7,6% 2026-10-02 —
Epoch AI simpleqa_verified wygaszanie ×0,61 0,58 ±0,02 1 479 ±5 4,4% 2026-08-31 —
LMArena text/longer_query 1 463 ±2,94 1 459 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1 484 ±4,33 1 475 ±4 3,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 440 [1 437–1 442] Percentyl 90 · #29 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 542 ±3,87 1 462 ±1 46,0% 2026-10-01 —
LMArena text/coding 1 497 ±3,39 1 468 ±3 44,4% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Agenci 1 429 [1 424–1 433] Percentyl 47 · #31 · składniki: 2
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena agent/overall -0,05 ±0,00 1 432 ±1 67,0% 2026-10-02 —
τ²-bench (Sierra) tau2/banking_knowledge wygaszanie ×0,76 0,40 ±0,05 1 481 ±8 26,0% 2026-07-23 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Matematyka 1 434 [1 422–1 447] Percentyl 87 · #34 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 480 ±7,48 1 470 ±7 86,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Obraz 1 454 [1 449–1 458] Percentyl 83 · #20 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 294 ±3,67 1 469 ±3 63,3% 2026-10-02 —
LMArena vision/ocr 1 303 ±3,91 1 474 ±4 15,6% 2026-10-02 —
LMArena vision/diagram 1 308 ±5,83 1 470 ±5 14,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Pisanie 1 449 [1 444–1 454] Percentyl 85 · #40 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 439 ±3,93 1 468 ±4 61,8% 2026-10-02 —
LMArena text/longer_query 1 463 ±2,94 1 459 ±3 32,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 繁體中文 1 450 [1 442–1 459] Percentyl 89 · #26 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 518 ±5,94 1 467 ±5 93,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Deutsch 1 437 [1 418–1 455] Percentyl 84 · #24 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 465 ±12 1 458 ±10 91,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 455 [1 449–1 461] Percentyl 93 · #20 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 479 ±2,95 1 471 ±3 93,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Español 1 440 [1 424–1 455] Percentyl 83 · #26 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 466 ±9,36 1 459 ±9 92,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Français 1 454 [1 439–1 470] Percentyl 92 · #11 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 497 ±9,38 1 475 ±9 92,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 日本語 1 443 [1 426–1 461] Percentyl 85 · #20 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 451 ±13 1 465 ±10 91,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 한국어 1 460 [1 444–1 476] Percentyl 93 · #10 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 461 ±12 1 481 ±9 92,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Polski 1 465 [1 446–1 485] Percentyl 94 · #9 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 498 ±13 1 490 ±11 91,4% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Русский 1 464 [1 456–1 472] Percentyl 94 · #15 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 483 ±4,86 1 481 ±4 93,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Muse Spark 1.1 1 452 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Muse Spark 1.1

Dane CC BY 4.0: zachowaj link do fedi.software.