Muse Spark 1.1 w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
A 1 452 ±7
Percentyl 91 · #28
Ludzie wolą / Rozwiązuje zadania
1 455 / 1 449
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+58
2 USD za 1M tokenów, mediana dostawców: 12 · producent 2 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
A Ogólny 1 452 [1 446–1 459] Percentyl 91 · #28 · składniki: 8
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
154 ±1,24 | 1 471 ±10 | 34,0% | 2026-07-09 | — |
| LMArena |
text/overall
|
1 479 ±2,23 | 1 479 ±2 | 15,8% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 486 ±2,58 | 1 472 ±2 | 15,8% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1 457 ±3,13 | 1 467 ±3 | 7,8% | 2026-10-02 | — |
| LMArena |
text/expert
|
1 479 ±4,81 | 1 459 ±4 | 7,6% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,58 ±0,02 | 1 479 ±5 | 4,4% | 2026-08-31 | — |
| LMArena |
text/longer_query
|
1 463 ±2,94 | 1 459 ±3 | 3,9% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 484 ±4,33 | 1 475 ±4 | 3,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 440 [1 437–1 442] Percentyl 90 · #29 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 542 ±3,87 | 1 462 ±1 | 46,0% | 2026-10-01 | — |
| LMArena |
text/coding
|
1 497 ±3,39 | 1 468 ±3 | 44,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Agenci 1 429 [1 424–1 433] Percentyl 47 · #31 · składniki: 2
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
-0,05 ±0,00 | 1 432 ±1 | 67,0% | 2026-10-02 | — |
| τ²-bench (Sierra) |
tau2/banking_knowledge
wygaszanie ×0,76 |
0,40 ±0,05 | 1 481 ±8 | 26,0% | 2026-07-23 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Matematyka 1 434 [1 422–1 447] Percentyl 87 · #34 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 480 ±7,48 | 1 470 ±7 | 86,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Obraz 1 454 [1 449–1 458] Percentyl 83 · #20 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 294 ±3,67 | 1 469 ±3 | 63,3% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1 303 ±3,91 | 1 474 ±4 | 15,6% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1 308 ±5,83 | 1 470 ±5 | 14,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 449 [1 444–1 454] Percentyl 85 · #40 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 439 ±3,93 | 1 468 ±4 | 61,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 463 ±2,94 | 1 459 ±3 | 32,0% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 繁體中文 1 450 [1 442–1 459] Percentyl 89 · #26 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 518 ±5,94 | 1 467 ±5 | 93,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Deutsch 1 437 [1 418–1 455] Percentyl 84 · #24 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 465 ±12 | 1 458 ±10 | 91,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: English 1 455 [1 449–1 461] Percentyl 93 · #20 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 479 ±2,95 | 1 471 ±3 | 93,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Español 1 440 [1 424–1 455] Percentyl 83 · #26 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 466 ±9,36 | 1 459 ±9 | 92,3% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Français 1 454 [1 439–1 470] Percentyl 92 · #11 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 497 ±9,38 | 1 475 ±9 | 92,3% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 日本語 1 443 [1 426–1 461] Percentyl 85 · #20 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 451 ±13 | 1 465 ±10 | 91,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 한국어 1 460 [1 444–1 476] Percentyl 93 · #10 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 461 ±12 | 1 481 ±9 | 92,2% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Polski 1 465 [1 446–1 485] Percentyl 94 · #9 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 498 ±13 | 1 490 ±11 | 91,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Русский 1 464 [1 456–1 472] Percentyl 94 · #15 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 483 ±4,86 | 1 481 ±4 | 93,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| Muse Spark 1.1 | 1 452 A |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.