muse-spark w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
A 1 439 ±8
Percentyl 87 · #40
Ludzie wolą / Rozwiązuje zadania
1 445 / 1 430
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
—
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
A Ogólny 1 439 [1 432–1 447] Percentyl 87 · #40 · składniki: 8
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
152 ±1,37 | 1 454 ±11 | 34,4% | 2026-04-08 | — |
| LMArena |
text/overall
|
1 474 ±2,92 | 1 474 ±3 | 16,8% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 475 ±3,49 | 1 462 ±3 | 16,7% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1 443 ±4,58 | 1 454 ±4 | 8,0% | 2026-10-02 | — |
| LMArena |
text/expert
|
1 458 ±8,16 | 1 442 ±7 | 7,3% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 452 ±4,35 | 1 448 ±4 | 4,0% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 478 ±6,68 | 1 469 ±6 | 3,7% | 2026-10-02 | — |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,90 ±0,02 | 1 457 ±10 | 1,6% | 2026-04-08 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 429 [1 421–1 437] Percentyl 82 · #50 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 482 ±5,03 | 1 455 ±4 | 89,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Matematyka 1 410 [1 394–1 426] Percentyl 77 · #59 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 455 ±9,95 | 1 446 ±10 | 85,1% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Obraz 1 460 [1 454–1 466] Percentyl 90 · #12 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 305 ±4,64 | 1 480 ±4 | 63,8% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1 306 ±5,06 | 1 478 ±5 | 15,6% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1 309 ±7,74 | 1 471 ±7 | 14,2% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 456 [1 448–1 465] Percentyl 90 · #27 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 460 ±6,95 | 1 490 ±7 | 59,4% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 452 ±4,35 | 1 448 ±4 | 33,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 繁體中文 1 441 [1 426–1 455] Percentyl 84 · #37 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 508 ±10 | 1 460 ±8 | 92,5% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: English 1 456 [1 448–1 464] Percentyl 93 · #19 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 480 ±3,90 | 1 473 ±4 | 93,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Español 1 439 [1 417–1 461] Percentyl 82 · #27 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 471 ±13 | 1 464 ±12 | 90,5% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Français 1 448 [1 425–1 471] Percentyl 87 · #19 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 497 ±14 | 1 475 ±13 | 90,1% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Polski 1 441 [1 416–1 466] Percentyl 85 · #21 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 473 ±17 | 1 470 ±14 | 89,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Русский 1 449 [1 436–1 461] Percentyl 88 · #30 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 467 ±7,72 | 1 467 ±7 | 93,0% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| muse-spark | 1 439 A |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.