Muse Spark 1.1 no fedi-index
A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.
fedi-index · Geral
A 1.452 ±7
Percentil 91 · #28
Preferido por pessoas / Resolve tarefas
1.455 / 1.449
Votos humanos vs. benchmarks, Elo-eq
Custo-benefício
+58
US$ 2 por 1 mi de tokens, mediana de 12 provedores · fabricante US$ 2
No seu hardware
Pesos fechados: apenas na nuvem.
Decomposição da pontuação
A Geral 1.452 [1.446–1.459] Percentil 91 · #28 · componentes: 8
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
154 ±1,24 | 1.471 ±10 | 34,0% | 2026-07-09 | — |
| LMArena |
text/overall
|
1.479 ±2,23 | 1.479 ±2 | 15,8% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.486 ±2,58 | 1.472 ±2 | 15,8% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.457 ±3,13 | 1.467 ±3 | 7,8% | 2026-10-02 | — |
| LMArena |
text/expert
|
1.479 ±4,81 | 1.459 ±4 | 7,6% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
defasagem ×0,61 |
0,58 ±0,02 | 1.479 ±5 | 4,4% | 2026-08-31 | — |
| LMArena |
text/longer_query
|
1.463 ±2,94 | 1.459 ±3 | 3,9% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.484 ±4,33 | 1.475 ±4 | 3,8% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Código 1.440 [1.437–1.442] Percentil 90 · #29 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1.542 ±3,87 | 1.462 ±1 | 46,0% | 2026-10-01 | — |
| LMArena |
text/coding
|
1.497 ±3,39 | 1.468 ±3 | 44,4% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Agentes 1.429 [1.424–1.433] Percentil 47 · #31 · componentes: 2
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
-0,05 ±0,00 | 1.432 ±1 | 66,9% | 2026-10-02 | — |
| τ²-bench (Sierra) |
tau2/banking_knowledge
defasagem ×0,76 |
0,40 ±0,05 | 1.481 ±8 | 26,1% | 2026-07-23 | xhigh |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Matemática 1.434 [1.422–1.447] Percentil 87 · #34 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.480 ±7,48 | 1.470 ±7 | 86,7% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Visão 1.454 [1.449–1.458] Percentil 83 · #20 · componentes: 3 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1.294 ±3,67 | 1.469 ±3 | 63,3% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1.303 ±3,91 | 1.474 ±4 | 15,6% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1.308 ±5,83 | 1.470 ±5 | 14,8% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Escrita 1.449 [1.444–1.454] Percentil 85 · #40 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.439 ±3,93 | 1.468 ±4 | 61,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.463 ±2,94 | 1.459 ±3 | 32,0% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: 繁體中文 1.450 [1.442–1.459] Percentil 89 · #26 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.518 ±5,94 | 1.467 ±5 | 93,6% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: Deutsch 1.437 [1.418–1.455] Percentil 84 · #24 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1.465 ±12 | 1.458 ±10 | 91,6% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: English 1.455 [1.449–1.461] Percentil 93 · #20 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.479 ±2,95 | 1.471 ±3 | 93,9% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: Español 1.440 [1.424–1.455] Percentil 83 · #26 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.466 ±9,36 | 1.459 ±9 | 92,3% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: Français 1.454 [1.439–1.470] Percentil 92 · #11 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1.497 ±9,38 | 1.475 ±9 | 92,3% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: 日本語 1.443 [1.426–1.461] Percentil 85 · #20 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1.451 ±13 | 1.465 ±10 | 91,9% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: 한국어 1.460 [1.444–1.476] Percentil 93 · #10 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1.461 ±12 | 1.481 ±9 | 92,2% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: Polski 1.465 [1.446–1.485] Percentil 94 · #9 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1.498 ±13 | 1.490 ±11 | 91,4% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Idioma: Русский 1.464 [1.456–1.472] Percentil 94 · #15 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.483 ±4,86 | 1.481 ±4 | 93,6% | 2026-10-02 | — |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
Histórico
O mesmo em tabela
| Modelo | 2026-10 |
|---|---|
| Muse Spark 1.1 | 1.452 A |
Selo
Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.
Dados CC BY 4.0: mantenha o link para fedi.software.