GPT-6 Luna no fedi-index
A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.
fedi-index · Geral
B 1.419 ±7
Percentil 79 · #62
Preferido por pessoas / Resolve tarefas
1.395 / 1.455
Votos humanos vs. benchmarks, Elo-eq
Custo-benefício
+80
US$ 0,20 por 1 mi de tokens, mediana de 21 provedores · fabricante US$ 0,20
No seu hardware
Pesos fechados: apenas na nuvem.
Decomposição da pontuação
B Geral 1.419 [1.412–1.426] Percentil 79 · #62 · componentes: 9
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
156 ±1,30 | 1.487 ±10 | 31,9% | 2026-09-22 | — |
| LMArena |
text/overall
|
1.391 ±3,33 | 1.392 ±3 | 17,0% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1.413 ±4,04 | 1.406 ±4 | 16,8% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1.416 ±5,21 | 1.428 ±5 | 8,0% | 2026-10-02 | max |
| LMArena |
text/expert
|
1.450 ±8,97 | 1.435 ±7 | 7,2% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1.411 ±4,85 | 1.411 ±4 | 4,1% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1.400 ±8,16 | 1.399 ±7 | 3,6% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
outlier defasagem ×0,61 |
0,41 ±0,02 | 1.427 ±5 | 2,1% | 2026-09-22 | max |
| Epoch AI |
gpqa_diamond
defasagem ×0,26 |
0,90 ±0,02 | 1.460 ±9 | 1,6% | 2026-09-22 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Código 1.424 [1.421–1.427] Percentil 80 · #55 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1.579 ±4,34 | 1.472 ±1 | 60,6% | 2026-10-01 | max |
| LMArena |
text/coding
outlier |
1.444 ±6,31 | 1.420 ±6 | 26,7% | 2026-10-02 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Agentes 1.437 [1.432–1.442] Percentil 58 · #25 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,01 ±0,01 | 1.462 ±3 | 90,3% | 2026-10-02 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
A Matemática 1.432 [1.421–1.443] Percentil 86 · #37 · componentes: 3
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.424 ±12 | 1.416 ±12 | 43,4% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
defasagem ×0,86 |
0,79 ±0,02 | 1.492 ±5 | 35,9% | 2026-09-22 | max |
| Epoch AI |
frontiermath_t4
defasagem ×0,86 |
0,56 ±0,08 | 1.482 ±12 | 11,9% | 2026-09-22 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Escrita 1.386 [1.377–1.394] Percentil 59 · #111 · componentes: 2 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.365 ±6,93 | 1.392 ±7 | 59,7% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1.411 ±4,85 | 1.411 ±4 | 33,4% | 2026-10-02 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: 繁體中文 1.382 [1.367–1.398] Percentil 49 · #114 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.429 ±11 | 1.397 ±9 | 92,3% | 2026-10-02 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: English 1.365 [1.356–1.375] Percentil 52 · #131 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.389 ±5,01 | 1.377 ±5 | 93,4% | 2026-10-02 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
C Idioma: Español 1.392 [1.366–1.417] Percentil 43 · #86 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.417 ±16 | 1.414 ±14 | 89,3% | 2026-10-02 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
B Idioma: Русский 1.382 [1.368–1.395] Percentil 51 · #116 · componentes: 1 provisório
| Fonte | Componente | Valor | Elo-eq | Peso | Medido em | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.388 ±8,26 | 1.396 ±7 | 92,8% | 2026-10-02 | max |
O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia
Histórico
O mesmo em tabela
| Modelo | 2026-10 |
|---|---|
| GPT-6 Luna | 1.419 B |
Selo
Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.
Dados CC BY 4.0: mantenha o link para fedi.software.