GPT-6 Luna i fedi-index
Scoren i hvert udsnit, hvad den består af, værdi, lokal kørsel og historik.
fedi-index · Generelt
B 1.419 ±7
Percentil 79 · #62
Folk foretrækker / Løser opgaver
1.395 / 1.455
Menneskelige stemmer vs. benchmarks, Elo-eq
Værdi
+80
0,20 US$ pr. 1M tokens, median af 21 udbydere · leverandør 0,20 US$
På din hardware
Lukkede vægte: kun i skyen.
Opdeling af scoren
B Generelt 1.419 [1.412–1.426] Percentil 79 · #62 · komponenter: 9
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
156 ±1,30 | 1.487 ±10 | 31,9% | 2026-09-22 | — |
| LMArena |
text/overall
|
1.391 ±3,33 | 1.392 ±3 | 17,0% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1.413 ±4,04 | 1.406 ±4 | 16,8% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1.416 ±5,21 | 1.428 ±5 | 8,0% | 2026-10-02 | max |
| LMArena |
text/expert
|
1.450 ±8,97 | 1.435 ±7 | 7,2% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1.411 ±4,85 | 1.411 ±4 | 4,1% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1.400 ±8,16 | 1.399 ±7 | 3,6% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
afviger nedvægtning ×0,61 |
0,41 ±0,02 | 1.427 ±5 | 2,1% | 2026-09-22 | max |
| Epoch AI |
gpqa_diamond
nedvægtning ×0,26 |
0,90 ±0,02 | 1.460 ±9 | 1,6% | 2026-09-22 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Kodning 1.424 [1.421–1.427] Percentil 80 · #55 · komponenter: 2 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1.579 ±4,34 | 1.472 ±1 | 60,6% | 2026-10-01 | max |
| LMArena |
text/coding
afviger |
1.444 ±6,31 | 1.420 ±6 | 26,7% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
B Agenter 1.437 [1.432–1.442] Percentil 58 · #25 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,01 ±0,01 | 1.462 ±3 | 90,3% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Matematik 1.432 [1.421–1.443] Percentil 86 · #37 · komponenter: 3
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.424 ±12 | 1.416 ±12 | 43,4% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
nedvægtning ×0,86 |
0,79 ±0,02 | 1.492 ±5 | 35,9% | 2026-09-22 | max |
| Epoch AI |
frontiermath_t4
nedvægtning ×0,86 |
0,56 ±0,08 | 1.482 ±12 | 11,9% | 2026-09-22 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
B Skrivning 1.386 [1.377–1.394] Percentil 59 · #111 · komponenter: 2 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.365 ±6,93 | 1.392 ±7 | 59,7% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1.411 ±4,85 | 1.411 ±4 | 33,4% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
C Sprog: 繁體中文 1.382 [1.367–1.398] Percentil 49 · #114 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.429 ±11 | 1.397 ±9 | 92,3% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
B Sprog: English 1.365 [1.356–1.375] Percentil 52 · #131 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.389 ±5,01 | 1.377 ±5 | 93,4% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
C Sprog: Español 1.392 [1.366–1.417] Percentil 43 · #86 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.417 ±16 | 1.414 ±14 | 89,3% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
B Sprog: Русский 1.382 [1.368–1.395] Percentil 51 · #116 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.388 ±8,26 | 1.396 ±7 | 92,8% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
Historik
Det samme i en tabel
| Model | 2026-10 |
|---|---|
| GPT-6 Luna | 1.419 B |
Badge
Vis modellens fedi-index på dit website eller i en README. Badget opdaterer sig selv og linker til denne side.
Data CC BY 4.0: behold linket til fedi.software.