GPT-6 Luna w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
B 1 419 ±7
Percentyl 79 · #62
Ludzie wolą / Rozwiązuje zadania
1 395 / 1 455
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+80
0,20 USD za 1M tokenów, mediana dostawców: 21 · producent 0,20 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
B Ogólny 1 419 [1 412–1 426] Percentyl 79 · #62 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
156 ±1,30 | 1 487 ±10 | 31,9% | 2026-09-22 | — |
| LMArena |
text/overall
|
1 391 ±3,33 | 1 392 ±3 | 17,0% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1 413 ±4,04 | 1 406 ±4 | 16,8% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1 416 ±5,21 | 1 428 ±5 | 8,0% | 2026-10-02 | max |
| LMArena |
text/expert
|
1 450 ±8,97 | 1 435 ±7 | 7,2% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1 411 ±4,85 | 1 411 ±4 | 4,1% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1 400 ±8,16 | 1 399 ±7 | 3,6% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
wartość odstająca wygaszanie ×0,61 |
0,41 ±0,02 | 1 427 ±5 | 2,1% | 2026-09-22 | max |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,90 ±0,02 | 1 460 ±9 | 1,6% | 2026-09-22 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 424 [1 421–1 427] Percentyl 80 · #55 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 579 ±4,34 | 1 472 ±1 | 60,6% | 2026-10-01 | max |
| LMArena |
text/coding
wartość odstająca |
1 444 ±6,31 | 1 420 ±6 | 26,7% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Agenci 1 437 [1 432–1 442] Percentyl 58 · #25 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,01 ±0,01 | 1 462 ±3 | 90,3% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Matematyka 1 432 [1 421–1 443] Percentyl 86 · #37 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 424 ±12 | 1 416 ±12 | 43,4% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,79 ±0,02 | 1 492 ±5 | 35,9% | 2026-09-22 | max |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,56 ±0,08 | 1 482 ±12 | 11,9% | 2026-09-22 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Pisanie 1 386 [1 377–1 394] Percentyl 59 · #111 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 365 ±6,93 | 1 392 ±7 | 59,7% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1 411 ±4,85 | 1 411 ±4 | 33,4% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 繁體中文 1 382 [1 367–1 398] Percentyl 49 · #114 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 429 ±11 | 1 397 ±9 | 92,3% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 365 [1 356–1 375] Percentyl 52 · #131 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 389 ±5,01 | 1 377 ±5 | 93,4% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Español 1 392 [1 366–1 417] Percentyl 43 · #86 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 417 ±16 | 1 414 ±14 | 89,3% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Русский 1 382 [1 368–1 395] Percentyl 51 · #116 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 388 ±8,26 | 1 396 ±7 | 92,8% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-6 Luna | 1 419 B |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.