GPT-5.6 Luna w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
A 1 438 ±6
Percentyl 86 · #41
Ludzie wolą / Rozwiązuje zadania
1 426 / 1 457
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+80
0,45 USD za 1M tokenów, mediana dostawców: 33 · producent 0,45 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
A Ogólny 1 438 [1 432–1 444] Percentyl 86 · #41 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
156 ±1,20 | 1 488 ±10 | 31,8% | 2026-07-09 | — |
| LMArena |
text/overall
|
1 431 ±2,23 | 1 431 ±2 | 16,6% | 2026-10-02 | xhigh |
| LMArena |
text/hard_prompts
|
1 452 ±2,60 | 1 442 ±2 | 16,5% | 2026-10-02 | xhigh |
| LMArena |
text/instruction_following
|
1 438 ±3,17 | 1 450 ±3 | 8,2% | 2026-10-02 | xhigh |
| LMArena |
text/expert
|
1 479 ±4,85 | 1 459 ±4 | 7,9% | 2026-10-02 | xhigh |
| LMArena |
text/longer_query
|
1 437 ±2,99 | 1 435 ±3 | 4,1% | 2026-10-02 | xhigh |
| LMArena |
text/multi_turn
|
1 433 ±4,23 | 1 429 ±4 | 4,0% | 2026-10-02 | xhigh |
| Epoch AI |
simpleqa_verified
wartość odstająca wygaszanie ×0,61 |
0,41 ±0,02 | 1 426 ±5 | 2,0% | 2026-08-10 | max |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,92 ±0,02 | 1 466 ±8 | 1,5% | 2026-07-09 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 424 [1 421–1 427] Percentyl 81 · #54 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 518 ±3,27 | 1 455 ±1 | 46,0% | 2026-10-01 | xhigh-codex-harness |
| LMArena |
text/coding
|
1 466 ±3,45 | 1 440 ±3 | 44,3% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Agenci 1 426 [1 424–1 429] Percentyl 42 · #34 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
-0,01 ±0,00 | 1 450 ±2 | 90,5% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Matematyka 1 450 [1 442–1 458] Percentyl 91 · #23 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 458 ±7,25 | 1 449 ±7 | 50,2% | 2026-10-02 | xhigh |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,82 ±0,02 | 1 499 ±5 | 31,7% | 2026-07-09 | max |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,61 ±0,08 | 1 490 ±12 | 10,5% | 2026-07-09 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Obraz 1 424 [1 420–1 429] Percentyl 61 · #45 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 260 ±3,86 | 1 439 ±4 | 63,4% | 2026-10-02 | xhigh |
| LMArena |
vision/ocr
|
1 267 ±4,12 | 1 440 ±4 | 15,6% | 2026-10-02 | xhigh |
| LMArena |
vision/diagram
|
1 275 ±6,16 | 1 441 ±6 | 14,7% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Pisanie 1 413 [1 408–1 419] Percentyl 71 · #79 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 395 ±3,96 | 1 423 ±4 | 61,8% | 2026-10-02 | xhigh |
| LMArena |
text/longer_query
|
1 437 ±2,99 | 1 435 ±3 | 32,0% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 繁體中文 1 414 [1 406–1 423] Percentyl 69 · #69 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 469 ±5,84 | 1 429 ±5 | 93,6% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Deutsch 1 428 [1 409–1 446] Percentyl 78 · #32 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 454 ±12 | 1 449 ±10 | 91,5% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 418 [1 412–1 423] Percentyl 72 · #78 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 441 ±2,97 | 1 432 ±3 | 93,9% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Español 1 422 [1 406–1 438] Percentyl 69 · #47 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 446 ±9,52 | 1 441 ±9 | 92,2% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Français 1 420 [1 404–1 435] Percentyl 61 · #53 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 456 ±9,39 | 1 438 ±9 | 92,3% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 日本語 1 417 [1 399–1 436] Percentyl 69 · #40 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 413 ±14 | 1 437 ±10 | 91,6% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 한국어 1 427 [1 412–1 443] Percentyl 76 · #34 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 414 ±11 | 1 446 ±9 | 92,3% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Polski 1 393 [1 373–1 412] Percentyl 41 · #78 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 404 ±13 | 1 411 ±11 | 91,3% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Русский 1 418 [1 410–1 426] Percentyl 71 · #68 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 428 ±4,81 | 1 432 ±4 | 93,7% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-5.6 Luna | 1 438 A |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.