GPT-6 Astra w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
A 1 463 ±8
Percentyl 95 · #16
Ludzie wolą / Rozwiązuje zadania
1 437 / 1 514
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+12
20 USD za 1M tokenów, mediana dostawców: 24 · producent 20 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
A Ogólny 1 463 [1 455–1 471] Percentyl 95 · #16 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
166 ±2,07 | 1 568 ±16 | 23,7% | 2026-09-03 | — |
| LMArena |
text/overall
|
1 442 ±3,49 | 1 442 ±4 | 18,7% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1 463 ±4,23 | 1 452 ±4 | 18,5% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1 455 ±5,69 | 1 465 ±5 | 8,7% | 2026-10-02 | max |
| LMArena |
text/expert
|
1 492 ±10 | 1 470 ±8 | 7,6% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,76 ±0,01 | 1 535 ±4 | 4,9% | 2026-08-30 | max |
| LMArena |
text/longer_query
|
1 458 ±5,12 | 1 455 ±5 | 4,5% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1 452 ±8,60 | 1 446 ±8 | 3,9% | 2026-10-02 | max |
| Epoch AI |
gpqa_diamond
wartość odstająca wygaszanie ×0,26 |
0,96 ±0,01 | 1 485 ±6 | 1,0% | 2026-08-30 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 471 [1 467–1 474] Percentyl 98 · #6 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 788 ±5,25 | 1 532 ±2 | 60,7% | 2026-10-01 | max |
| LMArena |
text/coding
wartość odstająca |
1 489 ±6,62 | 1 460 ±6 | 26,5% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Agenci 1 481 [1 472–1 491] Percentyl 96 · #3 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,12 ±0,01 | 1 514 ±5 | 89,5% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
S Matematyka 1 478 [1 468–1 488] Percentyl 98 · #6 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 469 ±14 | 1 459 ±13 | 37,4% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,94 ±0,01 | 1 524 ±3 | 36,4% | 2026-08-30 | max |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,98 ±0,02 | 1 548 ±4 | 17,9% | 2026-08-30 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Obraz 1 441 [1 434–1 448] Percentyl 75 · #29 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 280 ±5,74 | 1 456 ±5 | 65,1% | 2026-10-02 | max |
| LMArena |
vision/ocr
|
1 292 ±6,70 | 1 464 ±6 | 15,4% | 2026-10-02 | max |
| LMArena |
vision/diagram
|
1 299 ±11 | 1 463 ±10 | 12,7% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 434 [1 424–1 443] Percentyl 80 · #54 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 419 ±7,11 | 1 448 ±7 | 59,7% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1 458 ±5,12 | 1 455 ±5 | 33,4% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 繁體中文 1 424 [1 408–1 440] Percentyl 75 · #56 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 487 ±11 | 1 443 ±9 | 92,2% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 424 [1 414–1 434] Percentyl 76 · #66 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 448 ±5,10 | 1 439 ±5 | 93,4% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Русский 1 425 [1 410–1 439] Percentyl 77 · #55 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 440 ±8,83 | 1 443 ±8 | 92,6% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-6 Astra | 1 463 A |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.