GPT-6 Sol w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
A 1 434 ±8
Percentyl 84 · #49
Ludzie wolą / Rozwiązuje zadania
1 397 / 1 494
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+22
4 USD za 1M tokenów, mediana dostawców: 22 · producent 4 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
A Ogólny 1 434 [1 426–1 441] Percentyl 84 · #49 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
163 ±1,66 | 1 538 ±13 | 27,6% | 2026-09-22 | — |
| LMArena |
text/overall
|
1 395 ±3,54 | 1 395 ±4 | 17,5% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1 419 ±4,34 | 1 412 ±4 | 17,3% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1 413 ±5,66 | 1 425 ±5 | 8,2% | 2026-10-02 | max |
| LMArena |
text/expert
|
1 439 ±9,92 | 1 426 ±8 | 7,2% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,61 ±0,02 | 1 488 ±5 | 4,5% | 2026-09-22 | max |
| LMArena |
text/longer_query
|
1 414 ±5,24 | 1 413 ±5 | 4,2% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1 413 ±8,43 | 1 411 ±8 | 3,7% | 2026-10-02 | max |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,94 ±0,01 | 1 478 ±7 | 1,8% | 2026-09-22 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 444 [1 440–1 448] Percentyl 91 · #25 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 689 ±5,84 | 1 503 ±2 | 60,7% | 2026-10-01 | max |
| LMArena |
text/coding
wartość odstająca |
1 448 ±6,78 | 1 424 ±6 | 26,5% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Agenci 1 470 [1 460–1 480] Percentyl 90 · #7 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,10 ±0,01 | 1 502 ±6 | 89,3% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Matematyka 1 447 [1 436–1 458] Percentyl 90 · #26 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 407 ±14 | 1 400 ±13 | 38,7% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,90 ±0,02 | 1 516 ±4 | 37,4% | 2026-09-22 | max |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,90 ±0,05 | 1 536 ±8 | 15,3% | 2026-09-22 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Pisanie 1 397 [1 388–1 406] Percentyl 64 · #98 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 382 ±7,40 | 1 410 ±8 | 59,4% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1 414 ±5,24 | 1 413 ±5 | 33,7% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 繁體中文 1 362 [1 345–1 379] Percentyl 42 · #130 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 403 ±12 | 1 376 ±9 | 92,0% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 374 [1 364–1 384] Percentyl 55 · #123 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 398 ±5,37 | 1 386 ±6 | 93,3% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Español 1 361 [1 334–1 387] Percentyl 26 · #111 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 381 ±17 | 1 381 ±15 | 88,7% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Русский 1 399 [1 385–1 414] Percentyl 60 · #93 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 409 ±8,84 | 1 415 ±8 | 92,6% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-6 Sol | 1 434 A |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.