GPT-6.1 Sol w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
S 1 465 ±9
Percentyl 95 · #15
Ludzie wolą / Rozwiązuje zadania
1 437 / 1 513
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+53
4 USD za 1M tokenów, mediana dostawców: 18 · producent 4 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
S Ogólny 1 465 [1 456–1 474] Percentyl 95 · #15 · składniki: 8
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
166 ±1,97 | 1 565 ±16 | 26,2% | 2026-09-29 | — |
| LMArena |
text/overall
|
1 446 ±5,37 | 1 446 ±5 | 21,4% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1 466 ±7,05 | 1 455 ±6 | 20,5% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1 469 ±9,74 | 1 478 ±9 | 8,8% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,74 ±0,01 | 1 530 ±4 | 5,1% | 2026-09-29 | max |
| LMArena |
text/longer_query
|
1 465 ±8,71 | 1 461 ±8 | 4,7% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1 453 ±15 | 1 447 ±14 | 3,3% | 2026-10-02 | max |
| Epoch AI |
gpqa_diamond
wartość odstająca wygaszanie ×0,26 |
0,95 ±0,01 | 1 483 ±6 | 1,0% | 2026-09-29 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 464 [1 458–1 469] Percentyl 98 · #7 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 758 ±8,59 | 1 523 ±2 | 64,4% | 2026-10-01 | max |
| LMArena |
text/coding
wartość odstająca |
1 482 ±12 | 1 454 ±11 | 21,8% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Agenci 1 475 [1 463–1 487] Percentyl 91 · #6 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,11 ±0,01 | 1 509 ±7 | 88,9% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Matematyka 1 491 [1 487–1 494] Percentyl 100 · #1 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,94 ±0,01 | 1 524 ±3 | 57,2% | 2026-09-29 | max |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
1,00 ±0,00 | 1 552 ±0 | 29,8% | 2026-09-29 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Obraz 1 442 [1 431–1 454] Percentyl 78 · #26 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 285 ±8,12 | 1 461 ±7 | 75,6% | 2026-10-02 | max |
| LMArena |
vision/ocr
|
1 289 ±9,41 | 1 461 ±9 | 17,1% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 437 [1 423–1 451] Percentyl 82 · #48 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 429 ±12 | 1 458 ±12 | 55,8% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1 465 ±8,71 | 1 461 ±8 | 35,6% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 426 [1 410–1 442] Percentyl 78 · #61 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 454 ±8,61 | 1 445 ±9 | 92,1% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Русский 1 424 [1 401–1 446] Percentyl 75 · #59 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 445 ±14 | 1 447 ±13 | 90,3% | 2026-10-02 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-6.1 Sol | 1 465 S |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.