GPT-5.6 Sol w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
S 1 469 ±7
Percentyl 97 · #11
Ludzie wolą / Rozwiązuje zadania
1 454 / 1 493
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+40
8 USD za 1M tokenów, mediana dostawców: 34 · producent 8 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
S Ogólny 1 469 [1 462–1 476] Percentyl 97 · #11 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
162 ±1,49 | 1 530 ±12 | 28,2% | 2026-07-09 | — |
| LMArena |
text/overall
|
1 456 ±2,26 | 1 456 ±2 | 16,9% | 2026-10-02 | xhigh |
| LMArena |
text/hard_prompts
|
1 482 ±2,62 | 1 469 ±2 | 16,9% | 2026-10-02 | xhigh |
| LMArena |
text/instruction_following
|
1 482 ±3,23 | 1 490 ±3 | 8,3% | 2026-10-02 | xhigh |
| LMArena |
text/expert
|
1 518 ±5,00 | 1 491 ±4 | 8,1% | 2026-10-02 | xhigh |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,70 ±0,01 | 1 516 ±5 | 4,2% | 2026-08-10 | max |
| LMArena |
text/longer_query
|
1 480 ±3,01 | 1 475 ±3 | 4,2% | 2026-10-02 | xhigh |
| LMArena |
text/multi_turn
|
1 459 ±4,27 | 1 452 ±4 | 4,1% | 2026-10-02 | xhigh |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,93 ±0,02 | 1 475 ±7 | 1,6% | 2026-07-09 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 449 [1 446–1 452] Percentyl 92 · #22 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 620 ±3,06 | 1 484 ±1 | 46,1% | 2026-10-01 | xhigh-codex-harness |
| LMArena |
text/coding
|
1 496 ±3,51 | 1 467 ±3 | 44,3% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Agenci 1 467 [1 461–1 473] Percentyl 86 · #9 · składniki: 2
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,06 ±0,01 | 1 486 ±3 | 66,2% | 2026-10-02 | xhigh |
| τ²-bench (Sierra) |
tau2/banking_knowledge
wygaszanie ×0,76 |
0,47 ±0,05 | 1 492 ±8 | 26,6% | 2026-07-22 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
S Matematyka 1 467 [1 460–1 474] Percentyl 96 · #10 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 472 ±7,30 | 1 462 ±7 | 48,6% | 2026-10-02 | xhigh |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,89 ±0,02 | 1 514 ±4 | 31,8% | 2026-07-09 | max |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,83 ±0,06 | 1 525 ±10 | 12,2% | 2026-07-09 | max |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Obraz 1 442 [1 438–1 447] Percentyl 76 · #28 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 279 ±3,84 | 1 456 ±4 | 63,4% | 2026-10-02 | xhigh |
| LMArena |
vision/ocr
|
1 289 ±4,11 | 1 460 ±4 | 15,6% | 2026-10-02 | xhigh |
| LMArena |
vision/diagram
|
1 303 ±6,29 | 1 466 ±6 | 14,7% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Wyszukiwanie 1 482 [1 475–1 490] Percentyl 100 · #1 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
search/overall
|
1 257 ±3,81 | 1 501 ±4 | 93,7% | 2026-08-24 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 460 [1 454–1 465] Percentyl 92 · #23 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 448 ±4,05 | 1 478 ±4 | 61,7% | 2026-10-02 | xhigh |
| LMArena |
text/longer_query
|
1 480 ±3,01 | 1 475 ±3 | 32,1% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 繁體中文 1 454 [1 445–1 463] Percentyl 91 · #20 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 523 ±6,03 | 1 471 ±5 | 93,6% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Deutsch 1 441 [1 422–1 460] Percentyl 86 · #21 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 471 ±13 | 1 464 ±11 | 91,3% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: English 1 434 [1 428–1 439] Percentyl 85 · #43 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 457 ±3,01 | 1 449 ±3 | 93,9% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Español 1 423 [1 407–1 439] Percentyl 70 · #45 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 446 ±9,54 | 1 441 ±9 | 92,2% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Français 1 436 [1 420–1 452] Percentyl 79 · #29 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 475 ±9,74 | 1 456 ±9 | 92,2% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 日本語 1 456 [1 437–1 475] Percentyl 89 · #15 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 471 ±14 | 1 480 ±11 | 91,4% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 한국어 1 442 [1 426–1 458] Percentyl 86 · #20 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 436 ±12 | 1 462 ±9 | 92,2% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Polski 1 437 [1 418–1 456] Percentyl 82 · #24 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 461 ±13 | 1 459 ±11 | 91,3% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Русский 1 451 [1 443–1 459] Percentyl 89 · #27 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 468 ±4,90 | 1 468 ±4 | 93,6% | 2026-10-02 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-5.6 Sol | 1 469 S |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.