Przejdź do treści
fedi.software

GPT-6 Sol w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 434 ±8

Percentyl 84 · #49

Ludzie wolą / Rozwiązuje zadania

1 397 / 1 494

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+22

4 USD za 1M tokenów, mediana dostawców: 22 · producent 4 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

A Ogólny 1 434 [1 426–1 441] Percentyl 84 · #49 · składniki: 9
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 163 ±1,66 1 538 ±13 27,6% 2026-09-22 —
LMArena text/overall 1 395 ±3,54 1 395 ±4 17,5% 2026-10-02 max
LMArena text/hard_prompts 1 419 ±4,34 1 412 ±4 17,3% 2026-10-02 max
LMArena text/instruction_following 1 413 ±5,66 1 425 ±5 8,2% 2026-10-02 max
LMArena text/expert 1 439 ±9,92 1 426 ±8 7,2% 2026-10-02 max
Epoch AI simpleqa_verified wygaszanie ×0,61 0,61 ±0,02 1 488 ±5 4,5% 2026-09-22 max
LMArena text/longer_query 1 414 ±5,24 1 413 ±5 4,2% 2026-10-02 max
LMArena text/multi_turn 1 413 ±8,43 1 411 ±8 3,7% 2026-10-02 max
Epoch AI gpqa_diamond wygaszanie ×0,26 0,94 ±0,01 1 478 ±7 1,8% 2026-09-22 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 444 [1 440–1 448] Percentyl 91 · #25 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 689 ±5,84 1 503 ±2 60,7% 2026-10-01 max
LMArena text/coding wartość odstająca 1 448 ±6,78 1 424 ±6 26,5% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Agenci 1 470 [1 460–1 480] Percentyl 90 · #7 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena agent/overall 0,10 ±0,01 1 502 ±6 89,3% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Matematyka 1 447 [1 436–1 458] Percentyl 90 · #26 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 407 ±14 1 400 ±13 38,7% 2026-10-02 max
Epoch AI frontiermath_t1_3 wygaszanie ×0,86 0,90 ±0,02 1 516 ±4 37,4% 2026-09-22 max
Epoch AI frontiermath_t4 wygaszanie ×0,86 0,90 ±0,05 1 536 ±8 15,3% 2026-09-22 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 397 [1 388–1 406] Percentyl 64 · #98 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 382 ±7,40 1 410 ±8 59,4% 2026-10-02 max
LMArena text/longer_query 1 414 ±5,24 1 413 ±5 33,7% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 繁體中文 1 362 [1 345–1 379] Percentyl 42 · #130 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 403 ±12 1 376 ±9 92,0% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: English 1 374 [1 364–1 384] Percentyl 55 · #123 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 398 ±5,37 1 386 ±6 93,3% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Español 1 361 [1 334–1 387] Percentyl 26 · #111 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 381 ±17 1 381 ±15 88,7% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 399 [1 385–1 414] Percentyl 60 · #93 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 409 ±8,84 1 415 ±8 92,6% 2026-10-02 max

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
GPT-6 Sol 1 434 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: GPT-6 Sol

Dane CC BY 4.0: zachowaj link do fedi.software.