GPT-6 Sol i fedi-index
Poengsummen i hvert utsnitt, hva den består av, verdi, lokal kjøring og historikk.
fedi-index · Generelt
A 1 434 ±8
Persentil 84 · #49
Folk foretrekker / Løser oppgaver
1 397 / 1 494
Menneskelige stemmer vs. benchmarks, Elo-eq
Verdi
+22
USD 4 per 1M tokens, median av 22 leverandører · leverandør USD 4
På din maskinvare
Lukkede vekter: bare i skyen.
Oppdeling av poengsummen
A Generelt 1 434 [1 426–1 441] Persentil 84 · #49 · komponenter: 9
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
163 ±1,66 | 1 538 ±13 | 27,6% | 2026-09-22 | — |
| LMArena |
text/overall
|
1 395 ±3,54 | 1 395 ±4 | 17,5% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1 419 ±4,34 | 1 412 ±4 | 17,3% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1 413 ±5,66 | 1 425 ±5 | 8,2% | 2026-10-02 | max |
| LMArena |
text/expert
|
1 439 ±9,92 | 1 426 ±8 | 7,2% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
nedvekting ×0,61 |
0,61 ±0,02 | 1 488 ±5 | 4,5% | 2026-09-22 | max |
| LMArena |
text/longer_query
|
1 414 ±5,24 | 1 413 ±5 | 4,2% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1 413 ±8,43 | 1 411 ±8 | 3,7% | 2026-10-02 | max |
| Epoch AI |
gpqa_diamond
nedvekting ×0,26 |
0,94 ±0,01 | 1 478 ±7 | 1,8% | 2026-09-22 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
A Koding 1 444 [1 440–1 448] Persentil 91 · #25 · komponenter: 2 foreløpig
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 689 ±5,84 | 1 503 ±2 | 60,7% | 2026-10-01 | max |
| LMArena |
text/coding
avvik |
1 448 ±6,78 | 1 424 ±6 | 26,5% | 2026-10-02 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
A Agenter 1 470 [1 460–1 480] Persentil 90 · #7 · komponenter: 1 foreløpig
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,10 ±0,01 | 1 502 ±6 | 89,3% | 2026-10-02 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
A Matematikk 1 447 [1 436–1 458] Persentil 90 · #26 · komponenter: 3
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 407 ±14 | 1 400 ±13 | 38,7% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
nedvekting ×0,86 |
0,90 ±0,02 | 1 516 ±4 | 37,4% | 2026-09-22 | max |
| Epoch AI |
frontiermath_t4
nedvekting ×0,86 |
0,90 ±0,05 | 1 536 ±8 | 15,3% | 2026-09-22 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
B Skriving 1 397 [1 388–1 406] Persentil 64 · #98 · komponenter: 2 foreløpig
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 382 ±7,40 | 1 410 ±8 | 59,4% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1 414 ±5,24 | 1 413 ±5 | 33,7% | 2026-10-02 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
C Språk: 繁體中文 1 362 [1 345–1 379] Persentil 42 · #130 · komponenter: 1 foreløpig
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 403 ±12 | 1 376 ±9 | 92,0% | 2026-10-02 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
B Språk: English 1 374 [1 364–1 384] Persentil 55 · #123 · komponenter: 1 foreløpig
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 398 ±5,37 | 1 386 ±6 | 93,3% | 2026-10-02 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
C Språk: Español 1 361 [1 334–1 387] Persentil 26 · #111 · komponenter: 1 foreløpig
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 381 ±17 | 1 381 ±15 | 88,7% | 2026-10-02 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
B Språk: Русский 1 399 [1 385–1 414] Persentil 60 · #93 · komponenter: 1 foreløpig
| Kilde | Komponent | Verdi | Elo-eq | Vekt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 409 ±8,84 | 1 415 ±8 | 92,6% | 2026-10-02 | max |
Vekt er komponentens andel av poengsummen (resten er priori-verdien som trekker modeller med lite data mot populasjonens median). Metodikk
Historikk
Det samme i en tabell
| Modell | 2026-10 |
|---|---|
| GPT-6 Sol | 1 434 A |
Merke
Vis modellens fedi-index på nettstedet ditt eller i en README. Merket oppdaterer seg selv og lenker til denne siden.
Data CC BY 4.0: behold lenken til fedi.software.