Gå til indhold
fedi.software

GPT-6 Sol i fedi-index

Scoren i hvert udsnit, hvad den består af, værdi, lokal kørsel og historik.

fedi-index · Generelt

A 1.434 ±8

Percentil 84 · #49

Folk foretrækker / Løser opgaver

1.397 / 1.494

Menneskelige stemmer vs. benchmarks, Elo-eq

Værdi

+22

4 US$ pr. 1M tokens, median af 22 udbydere · leverandør 4 US$

På din hardware

Lukkede vægte: kun i skyen.

Opdeling af scoren

A Generelt 1.434 [1.426–1.441] Percentil 84 · #49 · komponenter: 9
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
Epoch AI eci 163 ±1,66 1.538 ±13 27,6% 2026-09-22 —
LMArena text/overall 1.395 ±3,54 1.395 ±4 17,5% 2026-10-02 max
LMArena text/hard_prompts 1.419 ±4,34 1.412 ±4 17,3% 2026-10-02 max
LMArena text/instruction_following 1.413 ±5,66 1.425 ±5 8,2% 2026-10-02 max
LMArena text/expert 1.439 ±9,92 1.426 ±8 7,2% 2026-10-02 max
Epoch AI simpleqa_verified nedvægtning ×0,61 0,61 ±0,02 1.488 ±5 4,5% 2026-09-22 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 4,2% 2026-10-02 max
LMArena text/multi_turn 1.413 ±8,43 1.411 ±8 3,7% 2026-10-02 max
Epoch AI gpqa_diamond nedvægtning ×0,26 0,94 ±0,01 1.478 ±7 1,8% 2026-09-22 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Kodning 1.444 [1.440–1.448] Percentil 91 · #25 · komponenter: 2 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena webdev/overall 1.689 ±5,84 1.503 ±2 60,7% 2026-10-01 max
LMArena text/coding afviger 1.448 ±6,78 1.424 ±6 26,5% 2026-10-02 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Agenter 1.470 [1.460–1.480] Percentil 90 · #7 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena agent/overall 0,10 ±0,01 1.502 ±6 89,3% 2026-10-02 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Matematik 1.447 [1.436–1.458] Percentil 90 · #26 · komponenter: 3
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/math 1.407 ±14 1.400 ±13 38,7% 2026-10-02 max
Epoch AI frontiermath_t1_3 nedvægtning ×0,86 0,90 ±0,02 1.516 ±4 37,4% 2026-09-22 max
Epoch AI frontiermath_t4 nedvægtning ×0,86 0,90 ±0,05 1.536 ±8 15,3% 2026-09-22 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Skrivning 1.397 [1.388–1.406] Percentil 64 · #98 · komponenter: 2 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/creative_writing 1.382 ±7,40 1.410 ±8 59,4% 2026-10-02 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 33,7% 2026-10-02 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

C Sprog: 繁體中文 1.362 [1.345–1.379] Percentil 42 · #130 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/chinese 1.403 ±12 1.376 ±9 92,0% 2026-10-02 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: English 1.374 [1.364–1.384] Percentil 55 · #123 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/english 1.398 ±5,37 1.386 ±6 93,3% 2026-10-02 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

C Sprog: Español 1.361 [1.334–1.387] Percentil 26 · #111 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/spanish 1.381 ±17 1.381 ±15 88,7% 2026-10-02 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Русский 1.399 [1.385–1.414] Percentil 60 · #93 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/russian 1.409 ±8,84 1.415 ±8 92,6% 2026-10-02 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

Historik

fedi-index pr. måned
Det samme i en tabel
Model 2026-10
GPT-6 Sol 1.434 A

Badge

Vis modellens fedi-index på dit website eller i en README. Badget opdaterer sig selv og linker til denne side.

fedi-index: GPT-6 Sol

Data CC BY 4.0: behold linket til fedi.software.