Vai al contenuto
fedi.software

GPT-6 Sol nel fedi-index

Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.

fedi-index · Generale

A 1.434 ±8

Percentile 84 · #49

Preferito dalle persone / Risolve compiti

1.397 / 1.494

Voti umani e benchmark, Elo-eq

Qualità-prezzo

+22

4 USD per 1 M di token, mediana di 22 provider · produttore 4 USD

Sul tuo hardware

Pesi chiusi: solo cloud.

Scomposizione del punteggio

A Generale 1.434 [1.426–1.441] Percentile 84 · #49 · componenti: 9
Fonte Componente Valore Elo-eq Peso Misurato Variante
Epoch AI eci 163 ±1,66 1.538 ±13 27,6% 2026-09-22 —
LMArena text/overall 1.395 ±3,54 1.395 ±4 17,5% 2026-10-02 max
LMArena text/hard_prompts 1.419 ±4,34 1.412 ±4 17,3% 2026-10-02 max
LMArena text/instruction_following 1.413 ±5,66 1.425 ±5 8,2% 2026-10-02 max
LMArena text/expert 1.439 ±9,92 1.426 ±8 7,2% 2026-10-02 max
Epoch AI simpleqa_verified obsolescenza ×0,61 0,61 ±0,02 1.488 ±5 4,5% 2026-09-22 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 4,2% 2026-10-02 max
LMArena text/multi_turn 1.413 ±8,43 1.411 ±8 3,7% 2026-10-02 max
Epoch AI gpqa_diamond obsolescenza ×0,26 0,94 ±0,01 1.478 ±7 1,8% 2026-09-22 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Codice 1.444 [1.440–1.448] Percentile 91 · #25 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena webdev/overall 1.689 ±5,84 1.503 ±2 60,7% 2026-10-01 max
LMArena text/coding anomalo 1.448 ±6,78 1.424 ±6 26,5% 2026-10-02 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Agenti 1.470 [1.460–1.480] Percentile 90 · #7 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena agent/overall 0,10 ±0,01 1.502 ±6 89,3% 2026-10-02 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Matematica 1.447 [1.436–1.458] Percentile 90 · #26 · componenti: 3
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/math 1.407 ±14 1.400 ±13 38,6% 2026-10-02 max
Epoch AI frontiermath_t1_3 obsolescenza ×0,86 0,90 ±0,02 1.516 ±4 37,4% 2026-09-22 max
Epoch AI frontiermath_t4 obsolescenza ×0,86 0,90 ±0,05 1.536 ±8 15,3% 2026-09-22 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Scrittura 1.397 [1.388–1.406] Percentile 64 · #98 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/creative_writing 1.382 ±7,40 1.410 ±8 59,4% 2026-10-02 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 33,7% 2026-10-02 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Lingua: 繁體中文 1.362 [1.345–1.379] Percentile 42 · #130 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/chinese 1.403 ±12 1.376 ±9 92,0% 2026-10-02 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: English 1.374 [1.364–1.384] Percentile 55 · #123 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/english 1.398 ±5,37 1.386 ±6 93,3% 2026-10-02 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Lingua: Español 1.361 [1.334–1.387] Percentile 26 · #111 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/spanish 1.381 ±17 1.381 ±15 88,7% 2026-10-02 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Русский 1.399 [1.385–1.414] Percentile 60 · #93 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/russian 1.409 ±8,84 1.415 ±8 92,6% 2026-10-02 max

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

Storico

fedi-index per mese
Gli stessi dati in tabella
Modello 2026-10
GPT-6 Sol 1.434 A

Badge

Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.

fedi-index: GPT-6 Sol

Dati CC BY 4.0: mantieni il link a fedi.software.