Vai al contenuto
fedi.software

GPT-5.2 nel fedi-index

Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.

fedi-index · Generale

A 1.428 ±5

Percentile 82 · #53

Preferito dalle persone / Risolve compiti

1.421 / 1.438

Voti umani e benchmark, Elo-eq

Qualità-prezzo

+12

4,81 USD per 1 M di token, mediana di 26 provider · produttore 4,81 USD

Sul tuo hardware

Pesi chiusi: solo cloud.

Scomposizione del punteggio

A Generale 1.428 [1.423–1.434] Percentile 82 · #53 · componenti: 9
Fonte Componente Valore Elo-eq Peso Misurato Variante
Epoch AI eci 153 ±0,97 1.465 ±8 33,4% 2025-12-11 —
LMArena text/overall 1.439 ±2,04 1.439 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1.445 ±2,50 1.435 ±2 15,7% 2026-10-02 —
LMArena text/instruction_following 1.417 ±3,16 1.429 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.445 ±4,93 1.431 ±4 7,5% 2026-10-02 high
LMArena text/longer_query 1.428 ±3,05 1.427 ±3 3,9% 2026-10-02 —
Epoch AI simpleqa_verified obsolescenza ×0,61 0,37 ±0,02 1.414 ±5 3,9% 2026-08-27 xhigh
LMArena text/multi_turn 1.458 ±3,96 1.452 ±4 3,8% 2026-10-02 —
Epoch AI gpqa_diamond obsolescenza ×0,26 0,91 ±0,02 1.465 ±8 1,4% 2025-12-13 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Codice 1.409 [1.405–1.414] Percentile 73 · #76 · componenti: 3
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/coding 1.447 ±3,42 1.423 ±3 39,1% 2026-10-02 —
LMArena webdev/overall 1.415 ±11 1.426 ±3 38,8% 2026-10-01 —
Epoch AI swe_bench_verified obsolescenza ×0,37 0,74 ±0,02 1.452 ±10 13,6% 2026-02-12 high

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

C Agenti 1.412 [1.400–1.424] Percentile 32 · #40 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
τ²-bench (Sierra) tau2/banking_knowledge obsolescenza ×0,76 0,32 ±0,05 1.467 ±8 79,2% 2026-05-05 high

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

A Matematica 1.426 [1.419–1.433] Percentile 84 · #43 · componenti: 3
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/math 1.439 ±5,49 1.431 ±5 52,7% 2026-10-02 high
Epoch AI frontiermath_t1_3 obsolescenza ×0,86 0,67 ±0,03 1.467 ±6 29,3% 2026-06-11 xhigh
Epoch AI frontiermath_t4 obsolescenza ×0,86 0,32 ±0,07 1.443 ±12 10,6% 2026-06-11 xhigh

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Visione 1.432 [1.428–1.436] Percentile 68 · #37 · componenti: 3 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena vision/overall 1.268 ±3,32 1.446 ±3 63,1% 2026-10-02 —
LMArena vision/ocr 1.275 ±3,44 1.447 ±3 15,6% 2026-10-02 —
LMArena vision/diagram 1.285 ±5,11 1.450 ±4 15,0% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Scrittura 1.415 [1.410–1.421] Percentile 73 · #74 · componenti: 2 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/creative_writing 1.402 ±4,28 1.430 ±4 61,5% 2026-10-02 —
LMArena text/longer_query 1.428 ±3,05 1.427 ±3 32,2% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 繁體中文 1.407 [1.398–1.416] Percentile 62 · #86 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/chinese 1.460 ±6,31 1.421 ±5 93,5% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Deutsch 1.422 [1.402–1.442] Percentile 72 · #41 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/german 1.448 ±13 1.443 ±11 91,2% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: English 1.422 [1.417–1.428] Percentile 75 · #70 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/english 1.446 ±2,81 1.436 ±3 93,9% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Español 1.412 [1.397–1.427] Percentile 57 · #65 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/spanish 1.433 ±9,08 1.429 ±8 92,4% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Français 1.421 [1.406–1.435] Percentile 65 · #48 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/french 1.456 ±8,68 1.438 ±8 92,6% 2026-10-02 high

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 日本語 1.421 [1.400–1.441] Percentile 72 · #36 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/japanese 1.420 ±15 1.442 ±11 91,1% 2026-10-02 high

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: 한국어 1.409 [1.391–1.427] Percentile 62 · #53 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/korean 1.390 ±13 1.428 ±10 91,7% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Polski 1.417 [1.400–1.434] Percentile 60 · #53 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/polish 1.434 ±11 1.436 ±10 91,9% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

B Lingua: Русский 1.428 [1.420–1.435] Percentile 78 · #51 · componenti: 1 provvisorio
Fonte Componente Valore Elo-eq Peso Misurato Variante
LMArena text/russian 1.440 ±4,72 1.443 ±4 93,7% 2026-10-02 —

Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia

Storico

fedi-index per mese
Gli stessi dati in tabella
Modello 2026-10
GPT-5.2 1.428 A

Badge

Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.

fedi-index: GPT-5.2

Dati CC BY 4.0: mantieni il link a fedi.software.