Vai al contenuto
fedi.software

Testo

Modelli di chat classificati in base ai voti umani alla cieca su LMArena, con l'intervallo di confidenza di ogni punteggio e il prezzo attuale per milione di token.

Aggiornato · Fonti: LMArena, LiteLLM, models.dev

Costo mensile
Tier Modello Elo Input / output, per 1M Al mese Contesto App Confronta
S1.4820,338 USD / 1,01 USD 1M
S1.4760,825 USD / 2,48 USD 1M
S1.470— —
S1.4550,282 USD / 1,13 USD 1M
S1.4471,03 USD / 6,16 USD 262K
A1.4410,045 USD / 0,32 USD 262K
A1.4390,36 USD / 1,43 USD 262K
A1.4380,1644 USD / 0,9864 USDGratis 262K
A1.4370,276 USD / 1,65 USD 1M
A1.4200,20 USD / 0,88 USD 131K
A1.4190,09 USD / 0,55 USD 131K
A1.4170,144 USD / 0,574 USDGratis 131K
A1.4170,1126 USD / 0,9008 USDGratis 262K
A1.4150,11 USD / 0,60 USD 131K
A1.4090,0846 USD / 0,6768 USD 262K
B1.4010,287 USD / 2,87 USD 131K
B1.3970,0282 USD / 0,282 USD 1M
B1.3940,0564 USD / 0,4512 USD 262K
B1.3840,09 USD / 0,30 USD 256K
B1.3680,15 USD / 0,65 USD 131K
B1.367— —
B1.3560,13 USD / 0,50 USDGratis 262K
B1.3400,05 USD / 0,10 USD 131K
B1.3290,18 USD / 0,20 USD 24K
B1.3260,115 USD / 0,287 USD 1M
B1.3170,0509 USD / 0,335 USD 41K
B1.299— —
B1.2820,345 USD / 1,38 USD 33K
C1.2690,12 USD / 0,30 USD 131K
C1.2300,06 USD / 0,20 USDGratis 33K
C1.2030,90 USD / 0,90 USD 33K
C1.175— —
C1.166— —
C1.137— —
C1.128— —
D1.083— —
D1.051— —
D997— —
Confronta ()

I tier sono nostri: la posizione di un modello nella classifica contando solo i modelli il cui intervallo di confidenza è interamente sopra il suo. S — primo 10%, A — fino al 30%, B — fino al 60%, C — fino all'85%, D — il resto.

Qualità e prezzo punteggio in verticale, prezzo combinato (3 parti di input : 1 di output) in orizzontale, USD per 1M di token
1.000 1.200 1.400 1.600 0,01 USD 0,10 USD 1 USD 10 USD 100 USD Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Da dove viene il punteggio

La classifica dei modelli di testo usa la categoria generale della text arena di LMArena. Il meccanismo è semplice: una persona scrive un prompt, riceve due risposte da modelli anonimi e vota quella che preferisce. Migliaia di voti diventano un punteggio in stile Elo, mostrato con la barra dell'intervallo di confidenza al 95%. Prezzi, finestra di contesto e modalità arrivano invece da models.dev e LiteLLM.

Cosa trovi in ogni riga

  • tier, punteggio con intervallo, produttore e l'indicazione «Pesi aperti» quando il modello è scaricabile;
  • il prezzo più basso trovato tra i provider, in USD per milione di token di input e di output, con l'andamento degli ultimi 30 giorni;
  • la finestra di contesto e, se l'app è nel nostro catalogo, il collegamento per scaricarla.

Un clic sulla riga apre i dettagli: provider dal più economico, modalità, contesto e output massimo, voti, posizione nella fonte, licenza, data di rilascio e limite delle conoscenze. I filtri isolano i modelli con pesi aperti, gratuiti, a «Prezzo basso» o di un produttore; l'ordinamento funziona per punteggio, prezzo, contesto o nome. Con la casella «Confronta» puoi mettere fino a 4 modelli uno accanto all'altro.

Come leggerla senza errori

Quando gli intervalli di due modelli si sovrappongono, la differenza tra loro non è statisticamente chiara: per questo più modelli possono condividere il tier più alto. Il tier si assegna solo con almeno 300 voti; sotto questa soglia il modello compare come «Tier non ancora assegnato». Il punteggio misura la preferenza degli utenti dell'arena, con prompt in gran parte in inglese: non dice nulla su velocità, costo o bravura in un compito preciso.

Prezzo e costo mensile

Il prezzo mostrato è il più basso tra i provider nel giorno dei dati e può differire da quello del produttore: sconti per caching, elaborazione in batch o prezzi regionali non compaiono. Qui «Prezzo basso» significa un prezzo combinato sotto 1 USD per milione di token, calcolato con 3 parti di input e 1 di output. Lo stesso rapporto 3 : 1 regge il grafico «Qualità e prezzo», mentre il calcolatore «Costo mensile» stima la spesa partendo dai token al mese e dalla quota di input che indichi tu.