Vai al contenuto
fedi.software

Testo

Modelli di chat classificati in base ai voti umani alla cieca su LMArena, con l'intervallo di confidenza di ogni punteggio e il prezzo attuale per milione di token.

Aggiornato · Fonti: LMArena, LiteLLM, models.dev

Costo mensile
Tier Modello Elo Input / output, per 1M Al mese Contesto App Confronta
S1.4820,1857 USD / 1,11 USD 1M
S1.4790,375 USD / 1,88 USD 1M
S1.4710,40 USD / 1,40 USDGratis 1M
S1.4700,30 USD / 1,05 USDGratis 1M
S1.4700,03 USD / 0,10 USDGratis 1M
S1.4660,07 USD / 0,43 USD 1M
S1.4610,45 USD / 2,15 USD 200K
A1.4460,40 USD / 1,75 USD 205K
A1.4430,10 USD / 0,25 USDGratis 262K
A1.4400,2740 USD / 1,10 USD 205K
A1.4360,2740 USD / 1,10 USD 205K
A1.4350,15 USD / 1,25 USD 1M
A1.4340,042 USD / 0,22 USDGratis 262K
A1.4300,286 USD / 1,14 USD 131K
A1.4170,09 USD / 0,71 USD 1M
A1.4160,125 USD / 0,75 USD 1M
A1.4070,30 USD / 2,50 USD 1M
B1.3840,1165 USD / 0,2911 USD 131K
B1.3790,09 USD / 0,36 USD 1M
B1.3770,137 USD / 0,411 USD 128K
B1.3690,10 USD / 0,10 USD 1M
B1.3580,08 USD / 0,16 USDGratis 131K
B1.3540,10 USD / 0,42 USD 990K
B1.3510,06 USD / 0,40 USD 200K
B1.3340,05 USD / 0,10 USDGratis 131K
B1.3330,29 USD / 0,86 USD 64K
B1.3300,052 USD / 0,21 USD 990K
B1.2910,04 USD / 0,08 USDGratis 131K
C1.2310,65 USD / 0,65 USD 8K
C1.2070,20 USD / 0,20 USD 8K
D1.0560,15 USD / 0,15 USD 8K
Confronta ()

I tier sono nostri: la posizione di un modello nella classifica contando solo i modelli il cui intervallo di confidenza è interamente sopra il suo. S — primo 10%, A — fino al 30%, B — fino al 60%, C — fino all'85%, D — il resto.

Qualità e prezzo punteggio in verticale, prezzo combinato (3 parti di input : 1 di output) in orizzontale, USD per 1M di token
1.000 1.200 1.400 1.600 0,01 USD 0,10 USD 1 USD 10 USD 100 USD Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Da dove viene il punteggio

La classifica dei modelli di testo usa la categoria generale della text arena di LMArena. Il meccanismo è semplice: una persona scrive un prompt, riceve due risposte da modelli anonimi e vota quella che preferisce. Migliaia di voti diventano un punteggio in stile Elo, mostrato con la barra dell'intervallo di confidenza al 95%. Prezzi, finestra di contesto e modalità arrivano invece da models.dev e LiteLLM.

Cosa trovi in ogni riga

  • tier, punteggio con intervallo, produttore e l'indicazione «Pesi aperti» quando il modello è scaricabile;
  • il prezzo più basso trovato tra i provider, in USD per milione di token di input e di output, con l'andamento degli ultimi 30 giorni;
  • la finestra di contesto e, se l'app è nel nostro catalogo, il collegamento per scaricarla.

Un clic sulla riga apre i dettagli: provider dal più economico, modalità, contesto e output massimo, voti, posizione nella fonte, licenza, data di rilascio e limite delle conoscenze. I filtri isolano i modelli con pesi aperti, gratuiti, a «Prezzo basso» o di un produttore; l'ordinamento funziona per punteggio, prezzo, contesto o nome. Con la casella «Confronta» puoi mettere fino a 4 modelli uno accanto all'altro.

Come leggerla senza errori

Quando gli intervalli di due modelli si sovrappongono, la differenza tra loro non è statisticamente chiara: per questo più modelli possono condividere il tier più alto. Il tier si assegna solo con almeno 300 voti; sotto questa soglia il modello compare come «Tier non ancora assegnato». Il punteggio misura la preferenza degli utenti dell'arena, con prompt in gran parte in inglese: non dice nulla su velocità, costo o bravura in un compito preciso.

Prezzo e costo mensile

Il prezzo mostrato è il più basso tra i provider nel giorno dei dati e può differire da quello del produttore: sconti per caching, elaborazione in batch o prezzi regionali non compaiono. Qui «Prezzo basso» significa un prezzo combinato sotto 1 USD per milione di token, calcolato con 3 parti di input e 1 di output. Lo stesso rapporto 3 : 1 regge il grafico «Qualità e prezzo», mentre il calcolatore «Costo mensile» stima la spesa partendo dai token al mese e dalla quota di input che indichi tu.