Vai al contenuto
fedi.software

Testo

Modelli di chat classificati in base ai voti umani alla cieca su LMArena, con l'intervallo di confidenza di ogni punteggio e il prezzo attuale per milione di token.

Aggiornato · Fonti: LMArena, LiteLLM, models.dev

Costo mensile
Tier Modello Elo Input / output, per 1M Al mese Contesto App Confronta
A1.4280,50 USD / 1,50 USD 262K
A1.4240,40 USD / 2 USD 262K
A1.4211,50 USD / 7,50 USD 256K
B1.3700,36 USD / 1,22 USD 131K
B1.3550,25 USD / 0,75 USD 128K
B1.3380,075 USD / 0,20 USD 128K
B1.3312,50 USD / 10 USD 256K
B1.282— —
B1.2780,10 USD / 0,30 USD 128K
C1.2662 USD / 6 USD 131K
C1.2650,50 USD / 1,50 USD 131K
C1.2552 USD / 5 USD 128K
C1.2340,05 USD / 0,08 USD 33K
C1.2292,50 USD / 10 USD 128K
C1.2240,50 USD / 1,50 USD 128K
C1.2042,50 USD / 10 USD 128K
C1.1910,10 USD / 0,10 USD 128K
C1.1870,15 USD / 0,60 USD 128K
C1.1630,15 USD / 0,60 USD 128K
C1.1620,60 USD / 0,60 USD 66K
C1.1320,15 USD / 0,15 USD 32K
D1.0900,05 USD / 0,25 USD 32K
D1.0230,07 USD / 0,28 USD 33K
Confronta ()

I tier sono nostri: la posizione di un modello nella classifica contando solo i modelli il cui intervallo di confidenza è interamente sopra il suo. S — primo 10%, A — fino al 30%, B — fino al 60%, C — fino all'85%, D — il resto.

Qualità e prezzo punteggio in verticale, prezzo combinato (3 parti di input : 1 di output) in orizzontale, USD per 1M di token
1.000 1.200 1.400 1.600 0,01 USD 0,10 USD 1 USD 10 USD 100 USD Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Da dove viene il punteggio

La classifica dei modelli di testo usa la categoria generale della text arena di LMArena. Il meccanismo è semplice: una persona scrive un prompt, riceve due risposte da modelli anonimi e vota quella che preferisce. Migliaia di voti diventano un punteggio in stile Elo, mostrato con la barra dell'intervallo di confidenza al 95%. Prezzi, finestra di contesto e modalità arrivano invece da models.dev e LiteLLM.

Cosa trovi in ogni riga

  • tier, punteggio con intervallo, produttore e l'indicazione «Pesi aperti» quando il modello è scaricabile;
  • il prezzo più basso trovato tra i provider, in USD per milione di token di input e di output, con l'andamento degli ultimi 30 giorni;
  • la finestra di contesto e, se l'app è nel nostro catalogo, il collegamento per scaricarla.

Un clic sulla riga apre i dettagli: provider dal più economico, modalità, contesto e output massimo, voti, posizione nella fonte, licenza, data di rilascio e limite delle conoscenze. I filtri isolano i modelli con pesi aperti, gratuiti, a «Prezzo basso» o di un produttore; l'ordinamento funziona per punteggio, prezzo, contesto o nome. Con la casella «Confronta» puoi mettere fino a 4 modelli uno accanto all'altro.

Come leggerla senza errori

Quando gli intervalli di due modelli si sovrappongono, la differenza tra loro non è statisticamente chiara: per questo più modelli possono condividere il tier più alto. Il tier si assegna solo con almeno 300 voti; sotto questa soglia il modello compare come «Tier non ancora assegnato». Il punteggio misura la preferenza degli utenti dell'arena, con prompt in gran parte in inglese: non dice nulla su velocità, costo o bravura in un compito preciso.

Prezzo e costo mensile

Il prezzo mostrato è il più basso tra i provider nel giorno dei dati e può differire da quello del produttore: sconti per caching, elaborazione in batch o prezzi regionali non compaiono. Qui «Prezzo basso» significa un prezzo combinato sotto 1 USD per milione di token, calcolato con 3 parti di input e 1 di output. Lo stesso rapporto 3 : 1 regge il grafico «Qualità e prezzo», mentre il calcolatore «Costo mensile» stima la spesa partendo dai token al mese e dalla quota di input che indichi tu.