Vai al contenuto
fedi.software

Programmazione

Modelli classificati su prompt di programmazione: tier, Elo con il suo intervallo di confidenza, prezzo per milione di token e finestra di contesto.

Aggiornato · Fonti: LMArena, LiteLLM, models.dev

Costo mensile
Tier Modello Elo Input / output, per 1M Al mese Contesto App Confronta
S1.547— —
S1.5090,75 USD / 3,75 USD 1M
S1.4980,75 USD / 3,75 USD 1M
S1.4920,1857 USD / 1,11 USD 1M
S1.4920,375 USD / 1,88 USD 1M
S1.4841 USD / 6 USD 1M
S1.483— —
S1.4820,57 USD / 3,43 USD 1M
S1.4742 USD / 6 USD 500K
A1.4631,25 USD / 6 USD 500K
A1.4600,07 USD / 0,43 USD 1M
A1.4590,10 USD / 0,25 USDGratis 262K
A1.4591,25 USD / 2,50 USD 1M
A1.4581,25 USD / 2,50 USD 1M
A1.4520,15 USD / 1,25 USD 1M
A1.4520,87 USD / 7 USD 1M
A1.4471,25 USD / 2,50 USD 2M
A1.4460,042 USD / 0,22 USDGratis 262K
A1.4452 USD / 10 USD 200K
A1.433— —
A1.4323 USD / 15 USD 131K
A1.4302,70 USD / 13,50 USD 256K
A1.4240,09 USD / 0,71 USD 1M
A1.4231,60 USD / 4,80 USD 500K
B1.4141,25 USD / 2,50 USD 1M
B1.4000,30 USD / 2,50 USD 1M
B1.4000,125 USD / 0,75 USD 1M
B1.3860,30 USD / 2,50 USD 1M
B1.3790,30 USD / 0,50 USD 131K
B1.3730,10 USD / 0,10 USD 1M
B1.3720,09 USD / 0,36 USD 1M
B1.3510,10 USD / 0,42 USD 990K
B1.3220,08 USD / 0,16 USDGratis 131K
B1.3220,052 USD / 0,21 USD 990K
B1.294— —
B1.2872 USD / 10 USD 131K
B1.2810,05 USD / 0,10 USDGratis 131K
C1.270— —
C1.269— —
C1.269Gratis 128K
C1.262— —
C1.255— —
C1.239— —
C1.2300,04 USD / 0,08 USDGratis 131K
C1.218— —
C1.218— —
C1.2110,65 USD / 0,65 USD 8K
C1.191— —
C1.1740,20 USD / 0,20 USD 8K
C1.112Gratis 128K
C1.1082 USD / 12 USD 1M
C1.104— —
D1.084— —
D1.0480,15 USD / 0,15 USD 8K
D1.034— —
D1.010— —
D994— —
Confronta ()

I tier sono nostri: la posizione di un modello nella classifica contando solo i modelli il cui intervallo di confidenza è interamente sopra il suo. S — primo 10%, A — fino al 30%, B — fino al 60%, C — fino all'85%, D — il resto.

Qualità e prezzo punteggio in verticale, prezzo combinato (3 parti di input : 1 di output) in orizzontale, USD per 1M di token
1.000 1.200 1.400 1.600 0,01 USD 0,10 USD 1 USD 10 USD 100 USD MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Che cosa misura questa classifica?

È la categoria di programmazione della text arena di LMArena: stessi voti alla cieca della classifica di testo, ma solo sui prompt che riguardano il codice. Le persone chiedono di scrivere una funzione, spiegare un errore o riorganizzare un pezzo di programma, confrontano due risposte anonime e votano. Il risultato è un punteggio Elo con intervallo di confidenza al 95%, trasformato nei tier S, A, B, C e D con la stessa regola delle altre classifiche.

In cosa è diversa dalle altre?

Valuta le risposte in una chat sul codice. Costruire un'intera applicazione web è un'altra prova, con una sua classifica di sviluppo web; il lavoro in più passaggi con strumenti e comandi ha invece la classifica degli agenti. Un modello forte qui non è per forza il compagno ideale per un agente che modifica un progetto vero.

Quali colonne guardare?

  • Tier e Elo, con la barra dell'intervallo: se due barre si sovrappongono, la differenza non è netta.
  • Prezzo in USD per milione di token, con l'andamento di 30 giorni e il filtro «Prezzo basso» (prezzo combinato sotto 1 USD).
  • Contesto: per lavorare su un intero repository conta molto, confrontalo accanto al prezzo.
  • Confronta: spunta fino a 4 modelli per vederli fianco a fianco.

Il calcolatore del costo mensile e il grafico «Qualità e prezzo» funzionano come nella classifica di testo, con il prezzo combinato calcolato 3 a 1 tra input e output.

Ci sono limiti da conoscere?

Sì. Un modello riceve il tier solo con almeno 300 voti; prima compare come «Tier non ancora assegnato». Soprattutto, rispondere bene in chat su un frammento di codice non equivale a far passare i test su un progetto reale, con dipendenze, configurazioni e file sparsi. Usa la classifica per scegliere i candidati, poi provali sul tuo codice. I punteggi vengono da LMArena, i prezzi da models.dev e LiteLLM, con la data dei dati sopra la tabella.