Salt la conținut
fedi.software

Programare

Modele clasate pe prompturi de programare: tier, Elo cu intervalul de încredere, preț per milion de tokeni și fereastra de context.

Actualizat · Surse: LMArena, LiteLLM, models.dev

Cost pe lună
Tier Model Elo Intrare / ieșire, per 1M Pe lună Context Aplicație Comparare
S1.5350,40 USD / 0,80 USD 1M
S1.5110,10 USD / 0,25 USD 1M
S1.5020,40 USD / 0,80 USD 1M
S1.4760,435 USD / 0,87 USD 1M
A1.4690,14 USD / 0,28 USD 1M
A1.4680,10 USD / 0,10 USD 1M
A1.4670,14 USD / 0,28 USD 262K
A1.4611,50 USD / 7,50 USD 256K
A1.4470,50 USD / 1,50 USD 262K
A1.4430,10 USD / 0,30 USD 262K
A1.4340,40 USD / 2 USD 262K
B1.4030,05 USD / 0,25 USD 262K
B1.3860,36 USD / 1,22 USD 131K
B1.3780,05 USD / 0,20 USDGratuit 131K
B1.3710,0115 USD / 0,17 USD 1M
B1.3630,075 USD / 0,20 USD 128K
B1.3540,40 USD / 0,40 USDGratuit 131K
B1.3192 USD / 5 USD 128K
B1.312Gratuit 128K
B1.3090,10 USD / 0,30 USD 128K
–1.296— —
C1.2772 USD / 6 USD 131K
C1.2760,50 USD / 1,50 USD 131K
C1.2720,357 USD / 0,408 USDGratuit 128K
C1.2460,05 USD / 0,08 USD 33K
C1.223— —
C1.209— —
C1.2020,10 USD / 0,10 USD 128K
C1.1660,60 USD / 0,60 USD 66K
C1.1260,15 USD / 0,15 USD 32K
D1.0820,05 USD / 0,25 USD 32K
D1.025— —
D1.0180,07 USD / 0,28 USD 33K
Compară ()

Tier-urile sunt ale noastre: locul unui model în clasament, numărând doar modelele al căror interval de încredere este în întregime deasupra lui. S — primele 10%, A — până la 30%, B — până la 60%, C — până la 85%, D — restul.

Calitate și preț scorul pe verticală, prețul combinat (3 părți intrare : 1 ieșire) pe orizontală, USD per 1M de tokeni
1.000 1.200 1.400 1.600 0,01 USD 0,10 USD 1 USD 10 USD 100 USD MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Ce măsoară acest clasament

Clasamentul de programare folosește categoria „coding” din arena de text LMArena. Metoda este aceeași ca la clasamentul general: voturi oarbe între două răspunsuri anonime, transformate într-un scor Elo, dar numai pentru întrebările despre cod. Un model care conversează excelent poate ocupa aici alt loc, pentru că alegerea oamenilor se face pe alte criterii: corectitudinea codului, explicațiile, respectarea cerinței.

Coloanele tabelului

  • tier-ul, calculat după aceeași regulă ca la clasamentul de text: cel puțin 300 de voturi, intervalul de încredere de 95% și pragurile 10, 30, 60 și 85%;
  • scorul Elo cu bara intervalului;
  • prețul per 1M de tokeni la intrare și la ieșire, cel mai mic găsit la furnizori;
  • fereastra de context și evoluția prețului în 30 de zile;
  • calculatorul „Cost pe lună”, graficul „Calitate și preț” și căsuța de comparare pentru până la 4 modele.

Cum alegeți un model pentru cod

Priviți mai întâi tier-ul, nu diferențele de câteva puncte: modelele din același tier nu se deosebesc clar statistic. Apoi comparați contextul cu prețul. Dacă lucrați pe un depozit întreg, cu multe fișiere trimise deodată, o fereastră de context mare contează la fel de mult ca scorul. Pentru întrebări scurte despre o funcție, un model mai ieftin din tier-ul următor este adesea suficient. Calculatorul vă arată cât ar costa volumul dumneavoastră lunar de tokeni cu fiecare model.

Ce nu arată scorul

Arena evaluează răspunsuri dintr-un chat despre cod, nu rularea testelor pe un proiect real. Construirea de aplicații web întregi are clasamentul separat Dezvoltare web, iar lucrul în mai mulți pași, cu instrumente, se vede în clasamentul Agenți. Dacă folosiți un agent de programare, verificați toate trei clasamentele: agentul este atât de bun cât modelul din spatele lui.

Modelele cu mai puțin de 300 de voturi apar cu „Fără tier deocamdată”. Datele se actualizează zilnic, iar deasupra tabelului vedeți data și sursele.