Hopp til innholdet
fedi.software

Koding

Modeller rangert på programmeringsoppgaver: nivå, Elo med konfidensintervall, pris per million tokens og kontekstvindu.

Oppdatert · Kilder: LMArena, LiteLLM, models.dev

Kostnad per måned
Nivå Modell Elo Input / output, per 1 mill. Per måned Kontekst App Sammenlign
S1 502USD 0,338 / USD 1,01 1M
S1 497USD 0,825 / USD 2,48 1M
S1 497USD 0,75 / USD 6 1M
S1 496USD 2 / USD 10 1M
S1 494USD 1,50 / USD 12 1M
S1 489USD 8 / USD 40 1M
S1 487— —
S1 485USD 0,045 / USD 0,32 262K
S1 483USD 1,50 / USD 2 1M
S1 482USD 2 / USD 10 1M
S1 473USD 0,282 / USD 1,13 1M
S1 472USD 1,03 / USD 6,16 262K
A1 467USD 0,276 / USD 1,65 1M
A1 466USD 0,06 / USD 0,37 1M
A1 464USD 0,1644 / USD 0,9864Gratis 262K
A1 456USD 0,36 / USD 1,43 262K
A1 454USD 1 / USD 8 400K
A1 448USD 1,60 / USD 8 1M
A1 447USD 0,25 / USD 2 128K
A1 445USD 0,09 / USD 0,55 131K
A1 444USD 0,08 / USD 0,40 1M
A1 440USD 0,144 / USD 0,574Gratis 131K
A1 438USD 0,375 / USD 4 400K
A1 438USD 0,20 / USD 0,88 131K
A1 436USD 0,1126 / USD 0,9008Gratis 262K
A1 436USD 1 / USD 8 400K
A1 427USD 0,0846 / USD 0,6768 262K
A1 425USD 0,287 / USD 2,87 131K
A1 424USD 0,11 / USD 0,60 131K
B1 416USD 0,09 / USD 0,30 256K
B1 413USD 4,50 / USD 14 128K
B1 412USD 0,13 / USD 0,50Gratis 262K
B1 412USD 0,0282 / USD 0,282 1M
B1 410USD 0,0564 / USD 0,4512 262K
B1 408USD 1,80 / USD 7,20 200K
B1 407USD 1,75 / USD 14 128K
B1 406USD 0,04 / USD 0,29 400K
B1 405USD 0,16 / USD 1 400K
B1 397USD 75 / USD 150 128K
B1 392USD 0,15 / USD 0,65 131K
B1 391USD 1,60 / USD 6,40 1M
B1 380USD 0,032 / USD 0,14 131K
B1 378USD 0,99 / USD 4 200K
B1 368USD 0,99 / USD 4 200K
B1 367USD 0,32 / USD 1,28 1M
B1 367USD 14 / USD 54 200K
B1 363USD 0,99 / USD 4 200K
B1 362USD 1,10 / USD 4,40 128K
B1 359— —
B1 358USD 0,05 / USD 0,10 131K
B1 351USD 0,04 / USD 0,32 400K
B1 337USD 0,0509 / USD 0,335 41K
B1 333USD 0,18 / USD 0,20 24K
B1 330USD 2,50 / USD 10 256K
B1 328USD 0,115 / USD 0,287 1M
B1 314— —
B1 307USD 0,009 / USD 0,045Gratis 131K
B1 306USD 0,08 / USD 0,26 1M
B1 297USD 5 / USD 15 128K
B1 292USD 0,12 / USD 0,30 131K
B1 290USD 0,15 / USD 0,60 128K
B1 288USD 0,345 / USD 1,38 33K
B1 284USD 2,50 / USD 10 128K
B1 276USD 0,06 / USD 0,20Gratis 33K
C1 268USD 9 / USD 27 128K
C1 254USD 10 / USD 30 8K
C1 197USD 0,50 / USD 1,50 128K
C1 196USD 0,90 / USD 0,90 33K
C1 187USD 2,50 / USD 10 128K
C1 184— —
C1 172USD 2,50 / USD 10 128K
C1 169USD 0,15 / USD 0,60 128K
C1 165— —
C1 155— —
C1 138— —
C1 136USD 0,45 / USD 1,40 16K
C1 128USD 0,15 / USD 0,60 128K
C1 107— —
D1 072— —
D999— —

Nivåene er våre: en modells plass på rangeringen, der bare modeller med hele konfidensintervallet over den telles. S — topp 10 %, A — opptil 30 %, B — opptil 60 %, C — opptil 85 %, D — resten.

Kvalitet mot pris vurdering loddrett, blandet pris (3 deler input : 1 output) vannrett, USD per 1 mill. tokens
1 000 1 200 1 400 1 600 USD 0,01 USD 0,10 USD 1 USD 10 USD 100 MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Samme arena, bare kode

Topplisten for koding viser kodekategorien i LMArenas tekstarena. Metoden er den samme som for tekst – blinde stemmer mellom to anonyme svar – men bare på spørsmål om programmering: å forklare en feilmelding, skrive en funksjon, foreslå en omskriving eller oversette kode mellom språk. Vurderingen er et Elo-tall med 95 %-konfidensintervall, og kolonnene er de samme som på tekstlisten: tier, Elo med intervall, pris per 1M tokens, kontekstvindu og prisutvikling over 30 dager. «Kostnad per måned», diagrammet «Kvalitet mot pris» og sammenligning av opptil 4 modeller fungerer på samme måte.

Tre topplister for utviklere

Det er lett å blande sammen de tre listene som handler om programmering, men de måler forskjellige ting:

  • Koding: svar i en chat om kode, vurdert av mennesker.
  • Webutvikling: modeller bygger hele, fungerende nettapper og vurderes på resultatet.
  • Agenter: oppgaver i flere trinn med verktøykall, på en egen skala.

Skal du velge modell til en kodeagent i terminalen, er det lurt å se på alle tre.

Kontekstvinduet betyr mye

Når du jobber med et helt kodelager, må modellen se mange filer samtidig. Et langt kontekstvindu gjør det mulig, men lange forespørsler koster også flere tokens. Sammenlign derfor kontekst og pris side om side, og regn med kalkulatoren på din egen forventede bruk før du bestemmer deg.

Tier-regelen

Bare modeller med minst 300 stemmer får tier. Plassen avgjøres av hvor mange modeller som har hele konfidensintervallet sitt over modellens eget, og grensene er 10, 30, 60 og 85 % for S, A, B og C. Resten får D, og modeller med færre stemmer vises som «Ikke plassert ennå».

Det arenaen ikke tester

Et godt chattesvar om kode er ikke det samme som kode som består testene i et ekte prosjekt. Arenaen vurderer hvordan svaret oppleves, ikke om det kompilerer i din kodebase. Prøv derfor modellen på egen kode, kjør testene og gå gjennom endringene før de går videre. Kildene er LMArena for vurderingene, mens models.dev og LiteLLM står for prisene, oppdatert daglig.