Siirry sisältöön
fedi.software

Ohjelmointi

Mallit ohjelmointikehotteiden mukaan järjestettyinä: taso, Elo luottamusväleineen, hinta miljoonaa tokenia kohden ja kontekstiikkuna.

Päivitetty · Lähteet: LMArena, LiteLLM, models.dev

Kuukausikustannus
Taso Malli Elo Syöte / tuloste, 1 milj. Kuukaudessa Konteksti Sovellus Vertaa
S1 5101 $ / 4 $Ilmainen 1M
S1 4890,275 $ / 1,10 $Ilmainen 262K
S1 4830,30 $ / 1,90 $ 262K
S1 4742 $ / 6 $ 500K
A1 4631,25 $ / 6 $ 500K
A1 4591,25 $ / 2,50 $ 1M
A1 4581,25 $ / 2,50 $ 1M
A1 4531,15 $ / 8 $ 262K
A1 4471,25 $ / 2,50 $ 2M
A1 4452 $ / 10 $ 200K
A1 4323 $ / 15 $ 131K
A1 4302,70 $ / 13,50 $ 256K
A1 4231,60 $ / 4,80 $ 500K
B1 4141,25 $ / 2,50 $ 1M
B1 3990,40 $ / 1,80 $ 256K
B1 381— —
B1 3790,30 $ / 0,50 $ 131K
B1 375— —
B1 312— —
B1 312— —
B1 2872 $ / 10 $ 131K
C1 269— —
C1 267— —
C1 230— —
C1 190— —
C1 169— —
C1 165— —
C1 159— —
C1 154— —
C1 143— —
C1 132— —
C1 129— —
C1 116— —
C1 113— —
C1 112— —
C1 098— —
C1 089— —
C1 080— —
D1 078— —
D1 067— —
D1 064— —
–1 053— —
D1 048— —
D1 045— —
D1 041— —
–1 039— —
D1 010— —
D1 001— —
–996— —
D945— —
D928— —
D913— —
D900— —
D886— —
D799— —
D776— —
D764— —
Vertaa ()

Tasot ovat omiamme: mallin sija taulukossa, kun lasketaan vain mallit, joiden koko luottamusväli on sen yläpuolella. S — parhaat 10 %, A — enintään 30 %, B — enintään 60 %, C — enintään 85 %, D — loput.

Laatu vs. hinta arvio pystyakselilla, yhdistetty hinta (3 osaa syötettä : 1 tulostetta) vaaka-akselilla, USD / 1 milj. tokenia
1 000 1 200 1 400 1 600 0,01 $ 0,10 $ 1 $ 10 $ 100 $ MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Mitä ohjelmoinnin tulostaulukko näyttää?

Se perustuu LMArenan tekstiareenan coding-luokkaan. Äänet ovat samoja sokeita ääniä kuin tekstitaulukossa, mutta vain kehotteista, jotka koskevat koodia: virheen selittämistä, funktion kirjoittamista, koodin muokkaamista tai ratkaisun ehdottamista. Sarakkeet ovat samat – taso, Elo 95 %:n väleineen, hinta miljoonaa tokenia kohden, konteksti, 30 päivän hintakehitys, laskuri, kaavio ja vertailu.

Miten se eroaa verkkokehityksestä ja agenteista?

Tässä arvioidaan vastauksia keskustelussa koodista. Kokonaisen verkkosovelluksen rakentamista yhdestä kehotteesta arvioidaan verkkokehityksen taulukossa, ja monivaiheista työtä työkalukutsuineen agenttien taulukossa. Sama malli voi menestyä kolmessa taulukossa eri tavoin, joten katso sitä, joka muistuttaa omaa tehtävääsi.

Mitä muuta kannattaa katsoa?

  • Konteksti – tärkeä, jos mallin pitää lukea koko koodivarasto. Katso sitä hinnan rinnalla.
  • Hinta – koodaustehtävät lähettävät usein paljon tokeneita; käytä ”Kuukausikustannus”-laskuria.
  • Avoimet painot – merkitsevät, jos haluat ajaa mallia itse.

Milloin malli saa tason?

Sääntö on sama kuin tekstitaulukossa: vähintään 300 ääntä, ja sija riippuu siitä, kuinka monta mallia on selvästi yläpuolella 95 %:n välit huomioiden. Mallit, joilla ääniä ei ole tarpeeksi, näkyvät merkinnällä ”Ei vielä tasoa”. ”Edullinen” tarkoittaa tässäkin sekahintaa alle 1 USD miljoonalta tokenilta.

Esimerkki käytöstä

Jos valitset mallia tiimin koodiavustajaksi, suodata ensin hinnan ja kontekstin mukaan. Valitse kärkitasoilta kolme tai neljä mallia, merkitse ne ja avaa vertailu. Anna sitten jokaiselle samat tyypilliset tehtävät omasta arjestanne ennen päätöstä.

Voiko sijoitukseen luottaa sokeasti?

Ei. Keskusteluvastaukset eivät ole sama asia kuin testien ajaminen oikeassa projektissa. Käytä taulukkoa ehdokkaiden karsintaan ja kokeile niitä omaan koodiisi.