Siirry sisältöön
fedi.software

Ohjelmointi

Mallit ohjelmointikehotteiden mukaan järjestettyinä: taso, Elo luottamusväleineen, hinta miljoonaa tokenia kohden ja kontekstiikkuna.

Päivitetty · Lähteet: LMArena, LiteLLM, models.dev

Kuukausikustannus
Taso Malli Elo Syöte / tuloste, 1 milj. Kuukaudessa Konteksti Sovellus Vertaa
S1 547— —
S1 5090,75 $ / 3,75 $ 1M
S1 4980,75 $ / 3,75 $ 1M
S1 4920,1857 $ / 1,11 $ 1M
S1 4920,375 $ / 1,88 $ 1M
S1 4880,5634 $ / 2,54 $ 119K
S1 4841 $ / 6 $ 1M
S1 4820,57 $ / 3,43 $ 1M
A1 4640,95 $ / 4,05 $Ilmainen 262K
A1 4600,07 $ / 0,43 $ 1M
A1 4590,10 $ / 0,25 $Ilmainen 262K
A1 455— —
A1 4530,45 $ / 1,20 $ 524K
A1 4520,15 $ / 1,25 $ 1M
A1 4520,87 $ / 7 $ 1M
A1 4460,042 $ / 0,22 $Ilmainen 262K
A1 4240,09 $ / 0,71 $ 1M
B1 4000,30 $ / 2,50 $ 1M
B1 4000,125 $ / 0,75 $ 1M
B1 3730,10 $ / 0,10 $ 1M
B1 3720,09 $ / 0,36 $ 1M
B1 3510,10 $ / 0,42 $ 990K
B1 3220,08 $ / 0,16 $Ilmainen 131K
B1 3220,052 $ / 0,21 $ 990K
B1 294— —
B1 2810,05 $ / 0,10 $Ilmainen 131K
C1 269Ilmainen 128K
C1 262— —
C1 255— —
C1 2300,04 $ / 0,08 $Ilmainen 131K
C1 218— —
C1 2110,65 $ / 0,65 $ 8K
C1 191— —
C1 1740,20 $ / 0,20 $ 8K
C1 112Ilmainen 128K
C1 1082 $ / 12 $ 1M
C1 104— —
D1 084— —
D1 0480,15 $ / 0,15 $ 8K
D1 034— —
D1 010— —
D994— —
Vertaa ()

Tasot ovat omiamme: mallin sija taulukossa, kun lasketaan vain mallit, joiden koko luottamusväli on sen yläpuolella. S — parhaat 10 %, A — enintään 30 %, B — enintään 60 %, C — enintään 85 %, D — loput.

Laatu vs. hinta arvio pystyakselilla, yhdistetty hinta (3 osaa syötettä : 1 tulostetta) vaaka-akselilla, USD / 1 milj. tokenia
1 000 1 200 1 400 1 600 0,01 $ 0,10 $ 1 $ 10 $ 100 $ MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Mitä ohjelmoinnin tulostaulukko näyttää?

Se perustuu LMArenan tekstiareenan coding-luokkaan. Äänet ovat samoja sokeita ääniä kuin tekstitaulukossa, mutta vain kehotteista, jotka koskevat koodia: virheen selittämistä, funktion kirjoittamista, koodin muokkaamista tai ratkaisun ehdottamista. Sarakkeet ovat samat – taso, Elo 95 %:n väleineen, hinta miljoonaa tokenia kohden, konteksti, 30 päivän hintakehitys, laskuri, kaavio ja vertailu.

Miten se eroaa verkkokehityksestä ja agenteista?

Tässä arvioidaan vastauksia keskustelussa koodista. Kokonaisen verkkosovelluksen rakentamista yhdestä kehotteesta arvioidaan verkkokehityksen taulukossa, ja monivaiheista työtä työkalukutsuineen agenttien taulukossa. Sama malli voi menestyä kolmessa taulukossa eri tavoin, joten katso sitä, joka muistuttaa omaa tehtävääsi.

Mitä muuta kannattaa katsoa?

  • Konteksti – tärkeä, jos mallin pitää lukea koko koodivarasto. Katso sitä hinnan rinnalla.
  • Hinta – koodaustehtävät lähettävät usein paljon tokeneita; käytä ”Kuukausikustannus”-laskuria.
  • Avoimet painot – merkitsevät, jos haluat ajaa mallia itse.

Milloin malli saa tason?

Sääntö on sama kuin tekstitaulukossa: vähintään 300 ääntä, ja sija riippuu siitä, kuinka monta mallia on selvästi yläpuolella 95 %:n välit huomioiden. Mallit, joilla ääniä ei ole tarpeeksi, näkyvät merkinnällä ”Ei vielä tasoa”. ”Edullinen” tarkoittaa tässäkin sekahintaa alle 1 USD miljoonalta tokenilta.

Esimerkki käytöstä

Jos valitset mallia tiimin koodiavustajaksi, suodata ensin hinnan ja kontekstin mukaan. Valitse kärkitasoilta kolme tai neljä mallia, merkitse ne ja avaa vertailu. Anna sitten jokaiselle samat tyypilliset tehtävät omasta arjestanne ennen päätöstä.

Voiko sijoitukseen luottaa sokeasti?

Ei. Keskusteluvastaukset eivät ole sama asia kuin testien ajaminen oikeassa projektissa. Käytä taulukkoa ehdokkaiden karsintaan ja kokeile niitä omaan koodiisi.