Hoppa till innehållet
fedi.software

Text

Chattmodeller rankade efter blinda röster från människor på LMArena, med konfidensintervallet för varje betyg och aktuellt pris per miljon tokens.

Uppdaterad · Källor: LMArena, LiteLLM, models.dev

Kostnad per månad
Tier Modell Elo Input / output, per 1M Per månad Kontext App Jämför
S1 4900,10 US$ / 0,20 US$ 1M
S1 4830,10 US$ / 0,20 US$ 1M
S1 4791,25 US$ / 4,25 US$ 1M
S1 474— —
S1 4480,959 US$ / 2,74 US$ 1M
B1 4030,09 US$ / 0,30 US$Gratis 256K
B1 389— —
B1 3510,21 US$ / 0,57 US$ 66K
B1 336— —
B1 3215,21 US$ / 16,44 US$ 16K
B1 311— —
B1 300— —
B1 288— —
B1 2870,05 US$ / 0,10 US$Gratis 1M
B1 2843,50 US$ / 3,50 US$ 4K
B1 2790,05 US$ / 0,10 US$ 328K
C1 2740,05 US$ / 0,23 US$Gratis 24K
C1 2610,40 US$ / 0,40 US$Gratis 131K
C1 256— —
C1 2210,51 US$ / 0,74 US$ 8K
C1 218— —
C1 193— —
C1 1870,02 US$ / 0,04 US$Gratis 32K
C1 1660,04 US$ / 0,04 US$ 8K
C1 1151 US$ / 1 US$ 4K
C1 1100,02 US$ / 0,02 US$Gratis 80K
D1 0840,10 US$ / 0,50 US$ 4K
D1 065— —
D1 057— —
D1 0550,01 US$ / 0,01 US$Gratis 60K
D1 0530,05 US$ / 0,25 US$ 4K
D1 032— —
D833— —
Jämför ()

Tiers är våra egna: en modells plats på topplistan där bara de modeller räknas vars hela konfidensintervall ligger ovanför den. S – topp 10%, A – upp till 30%, B – upp till 60%, C – upp till 85%, D – resten.

Kvalitet mot pris uppåt betyg, åt sidan blandat pris (3 delar input : 1 output), USD per 1M tokens
1 000 1 200 1 400 1 600 0,01 US$ 0,10 US$ 1 US$ 10 US$ 100 US$ Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Topplistan för textmodeller bygger på den övergripande kategorin i LMArenas textarena. Där skickar människor en fråga, får två anonyma svar och röstar på det de föredrar. Rösterna räknas om till ett betyg i Elo-stil, samma princip som i schack.

Så läser du tabellen

  • Tier och betyg: stapeln visar betyget med dess 95%-konfidensintervall.
  • Leverantör och ”Öppna vikter”: vem som gjort modellen och om vikterna går att ladda ner.
  • Pris: det lägsta aktuella priset per 1M input- och output-tokens bland leverantörerna, i USD, samt prisutvecklingen under 30 dagar.
  • Kontext: hur mycket text modellen kan hålla i minnet i ett samtal.
  • Nedladdning: en länk till appen när den finns i vår katalog.

Med filtren väljer du öppna vikter, gratis, ”Lågt pris” eller en viss leverantör, och du kan sortera efter betyg, pris, kontext eller namn. Klickar du på en rad ser du leverantörerna med det billigaste priset först, modaliteter, kontext och maximal output, antal röster, placering hos källan, licens, lanseringsdatum och när modellens kunskap slutar. Kryssrutan lägger till upp till 4 modeller i jämförelsen.

Varför flera modeller delar toppen

Konfidensintervallen överlappar ofta. Då går det inte att säga statistiskt vilken av två modeller som är bättre, och båda kan hamna i samma tier. Vår regel: bland modeller med minst 300 röster får varje modell plats efter hur många modeller vars hela intervall ligger ovanför dess eget. Under 10% av listan blir S, under 30% A, under 60% B, under 85% C och resten D. En modell med färre röster visas som ”Ingen tier ännu”.

Kalkylatorn och diagrammet

I ”Kostnad per månad” anger du tokens per månad och andelen input, så räknas kostnaden ut för varje modell. Diagrammet ”Kvalitet mot pris” placerar betyget uppåt och ett blandat pris åt sidan, där input och output vägs 3 : 1. ”Lågt pris” betyder här ett blandat pris under 1 USD per 1M tokens.

Vad betyget inte säger

Betyget speglar vad arenans användare föredrar, oftast på engelska frågor. Det mäter inte hastighet, kostnad eller hur bra en modell är på just din uppgift. Priset hos en leverantör kan också skilja sig från tillverkarens eget: rabatter för cache, batchkörning och regionala priser visas inte. Källorna är LMArena för betygen samt models.dev och LiteLLM för priser, kontext och modaliteter, alla uppdaterade dagligen.