Hopp til innholdet
fedi.software

Tekst

Chatmodeller rangert etter blinde stemmer fra mennesker på LMArena, med konfidensintervallet for hver vurdering og dagens pris per million tokens.

Oppdatert · Kilder: LMArena, LiteLLM, models.dev

Kostnad per måned
Nivå Modell Elo Input / output, per 1 mill. Per måned Kontekst App Sammenlign
S1 512USD 4 / USD 20 1M
S1 511USD 10 / USD 50 1M
S1 507USD 5 / USD 25 1M
S1 503USD 4,30 / USD 21 1M
S1 492USD 3 / USD 18,50 1M
S1 490USD 4,30 / USD 21 1M
S1 476USD 1 / USD 4Gratis 1M
S1 468USD 0,5634 / USD 2,54 119K
S1 467USD 2 / USD 10 1M
S1 461USD 0,425 / USD 2,12 1M
S1 458USD 0,90 / USD 5,55 1M
S1 455USD 0,275 / USD 1,10Gratis 262K
A1 451USD 0,71 / USD 3,57 200K
A1 445USD 0,30 / USD 1,90 262K
A1 445— —
A1 443USD 1,44 / USD 7,20 1M
A1 439USD 0,43 / USD 2,14 1M
A1 419USD 13 / USD 64 197K
A1 414USD 1,15 / USD 8 262K
B1 396USD 0,14 / USD 0,71 200K
B1 380USD 0,40 / USD 1,80 256K
B1 377USD 13 / USD 64 193K
B1 351USD 2,60 / USD 13 983K
B1 314USD 3 / USD 15 200K
B1 298USD 3 / USD 15 200K
C1 262USD 15 / USD 75 200K
C1 255USD 0,80 / USD 4 200K
C1 218USD 3 / USD 15 200K
C1 195USD 0,25 / USD 1,25 200K

Nivåene er våre: en modells plass på rangeringen, der bare modeller med hele konfidensintervallet over den telles. S — topp 10 %, A — opptil 30 %, B — opptil 60 %, C — opptil 85 %, D — resten.

Kvalitet mot pris vurdering loddrett, blandet pris (3 deler input : 1 output) vannrett, USD per 1 mill. tokens
1 000 1 200 1 400 1 600 USD 0,01 USD 0,10 USD 1 USD 10 USD 100 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Topplisten for tekstmodeller bygger på den samlede kategorien i LMArenas tekstarena. Der sender folk inn et spørsmål, får to anonyme svar og stemmer på det de liker best. Stemmene regnes om til en vurdering i Elo-stil, samme prinsipp som i sjakk.

Slik leser du tabellen, steg for steg

  1. Tier og vurdering: søylen viser vurderingen med 95 %-konfidensintervall. Overlapper to søyler, er forskjellen ikke statistisk klar.
  2. Leverandør og «Åpne vekter»: hvem som har laget modellen, og om vektene kan lastes ned.
  3. Pris: den laveste aktuelle prisen per 1M input- og output-tokens blant leverandørene, i USD, pluss prisutviklingen over 30 dager.
  4. Kontekst: hvor mye tekst modellen kan holde i én samtale.
  5. Nedlasting: en lenke til appen når den finnes i vår katalog.

Med filtrene velger du åpne vekter, gratis, «Lav pris» eller en bestemt leverandør, og du kan sortere etter vurdering, pris, kontekst eller navn. Klikker du på en rad, ser du leverandørene med billigste pris først, modaliteter, kontekst og maksimal output, antall stemmer, plass hos kilden, lisens, lanseringsdato og når modellens kunnskap slutter. Avkrysningsboksen legger opptil 4 modeller i sammenligningen.

Hvorfor deler flere modeller toppen?

Blant modeller med minst 300 stemmer får hver modell plass etter hvor mange modeller som har hele intervallet sitt over modellens eget. Under 10 % av listen gir S, under 30 % A, under 60 % B, under 85 % C og resten D. Modeller som statistisk ikke kan skilles fra lederen, deler førsteplassen. Har en modell færre stemmer, står den som «Ikke plassert ennå».

Kalkulatoren og diagrammet

I «Kostnad per måned» fyller du inn tokens per måned og andelen input, og kostnaden regnes ut for hver modell. Diagrammet «Kvalitet mot pris» viser vurderingen oppover og en blandet pris bortover, der input og output vektes 3 : 1. «Lav pris» betyr her en blandet pris under 1 USD per 1M tokens.

Hva vurderingen ikke sier

Vurderingen viser hva arenaens brukere foretrekker, oftest på engelske spørsmål. Den måler ikke hastighet, kostnad eller hvor god en modell er på akkurat din oppgave. Prisen hos en leverandør kan også avvike fra produsentens egen: rabatter for hurtigbuffer, batchkjøring og regionale priser vises ikke. Kildene er LMArena for vurderingene, mens models.dev og LiteLLM står for priser, kontekst og modaliteter, alle oppdatert daglig.