Hopp til innholdet
fedi.software

Tekst

Chatmodeller rangert etter blinde stemmer fra mennesker på LMArena, med konfidensintervallet for hver vurdering og dagens pris per million tokens.

Oppdatert · Kilder: LMArena, LiteLLM, models.dev

Kostnad per måned
Nivå Modell Elo Input / output, per 1 mill. Per måned Kontekst App Sammenlign
S1 471USD 0,40 / USD 1,40Gratis 1M
S1 470USD 0,30 / USD 1,05Gratis 1M
S1 470USD 0,03 / USD 0,10Gratis 1M
S1 461USD 0,45 / USD 2,15 200K
A1 446USD 0,40 / USD 1,75 205K
A1 440USD 0,2740 / USD 1,10 205K
A1 437USD 0,7042 / USD 3,10 200K
A1 436USD 0,2740 / USD 1,10 205K
A1 430USD 0,286 / USD 1,14 131K
B1 384USD 0,1165 / USD 0,2911 131K
B1 377USD 0,137 / USD 0,411 128K
B1 351USD 0,06 / USD 0,40 200K
B1 333USD 0,29 / USD 0,86 64K
B1 331USD 10,00 / USD 10,00 128K
C1 226— —
D972— —
D939— —
D918— —

Nivåene er våre: en modells plass på rangeringen, der bare modeller med hele konfidensintervallet over den telles. S — topp 10 %, A — opptil 30 %, B — opptil 60 %, C — opptil 85 %, D — resten.

Kvalitet mot pris vurdering loddrett, blandet pris (3 deler input : 1 output) vannrett, USD per 1 mill. tokens
1 000 1 200 1 400 1 600 USD 0,01 USD 0,10 USD 1 USD 10 USD 100 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Topplisten for tekstmodeller bygger på den samlede kategorien i LMArenas tekstarena. Der sender folk inn et spørsmål, får to anonyme svar og stemmer på det de liker best. Stemmene regnes om til en vurdering i Elo-stil, samme prinsipp som i sjakk.

Slik leser du tabellen, steg for steg

  1. Tier og vurdering: søylen viser vurderingen med 95 %-konfidensintervall. Overlapper to søyler, er forskjellen ikke statistisk klar.
  2. Leverandør og «Åpne vekter»: hvem som har laget modellen, og om vektene kan lastes ned.
  3. Pris: den laveste aktuelle prisen per 1M input- og output-tokens blant leverandørene, i USD, pluss prisutviklingen over 30 dager.
  4. Kontekst: hvor mye tekst modellen kan holde i én samtale.
  5. Nedlasting: en lenke til appen når den finnes i vår katalog.

Med filtrene velger du åpne vekter, gratis, «Lav pris» eller en bestemt leverandør, og du kan sortere etter vurdering, pris, kontekst eller navn. Klikker du på en rad, ser du leverandørene med billigste pris først, modaliteter, kontekst og maksimal output, antall stemmer, plass hos kilden, lisens, lanseringsdato og når modellens kunnskap slutter. Avkrysningsboksen legger opptil 4 modeller i sammenligningen.

Hvorfor deler flere modeller toppen?

Blant modeller med minst 300 stemmer får hver modell plass etter hvor mange modeller som har hele intervallet sitt over modellens eget. Under 10 % av listen gir S, under 30 % A, under 60 % B, under 85 % C og resten D. Modeller som statistisk ikke kan skilles fra lederen, deler førsteplassen. Har en modell færre stemmer, står den som «Ikke plassert ennå».

Kalkulatoren og diagrammet

I «Kostnad per måned» fyller du inn tokens per måned og andelen input, og kostnaden regnes ut for hver modell. Diagrammet «Kvalitet mot pris» viser vurderingen oppover og en blandet pris bortover, der input og output vektes 3 : 1. «Lav pris» betyr her en blandet pris under 1 USD per 1M tokens.

Hva vurderingen ikke sier

Vurderingen viser hva arenaens brukere foretrekker, oftest på engelske spørsmål. Den måler ikke hastighet, kostnad eller hvor god en modell er på akkurat din oppgave. Prisen hos en leverandør kan også avvike fra produsentens egen: rabatter for hurtigbuffer, batchkjøring og regionale priser vises ikke. Kildene er LMArena for vurderingene, mens models.dev og LiteLLM står for priser, kontekst og modaliteter, alle oppdatert daglig.