Naar de inhoud
fedi.software

Tekst

Chatmodellen gerangschikt op blinde stemmen van mensen op LMArena, met het betrouwbaarheidsinterval van elke score en de huidige prijs per miljoen tokens.

Bijgewerkt · Bronnen: LMArena, LiteLLM, models.dev

Kosten per maand
Tier Model Elo Input / output, per 1M Per maand Context App Vergelijken
S1.533— —
S1.497US$ 0,75 / US$ 3,75 1M
S1.487US$ 0,75 / US$ 3,75 1M
S1.482US$ 0,1857 / US$ 1,11 1M
S1.480US$ 1 / US$ 6 1M
S1.479US$ 0,375 / US$ 1,88 1M
S1.479US$ 0,57 / US$ 3,43 1M
S1.466US$ 0,07 / US$ 0,43 1M
S1.458US$ 0,87 / US$ 7 1M
A1.443US$ 0,10 / US$ 0,25Gratis 262K
A1.435US$ 0,15 / US$ 1,25 1M
A1.434US$ 0,042 / US$ 0,22Gratis 262K
A1.427— 131K
A1.417US$ 0,09 / US$ 0,71 1M
A1.416US$ 0,125 / US$ 0,75 1M
A1.407US$ 0,30 / US$ 2,50 1M
B1.379US$ 0,09 / US$ 0,36 1M
B1.369US$ 0,10 / US$ 0,10 1M
B1.361— —
B1.358US$ 0,08 / US$ 0,16Gratis 131K
B1.354US$ 0,10 / US$ 0,42 990K
B1.334US$ 0,05 / US$ 0,10Gratis 131K
B1.330US$ 0,052 / US$ 0,21 990K
B1.319— —
B1.318US$ 0,06 / US$ 0,25 131K
B1.305Gratis 128K
B1.293— —
B1.291US$ 0,04 / US$ 0,08Gratis 131K
B1.290US$ 0,05 / US$ 0,10 131K
B1.287— —
B1.279— —
C1.241— —
C1.231US$ 0,65 / US$ 0,65 8K
C1.227— —
C1.226— —
C1.207US$ 0,20 / US$ 0,20 8K
C1.156Gratis 128K
C1.149— —
C1.149— —
C1.130US$ 2 / US$ 12 1M
C1.127— —
C1.096— —
C1.094— —
D1.080— —
D1.056US$ 0,15 / US$ 0,15 8K
D1.027— —
D1.022— —
D1.002— —

De tiers zijn van ons: de plaats van een model in de ranglijst, waarbij alleen modellen meetellen waarvan het hele betrouwbaarheidsinterval erboven ligt. S — top 10%, A — tot 30%, B — tot 60%, C — tot 85%, D — de rest.

Kwaliteit versus prijs omhoog score, opzij gemengde prijs (3 delen input : 1 output), USD per 1M tokens
1.000 1.200 1.400 1.600 US$ 0,01 US$ 0,10 US$ 1 US$ 10 US$ 100 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Hoe lees je deze ranglijst?

Begin bij de tier en kijk daarna naar de balk naast de rating: dat is het 95%-betrouwbaarheidsinterval. Overlappen de balken van twee modellen, dan is het verschil tussen die twee statistisch niet duidelijk. Daarom kunnen meerdere modellen samen in de hoogste tier staan. De rating komt uit de tekstarena van LMArena, categorie overall. Mensen sturen daar een prompt, krijgen twee anonieme antwoorden te zien en stemmen op het betere. Uit al die stemmen ontstaat een rating in de stijl van Elo. Zo'n rating zegt iets over de voorkeur van arenagebruikers, meestal bij Engelse prompts. Snelheid, kosten of geschiktheid voor één specifieke taak meet hij niet.

Wat staat er per model?

  • tier, rating met interval, leverancier en of het model open gewichten heeft;
  • de laagste actuele prijs per 1M input- en outputtokens die we bij aanbieders vonden, in USD;
  • het contextvenster en de prijsontwikkeling over 30 dagen;
  • een link om de app te downloaden als die in onze catalogus staat.

Klik je op een regel, dan opent een detailvenster met de aanbieders van goedkoop naar duur, modaliteiten, context en maximale output, het aantal stemmen, de positie bij de bron, de licentie, de releasedatum en de kennisgrens.

Filteren, rekenen en vergelijken

Met de filters toon je alleen modellen met open gewichten, gratis modellen, modellen met “Lage prijs” of die van één leverancier. “Lage prijs” betekent op deze ranglijst een gemengde prijs onder 1 USD per 1M tokens. De gemengde prijs telt 3 delen input en 1 deel output, dezelfde verhouding als in de grafiek “Kwaliteit versus prijs”. In “Kosten per maand” vul je het aantal tokens per maand en het aandeel input in. Vink maximaal 4 modellen aan om ze naast elkaar te vergelijken.

Waar zitten de beperkingen?

Een model met minder dan 300 stemmen krijgt nog geen tier en toont “Nog geen tier”. De prijs is de laagste die we op de dag van de gegevens vonden via models.dev en LiteLLM; de prijs bij de leverancier zelf kan afwijken. Kortingen voor caching, batchverwerking en regionale prijzen staan niet in de tabel. Zoek je een model om mee te programmeren, kijk dan ook naar de ranglijst programmeren.