Aller au contenu
fedi.software

Programmation

Modèles classés sur des requêtes de programmation : tier, Elo avec son intervalle de confiance, prix par million de tokens et fenêtre de contexte.

Mis à jour · Sources: LMArena, LiteLLM, models.dev

Coût par mois
Tier Modèle Elo Entrée / sortie, par million Par mois Contexte Application Comparer
S1 547— —
S1 5090,75 $US / 3,75 $US 1M
S1 5020,338 $US / 1,01 $US 1M
S1 4980,75 $US / 3,75 $US 1M
S1 4970,825 $US / 2,48 $US 1M
S1 4920,1857 $US / 1,11 $US 1M
S1 4920,375 $US / 1,88 $US 1M
S1 487— —
S1 4850,045 $US / 0,32 $US 262K
S1 4841 $US / 6 $US 1M
S1 4820,57 $US / 3,43 $US 1M
S1 4730,282 $US / 1,13 $US 1M
S1 4721,03 $US / 6,16 $US 262K
A1 4670,276 $US / 1,65 $US 1M
A1 4640,066 $US / 0,26 $US 262K
A1 4640,1644 $US / 0,9864 $USGratuit 262K
A1 4600,07 $US / 0,43 $US 1M
A1 4590,10 $US / 0,25 $USGratuit 262K
A1 4560,36 $US / 1,43 $US 262K
A1 4520,15 $US / 1,25 $US 1M
A1 4520,87 $US / 7 $US 1M
A1 4460,042 $US / 0,22 $USGratuit 262K
A1 4450,09 $US / 0,55 $US 131K
A1 4400,144 $US / 0,574 $USGratuit 131K
A1 4380,20 $US / 0,88 $US 131K
A1 4360,1126 $US / 0,9008 $USGratuit 262K
A1 4270,0846 $US / 0,6768 $US 262K
A1 4250,287 $US / 2,87 $US 131K
A1 4240,11 $US / 0,60 $US 131K
A1 4240,09 $US / 0,71 $US 1M
A1 422— —
A1 419— —
B1 4160,09 $US / 0,30 $US 256K
B1 4120,13 $US / 0,50 $USGratuit 262K
B1 4120,0282 $US / 0,282 $US 1M
B1 4100,0564 $US / 0,4512 $US 262K
B1 4000,30 $US / 2,50 $US 1M
B1 4000,125 $US / 0,75 $US 1M
B1 3920,15 $US / 0,65 $US 131K
B1 389— 131K
B1 3730,10 $US / 0,10 $US 1M
B1 3720,09 $US / 0,36 $US 1M
B1 361— 131K
B1 359— —
B1 3580,05 $US / 0,10 $US 131K
B1 3510,10 $US / 0,42 $US 990K
B1 3370,0509 $US / 0,335 $US 41K
B1 3330,18 $US / 0,20 $US 24K
B1 3280,115 $US / 0,287 $US 1M
B1 3220,08 $US / 0,16 $USGratuit 131K
B1 3220,052 $US / 0,21 $US 990K
–1 319— —
B1 314— —
B1 307— —
B1 307— —
B1 294— —
B1 2920,12 $US / 0,30 $US 131K
B1 2880,345 $US / 1,38 $US 33K
B1 2810,05 $US / 0,10 $USGratuit 131K
B1 2760,06 $US / 0,20 $USGratuit 33K
B1 270— —
C1 269Gratuit 128K
C1 262— —
C1 255— —
C1 231— —
C1 2300,04 $US / 0,08 $USGratuit 131K
C1 218— —
C1 2110,65 $US / 0,65 $US 8K
C1 1960,90 $US / 0,90 $US 33K
C1 191— —
C1 184— —
C1 1740,20 $US / 0,20 $US 8K
C1 165— —
C1 155— —
C1 138— —
C1 112Gratuit 128K
C1 1082 $US / 12 $US 1M
C1 107— —
C1 104— —
D1 084— —
D1 072— —
D1 0480,15 $US / 0,15 $US 8K
D1 034— —
D1 010— —
D999— —
D994— —
Comparer ()

Les tiers sont les nôtres : la place d'un modèle dans le classement, en ne comptant que les modèles dont tout l'intervalle de confiance est au-dessus du sien. S — les 10 % du haut, A — jusqu'à 30 %, B — jusqu'à 60 %, C — jusqu'à 85 %, D — le reste.

Qualité et prix note en vertical, prix combiné (3 parts d'entrée pour 1 de sortie) en horizontal, USD par million de tokens
1 000 1 200 1 400 1 600 0,01 $US 0,10 $US 1 $US 10 $US 100 $US MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Que classe cette page ?

Les modèles selon leurs réponses aux questions de programmation. Il s'agit de la catégorie « code » de l'arène texte de LMArena : mêmes votes à l'aveugle entre deux réponses anonymes, mais uniquement sur des demandes liées au code, qu'il s'agisse d'écrire une fonction, de corriger un bug ou d'expliquer un message d'erreur. Les colonnes sont celles du classement texte : tier, note Elo avec son intervalle à 95 %, prix par million de tokens, contexte, tendance du prix sur 30 jours, calculateur, graphique et comparaison.

En quoi diffère-t-elle des pages développement web et agents ?

Ce classement juge des réponses dans une conversation. La création d'applications web complètes a son propre tableau, développement web, et le travail en plusieurs étapes avec des outils relève du classement agents. Un modèle excellent pour expliquer du code n'est pas forcément celui qui mène le mieux une tâche longue et autonome.

Pourquoi regarder la fenêtre de contexte ?

Pour travailler sur un dépôt entier, il faut que le modèle puisse lire beaucoup de fichiers à la fois. Une grande fenêtre de contexte compte alors autant que la note. Comparez-la avec le prix : envoyer tout un projet à chaque requête fait vite grimper la facture, que le calculateur « Coût par mois » permet d'estimer.

Que signifient les tiers ?

Ils sont calculés par le site, selon la même règle que sur toutes les pages : parmi les modèles qui ont au moins 300 votes, la place dépend du nombre de modèles dont l'intervalle de confiance est entièrement au-dessus. S correspond aux premiers 10 %, A à 30 %, B à 60 %, C à 85 %, D au reste. En dessous de 300 votes, un modèle reste « Pas encore de tier ».

Les votes suffisent-ils pour choisir ?

Non. Des réponses préférées dans un chat ne garantissent pas qu'un code passe les tests d'un vrai projet. Servez-vous du classement pour présélectionner quelques modèles, puis essayez-les sur votre base de code. Le filtre « Petit prix » (moins de 1 USD par million de tokens en prix combiné) aide à repérer des options économiques pour les tâches répétitives.

D'où viennent les données ?

Les notes viennent de LMArena, les prix et contextes de models.dev et LiteLLM, actualisés chaque jour.