Aller au contenu
fedi.software

Programmation

Modèles classés sur des requêtes de programmation : tier, Elo avec son intervalle de confiance, prix par million de tokens et fenêtre de contexte.

Mis à jour · Sources: LMArena, LiteLLM, models.dev

Coût par mois
Tier Modèle Elo Entrée / sortie, par million Par mois Contexte Application Comparer
S1 4970,75 $US / 6 $US 1M
S1 4962 $US / 10 $US 1M
S1 4941,50 $US / 12 $US 1M
S1 4898 $US / 40 $US 1M
S1 4831,50 $US / 2 $US 1M
S1 4822 $US / 10 $US 1M
A1 4660,06 $US / 0,37 $US 1M
A1 4611,50 $US / 7,50 $US 256K
A1 4541 $US / 8 $US 400K
A1 4481,60 $US / 8 $US 1M
A1 4470,50 $US / 1,50 $US 262K
A1 4470,25 $US / 2 $US 128K
A1 4440,08 $US / 0,40 $US 1M
A1 4380,375 $US / 4 $US 400K
A1 4361 $US / 8 $US 400K
A1 4340,40 $US / 2 $US 262K
B1 4134,50 $US / 14 $US 128K
B1 4081,80 $US / 7,20 $US 200K
B1 4071,75 $US / 14 $US 128K
B1 4060,04 $US / 0,29 $US 400K
B1 4050,16 $US / 1 $US 400K
B1 39775 $US / 150 $US 128K
B1 3911,60 $US / 6,40 $US 1M
B1 3860,36 $US / 1,22 $US 131K
B1 3800,032 $US / 0,14 $US 131K
B1 3780,99 $US / 4 $US 200K
B1 3680,99 $US / 4 $US 200K
B1 3670,32 $US / 1,28 $US 1M
B1 36714 $US / 54 $US 200K
B1 3630,99 $US / 4 $US 200K
B1 3630,075 $US / 0,20 $US 128K
B1 3621,10 $US / 4,40 $US 128K
B1 3510,04 $US / 0,32 $US 400K
B1 3192 $US / 5 $US 128K
B1 3090,10 $US / 0,30 $US 128K
B1 3070,009 $US / 0,045 $USGratuit 131K
B1 3060,08 $US / 0,26 $US 1M
B1 2975 $US / 15 $US 128K
B1 2900,15 $US / 0,60 $US 128K
B1 2842,50 $US / 10 $US 128K
C1 2772 $US / 6 $US 131K
C1 2760,50 $US / 1,50 $US 131K
C1 2689 $US / 27 $US 128K
C1 25410 $US / 30 $US 8K
C1 2460,05 $US / 0,08 $US 33K
C1 2310,07 $US / 0,14 $US 16K
C1 2020,10 $US / 0,10 $US 128K
C1 1660,60 $US / 0,60 $US 66K
C1 1360,45 $US / 1,40 $US 16K
C1 1300,17 $US / 0,68 $US 4K
C1 1260,15 $US / 0,15 $US 32K
C1 1010,15 $US / 0,60 $US 8K
C1 093— —
C1 0930,13 $US / 0,52 $US 4K
D1 0820,05 $US / 0,25 $US 32K
C1 081— —
D1 0390,13 $US / 0,52 $US 128K
D1 035— —
D1 0180,07 $US / 0,28 $US 33K
Comparer ()

Les tiers sont les nôtres : la place d'un modèle dans le classement, en ne comptant que les modèles dont tout l'intervalle de confiance est au-dessus du sien. S — les 10 % du haut, A — jusqu'à 30 %, B — jusqu'à 60 %, C — jusqu'à 85 %, D — le reste.

Qualité et prix note en vertical, prix combiné (3 parts d'entrée pour 1 de sortie) en horizontal, USD par million de tokens
1 000 1 200 1 400 1 600 0,01 $US 0,10 $US 1 $US 10 $US 100 $US MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Que classe cette page ?

Les modèles selon leurs réponses aux questions de programmation. Il s'agit de la catégorie « code » de l'arène texte de LMArena : mêmes votes à l'aveugle entre deux réponses anonymes, mais uniquement sur des demandes liées au code, qu'il s'agisse d'écrire une fonction, de corriger un bug ou d'expliquer un message d'erreur. Les colonnes sont celles du classement texte : tier, note Elo avec son intervalle à 95 %, prix par million de tokens, contexte, tendance du prix sur 30 jours, calculateur, graphique et comparaison.

En quoi diffère-t-elle des pages développement web et agents ?

Ce classement juge des réponses dans une conversation. La création d'applications web complètes a son propre tableau, développement web, et le travail en plusieurs étapes avec des outils relève du classement agents. Un modèle excellent pour expliquer du code n'est pas forcément celui qui mène le mieux une tâche longue et autonome.

Pourquoi regarder la fenêtre de contexte ?

Pour travailler sur un dépôt entier, il faut que le modèle puisse lire beaucoup de fichiers à la fois. Une grande fenêtre de contexte compte alors autant que la note. Comparez-la avec le prix : envoyer tout un projet à chaque requête fait vite grimper la facture, que le calculateur « Coût par mois » permet d'estimer.

Que signifient les tiers ?

Ils sont calculés par le site, selon la même règle que sur toutes les pages : parmi les modèles qui ont au moins 300 votes, la place dépend du nombre de modèles dont l'intervalle de confiance est entièrement au-dessus. S correspond aux premiers 10 %, A à 30 %, B à 60 %, C à 85 %, D au reste. En dessous de 300 votes, un modèle reste « Pas encore de tier ».

Les votes suffisent-ils pour choisir ?

Non. Des réponses préférées dans un chat ne garantissent pas qu'un code passe les tests d'un vrai projet. Servez-vous du classement pour présélectionner quelques modèles, puis essayez-les sur votre base de code. Le filtre « Petit prix » (moins de 1 USD par million de tokens en prix combiné) aide à repérer des options économiques pour les tâches répétitives.

D'où viennent les données ?

Les notes viennent de LMArena, les prix et contextes de models.dev et LiteLLM, actualisés chaque jour.