Aller au contenu
fedi.software

Texte

Modèles de chat classés par les votes humains à l'aveugle sur LMArena, avec l'intervalle de confiance de chaque note et le prix actuel par million de tokens.

Mis à jour · Sources: LMArena, LiteLLM, models.dev

Coût par mois
Tier Modèle Elo Entrée / sortie, par million Par mois Contexte Application Comparer
S1 4710,40 $US / 1,40 $USGratuit 1M
S1 4700,30 $US / 1,05 $USGratuit 1M
S1 4700,03 $US / 0,10 $USGratuit 1M
S1 4610,45 $US / 2,15 $US 200K
A1 4460,40 $US / 1,75 $US 205K
A1 4400,2740 $US / 1,10 $US 205K
A1 4370,7042 $US / 3,10 $US 200K
A1 4360,2740 $US / 1,10 $US 205K
A1 4320,20 $US / 0,90 $USGratuit 1M
A1 4300,286 $US / 1,14 $US 131K
A1 4050,08 $US / 0,32 $USGratuit 205K
B1 3920,27 $US / 1,10 $US 205K
B1 3840,1165 $US / 0,2911 $US 131K
B1 3770,137 $US / 0,411 $US 128K
B1 3590,22 $US / 0,88 $US 205K
B1 3550,25 $US / 0,75 $US 128K
B1 3510,06 $US / 0,40 $US 200K
B1 3430,132 $US / 1,25 $US 1M
B1 3400,20 $US / 1 $US 205K
B1 3330,29 $US / 0,86 $US 64K
B1 33110,00 $US / 10,00 $US 128K
B1 282— —
C1 226— —
D972— —
D939— —
D918— —
Comparer ()

Les tiers sont les nôtres : la place d'un modèle dans le classement, en ne comptant que les modèles dont tout l'intervalle de confiance est au-dessus du sien. S — les 10 % du haut, A — jusqu'à 30 %, B — jusqu'à 60 %, C — jusqu'à 85 %, D — le reste.

Qualité et prix note en vertical, prix combiné (3 parts d'entrée pour 1 de sortie) en horizontal, USD par million de tokens
1 000 1 200 1 400 1 600 0,01 $US 0,10 $US 1 $US 10 $US 100 $US Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Ce que mesure ce classement

Le tableau reprend l'arène texte de LMArena, catégorie générale. Le principe est simple : un internaute envoie une question, reçoit deux réponses de modèles anonymes et vote pour celle qu'il préfère. L'ensemble de ces duels est converti en une note de type Elo, comme aux échecs. La note traduit donc la préférence des utilisateurs de l'arène, surtout sur des questions en anglais. Elle ne mesure ni la vitesse, ni le coût, ni la performance sur une tâche précise, et un modèle bien noté peut décevoir sur votre cas d'usage.

Lire une ligne du tableau

  • Tier et note : la barre représente l'intervalle de confiance à 95 %. Quand les intervalles de deux modèles se chevauchent, l'écart n'est pas statistiquement net, ce qui explique que plusieurs modèles partagent le tier du haut.
  • Prix : le tarif le plus bas trouvé chez les fournisseurs pour ce modèle le jour des données, en USD, par million de tokens en entrée et en sortie, avec la tendance sur 30 jours.
  • Contexte, éditeur, poids ouverts : la taille de la fenêtre de contexte et la mention « Poids ouverts » pour les modèles téléchargeables.
  • Détails : un clic sur la ligne affiche les fournisseurs du moins cher au plus cher, les modalités, la sortie maximale, le nombre de votes, le rang chez la source, la licence et les dates de sortie et de connaissances.

Un modèle qui n'a pas encore 300 votes est marqué « Pas encore de tier ».

Filtrer, calculer, comparer

Les filtres permettent d'afficher uniquement les modèles à poids ouverts, les modèles gratuits, ceux à « Petit prix » (ici, un prix combiné inférieur à 1 USD par million de tokens) ou un éditeur donné. Le calculateur « Coût par mois » estime la facture à partir de votre volume de tokens et de la part d'entrée. Le graphique « Qualité et prix » place chaque modèle selon sa note et son prix combiné, calculé sur la base de 3 parts d'entrée pour 1 part de sortie. Enfin, la case « Comparer » permet de sélectionner jusqu'à 4 modèles pour la page de comparaison.

Les limites des prix affichés

Le prix d'un fournisseur peut différer de celui de l'éditeur du modèle. Les remises pour le cache, le traitement par lots ou les prix régionaux ne figurent pas dans le tableau. Pour les notes, la source est LMArena ; pour les prix, le contexte et les modalités, models.dev et LiteLLM. Quand un modèle figure dans notre catalogue, un lien mène à l'application à télécharger.