Le même travail coûte 245× plus cher selon le modèle que vous choisissez
Les prix de sortie pour 190 modèles d'IA vont de $0.03 à $15.00 par million de tokens. Sur un mois de travail d'agent ordinaire, cela représente une différence entre six cents et treize dollars cinquante — pour une sortie que la plupart des équipes ne comparent jamais.
TL;DR — la version courte
Les prix de sortie pour les 190 modèles que nous suivons vont de 0,03 $ à 15,00 $ par million de tokens — un écart de 500×. La médiane est de 0,87 $.
Pour une charge de travail concrète — 2 millions de tokens d'entrée et 500 000 tokens de sortie, environ un mois chargé d'utilisation d'agent — la facture va de 6 cents à 13,50 $. Même tâche, 245× le prix.
Treize modèles ne coûtent rien du tout, et 59 se situent en dessous de cinquante cents. L'extrémité chère est presque vide : exactement deux modèles coûtent plus de 10 $.
Les tarifs des modèles sont indiqués par million de tokens, une unité pour laquelle personne n'a d'intuition. Ainsi, les chiffres glissent : 0,60 $ et 6,00 $ se lisent tous deux comme “assez bon marché”, et vous choisissez en fonction des scores de benchmark ou du dernier nom que vous avez vu.
Voici ce que coûte cette habitude.
Un écart de 500×, sur la même étagère
Parmi les 190 modèles commerciaux que nous tarifons, la sortie va de 0,03 $ par million de tokens (Mistral Nemo) à $15.00 (Kimi K3). La médiane est de 0,87 $.
Ce ne sont pas des produits différents comme le sont un vélo et une voiture. Ce sont toutes des API texte-entrée, texte-sortie, la plupart géreront parfaitement votre tâche de résumé, et elles se côtoient dans le même menu déroulant, quel que soit le framework que vous utilisez.
Où les modèles se regroupent réellement
La forme mérite un second regard. Le marché a un gros ventre à 1–3 $ — c'est là que 59 modèles se font concurrence, et où atterrissent la plupart des valeurs par défaut. En dessous se trouve une population nombreuse et silencieuse : 72 modèles tarifés sous un dollar, treize d'entre eux gratuits.
Au-dessus de 3 $, l'étagère se vide rapidement. Vingt modèles entre 3 $ et 10 $, et exactement deux au-dessus : Kimi K3 à 15,00 $ et Command R+ de Cohere’s à 10,00 $.
À quoi cela ressemble sur une facture réelle
La tarification par million ne devient réelle que lorsqu'on la rattache à du travail. Prenez un mois d'utilisation modérée d'agent : 2 millions de tokens d'entrée et 500 000 tokens de sortie — quelques milliers de résumés de documents, ou un développeur utilisant régulièrement un assistant de codage.
| Modèle | Fournisseur | Ce mois coûte |
|---|---|---|
| Mistral Nemo | Mistral AI | $0.06 |
| Llama 3.1 8B Instruct | Meta | $0.14 |
| le modèle médian | — | $0.97 |
| Qwen3.6 Max Preview | Alibaba | $5.68 |
| Kimi K3 | Moonshot AI | $13.50 |
Six cents contre treize dollars cinquante. Si cette charge de travail est une fonctionnalité produit pour dix mille utilisateurs, les deux mêmes lignes sont 600 $ contre 135 000 $.
Trois habitudes qui coûtent de l'argent sans raison
- Un seul modèle pour tout. La classification, le routage, l'extraction et le formatage ne sont pas du raisonnement. Les envoyer à un modèle phare, c'est payer des prix de raisonnement pour un travail de recherche.
- Ignorer la séparation entrée/sortie. Le coût de la sortie est généralement trois à cinq fois celui de l'entrée. Une requête demandant un document réécrit plutôt qu'un diff peut discrètement multiplier la facture.
- Ne jamais revérifier. Nous enregistrons des centaines de changements de prix par semaine. Le modèle que vous avez évalué en mars peut coûter le double — ou la moitié — de celui qui le côtoie aujourd'hui.
Comment choisir sans tableur
Triez par prix, filtrez par la fenêtre de contexte dont vous avez réellement besoin, et commencez par le bas plutôt que par le haut. Exécutez vos véritables requêtes sur le modèle le moins cher qui pourrait fonctionner, puis remontez seulement lorsqu'il échoue visiblement. La plupart des équipes s'arrêtent deux ou trois échelons en dessous de leur point de départ.
Notre model leaderboard liste les 190 modèles avec les tarifs en direct d'entrée et de sortie, les fenêtres de contexte et la prise en charge des appels d'outils, et les pages head-to-head mettent deux modèles côte à côte. Tout est gratuit à lire et aucun compte n'est nécessaire.
Méthode
190 modèles commerciaux avec des tarifs publiés, collectés depuis les pages de prix des fournisseurs via OpenRouter et mis à jour quotidiennement ; les chiffres ici sont ceux du 7 août 2026. Les prix sont en dollars américains par million de tokens. “Gratuit” signifie un prix de sortie nul sur le niveau gratuit que le fournisseur publie — ces niveaux comportent des limites de débit que nous ne modélisons pas.
L'exemple mensuel est un calcul arithmétique sur les prix de liste : 2 × prix d'entrée plus 0.5 × prix de sortie. Il ignore les réductions de cache, la tarification par lot et les accords d'utilisation engagée, qui influencent tous les factures réelles. Les modèles open-weight auto-hébergés sont exclus ici car leur coût est matériel, pas des tokens — pour ceux-ci, consultez notre local AI pages.