Tarification en direct par token pour chaque modèle majeur — propriétaire et à poids ouverts — en un seul endroit. Voir les coûts d'un coup d'œil dans le graphique, calculer votre facture mensuelle, comparer les modèles côte à côte, et découvrir ce que le même travail coûterait à exécuter sur votre propre matériel : pour les modèles à poids ouverts, rien d'autre que l'électricité.
Tarification tirée de données en direct · suivies dans le temps · olud.ai
Les barres sont à l'échelle du modèle le plus cher affiché. Moins c'est moins cher.
Chaque prix ci-dessus est ce qu'un fournisseur facture pour exécuter un modèle pour vous. Mais les modèles à poids ouvert — DeepSeek, Llama, Qwen, Mistral, Gemma — sont gratuits à télécharger et à exécuter sur votre propre GPU. Après le matériel, le coût marginal par token est essentiellement l'électricité. Pour des charges de travail stables et à fort volume, cela change complètement les calculs.
Pour chaque modèle payant populaire, voici le modèle à poids ouvert vers lequel les gens se tournent, et où en savoir plus :
Méthode. Les prix sont par million de tokens, extraits de l'API OpenRouter et actualisés quotidiennement. Les poids de coût « mélangés » pour l'entrée et la sortie sont de 3:1, un proxy numérique commun. Le coût d'auto-hébergement est marginal (électricité) et exclut le matériel — les chiffres réels dépendent de votre GPU, de l'utilisation et du prix de l'électricité. L'historique des mouvements de prix est enregistré depuis le lancement, donc la section des mouvements se remplira au cours des prochaines semaines.
Les prix vous indiquent ce qu'un modèle coûte. Le classement vous dit s'il est bon — modèles à poids ouverts classés par utilisation dans le monde réel.
Ouvrir le classement →