Modèles AI · Tarification

Modèle AI Tarification

Tarification en direct par token pour chaque modèle majeur — propriétaire et à poids ouverts — en un seul endroit. Voir les coûts d'un coup d'œil dans le graphique, calculer votre facture mensuelle, comparer les modèles côte à côte, et découvrir ce que le même travail coûterait à exécuter sur votre propre matériel : pour les modèles à poids ouverts, rien d'autre que l'électricité.

Tarification tirée de données en direct · suivies dans le temps · olud.ai

Calculatrice de coût mensuelEntrez votre volume de tokens — les coûts se mettent à jour en direct et classent les moins chers en premier.

Prix en un coup d'œilModèles les moins chers par coût moyen (entrée + sortie pondéré 3:1). Poids ouvert en vert.

Poids ouvertPropriétaire
Chargement du graphique…

Les barres sont à l'échelle du modèle le plus cher affiché. Moins c'est moins cher.

Chaque modèle, chaque prixPar million de tokens. Cochez les cases pour comparer les modèles côte à côte. Les poids “mélangés” pondèrent l'entrée/sortie 3:1.

Comparer

Chargement des prix en direct…

Coût de l'API contre le fait de l'exécuter vous-mêmeLa partie que personne d'autre ne montre : les modèles à poids ouvert coûtent environ ~$0 par token une fois que vous les hébergez.

Chaque prix ci-dessus est ce qu'un fournisseur facture pour exécuter un modèle pour vous. Mais les modèles à poids ouvert — DeepSeek, Llama, Qwen, Mistral, Gemma — sont gratuits à télécharger et à exécuter sur votre propre GPU. Après le matériel, le coût marginal par token est essentiellement l'électricité. Pour des charges de travail stables et à fort volume, cela change complètement les calculs.

Pour chaque modèle payant populaire, voici le modèle à poids ouvert vers lequel les gens se tournent, et où en savoir plus :

Exécutez des modèles ouverts vous-mêmeGratuit n'est vraiment gratuit que si vous pouvez réellement l'exécuter. Voici les outils pour le faire — guides complets sur chacun.

Mouvements de prix récentsLes fournisseurs réduisent constamment les prix. Nous enregistrons un instantané quotidien et mettons en avant les changements.

Chargement de l'historique des prix…

Continuez à explorer

Méthode. Les prix sont par million de tokens, extraits de l'API OpenRouter et actualisés quotidiennement. Les poids de coût « mélangés » pour l'entrée et la sortie sont de 3:1, un proxy numérique commun. Le coût d'auto-hébergement est marginal (électricité) et exclut le matériel — les chiffres réels dépendent de votre GPU, de l'utilisation et du prix de l'électricité. L'historique des mouvements de prix est enregistré depuis le lancement, donc la section des mouvements se remplira au cours des prochaines semaines.

Vous voulez aussi le côté capacité ?

Les prix vous indiquent ce qu'un modèle coûte. Le classement vous dit s'il est bon — modèles à poids ouverts classés par utilisation dans le monde réel.

Ouvrir le classement →
sélectionné — Comparer ↑