NVIDIA Nemotron 3 Ultra est un modèle de raisonnement et d'orchestration à la frontière ouverte de NVIDIA, avec 55B de paramètres actifs sur 550B au total (MoE).
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Artificial Analysis mesure 273 des 383 modèles suivis ici — celui-ci n'est pas encore couvert. La position tarifaire ci-dessus est mesurée sur l'ensemble du catalogue et ne dépend pas des référentiels.
Nemotron 3 Ultra (batch) est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.
Nemotron 3 Ultra (batch) est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement.
Les poids sont libres et ouverts — vous pouvez auto-héberger Nemotron 3 Ultra (batch) et ne rien payer par jeton. Si vous préférez une API hébergée, les prix indiqués sont de 0,6 $ par million de jetons en entrée et 3,6 $ par million de jetons en sortie.
Oui. Nemotron 3 Ultra (batch) a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.