NVIDIA · tous les modèles ›

NNemotron 3 Ultra (batch)OPEN

NVIDIA Nemotron 3 Ultra est un modèle de raisonnement et d'orchestration à la frontière ouverte de NVIDIA, avec 55B de paramètres actifs sur 550B au total (MoE).

512KFenêtre de contexte · tokens
$0.6Prix d'entrée · par M tokens
$3.6Prix de sortie · par M tokens
NVIDIAFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Référentiels

Artificial Analysis mesure 273 des 383 modèles suivis ici — celui-ci n'est pas encore couvert. La position tarifaire ci-dessus est mesurée sur l'ensemble du catalogue et ne dépend pas des référentiels.

À propos de ce modèle

Nemotron 3 Ultra (batch) est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Nemotron 3 Ultra (batch) ?

Nemotron 3 Ultra (batch) est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement.

Nemotron 3 Ultra (batch) est-il gratuit ?

Les poids sont libres et ouverts — vous pouvez auto-héberger Nemotron 3 Ultra (batch) et ne rien payer par jeton. Si vous préférez une API hébergée, les prix indiqués sont de 0,6 $ par million de jetons en entrée et 3,6 $ par million de jetons en sortie.

Puis-je auto-héberger Nemotron 3 Ultra (batch) ?

Oui. Nemotron 3 Ultra (batch) a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIA