NVIDIA Nemotron 3 Super est un modèle hybride MoE à 120B de paramètres, activant seulement 12B de paramètres pour une efficacité de calcul maximale et une précision dans des applications multi-agents complexes.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Nemotron 3 Super, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Nemotron 3 Super est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Nemotron 3 Super est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 25.7 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Super et ne rien payer par jeton. Si vous préférez une API hébergée, les prix affichés sont de 0,08 $ par million de jetons d'entrée et de 0,4 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 80%, Humanity's Last Exam 20.8%, Long Context Reasoning 60.3%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.3%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. Il est particulièrement utilisé pour génération de code.
Il génère environ 144.2 tokens par seconde, avec un délai médian 1.11s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Nemotron 3 Super a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.