NVIDIA Nemotron 3 Super est un modèle hybride MoE à 120B de paramètres, activant seulement 12B de paramètres pour une efficacité de calcul maximale et une précision dans des applications multi-agents complexes.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Nemotron 3 Super (gratuit), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Nemotron 3 Super (free) est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Nemotron 3 Super (free) est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 25.7 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Super (free) et ne rien payer par token. Si vous préférez une API hébergée, les prix sont gratuits par million de tokens d'entrée et gratuits par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 80%, Humanity's Last Exam 20.8%, Long Context Reasoning 60.3%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.3%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. Il est particulièrement utilisé pour génération de code.
Il génère environ 144.2 tokens par seconde, avec un délai médian 1.11s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Nemotron 3 Super (gratuit) a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.