NVIDIA Nemotron 3 Nano 30B A3B est un petit modèle MoE de langage avec la plus haute efficacité de calcul et précision pour les développeurs souhaitant construire des systèmes d'IA agentiques spécialisés.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Nemotron 3 Nano 30B A3B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Nemotron 3 Nano 30B A3B est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et le self-hosted gratuitement ; les prix ci-dessous sont les prix de liste des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Nemotron 3 Nano 30B A3B est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 14.5 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Nano 30B A3B et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,05 $ par million de jetons d'entrée et de 0,2 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 75.7%, MMLU-Pro 79.4%, Humanity's Last Exam 11.4%, Long Context Reasoning 37.3%, LiveCodeBench 74.1%, SciCode 29.6%, AIME 2025 91%, IFBench 71.1%, τ²-Bench 40.9%, τ-Bench Banking 6%, Terminal-Bench 6.7%, Terminal-Bench Hard 13.6%. Il est particulièrement utilisé pour génération de code.
Il génère environ 236.8 tokens par seconde, avec un délai médian 0.68s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Nemotron 3 Nano 30B A3B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.