Nemotron 3 Nano 30B A3B (NVIDIA): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.
Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.
Scores de référence indépendants pour Nemotron 3 Nano 30B A3B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Nemotron 3 Nano 30B A3B est un modèle d'IA à poids ouvert de NVIDIA. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont les prix de liste des API hébergées, suivis à l'heure, pour lorsque vous préférez la commodité à l'auto-hébergement.
Nemotron 3 Nano 30B A3B est un modèle de langage IA de NVIDIA. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 14.2 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Nano 30B A3B et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,05 $ par million de jetons d'entrée et de 0,2 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 75.7%, MMLU-Pro 79.4%, Humanity's Last Exam 10.2%, Long Context Reasoning 33.7%, LiveCodeBench 74.1%, SciCode 29.6%, AIME 2025 91%, IFBench 71.1%, τ²-Bench 40.9%, τ-Bench Banking 6%, Terminal-Bench 6.7%, Terminal-Bench Hard 13.6%. Il est particulièrement utilisé pour génération de code.
Il génère environ 201.1 tokens par seconde, avec un délai médian 0.77s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Nemotron 3 Nano 30B A3B a des poids ouverts, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.
Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.