NVIDIA · tous les modèles ›

NNemotron 3 Nano 30B A3BOPEN

NVIDIA Nemotron 3 Nano 30B A3B est un petit modèle MoE de langage avec la plus haute efficacité de calcul et précision pour les développeurs souhaitant construire des systèmes d'IA agentiques spécialisés.

262KFenêtre de contexte · tokens
$0.05Prix d'entrée · par M tokens
$0.2Prix de sortie · par M tokens
NVIDIAFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Nemotron 3 Nano 30B A3B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.

26×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Nemotron 3 Nano 30B A3B offre 26 fois plus de capacité. Les open weights signifient également que vous pouvez l'auto-héberger et ne rien payer par token.
Intelligence index14.5
Coding index14.4
Math index91
GPQA75.7%
MMLU-Pro79.4%
Humanity's Last Exam11.4%
Long Context Reasoning37.3%
LiveCodeBench74.1%
SciCode29.6%
AIME 202591%
IFBench71.1%
τ²-Bench40.9%
τ-Bench Banking6%
Terminal-Bench6.7%
Terminal-Bench Hard13.6%
⚡ Speed236.8 tokens/sec
⏱ Latency0.68s to first token
💰 Blended price$0.088 / 1M tokens
📈 Value164.8 intelligence points per $
vs. modèles mesurés icitop 76%
Scores plus élevés que 24% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $0.63 par 1M de tokens (médiane de 19) — celui-ci coûte $0.09.
Moins cher et meilleur sur cet indice : DeepSeek V4 Flash 0731 · Solar Pro 4 · Ling-3.0-flash et 3 de plus
Données de benchmark par Artificial Analysis

À propos de ce modèle

Nemotron 3 Nano 30B A3B est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et le self-hosted gratuitement ; les prix ci-dessous sont les prix de liste des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Nemotron 3 Nano 30B A3B ?

Nemotron 3 Nano 30B A3B est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 14.5 sur l'indice d'intelligence d'Artificial Analysis.

Nemotron 3 Nano 30B A3B est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Nano 30B A3B et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,05 $ par million de jetons d'entrée et de 0,2 $ par million de jetons de sortie.

À quoi est bon Nemotron 3 Nano 30B A3B ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 75.7%, MMLU-Pro 79.4%, Humanity's Last Exam 11.4%, Long Context Reasoning 37.3%, LiveCodeBench 74.1%, SciCode 29.6%, AIME 2025 91%, IFBench 71.1%, τ²-Bench 40.9%, τ-Bench Banking 6%, Terminal-Bench 6.7%, Terminal-Bench Hard 13.6%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de Nemotron 3 Nano 30B A3B ?

Il génère environ 236.8 tokens par seconde, avec un délai médian 0.68s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Nemotron 3 Nano 30B A3B ?

Oui. Nemotron 3 Nano 30B A3B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIA