NVIDIA · tous les modèles ›

NNemotron 3 UltraOPEN

NVIDIA Nemotron 3 Ultra est un modèle de raisonnement et d'orchestration à la frontière ouverte de NVIDIA, avec 55B de paramètres actifs sur 550B au total (MoE).

262KFenêtre de contexte · tokens
$0.5Prix d'entrée · par M tokens
$2.2Prix de sortie · par M tokens
NVIDIAFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Nemotron 3 Ultra, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.

5.3×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Nemotron 3 Ultra offre 5.3 fois plus de capacités. Les open weights signifient également que vous pouvez l'auto-héberger et ne rien payer par jeton.
Intelligence index38.3
Coding index49.3
GPQA86.7%
Humanity's Last Exam28.4%
Long Context Reasoning71%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking14.2%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed172.5 tokens/sec
⏱ Latency1.2s to first token
💰 Blended price$1.137 / 1M tokens
📈 Value33.7 intelligence points per $
vs. modèles mesurés icitop 31%
Scores plus élevés que 69% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $1.56 par 1M de tokens (médiane de 23) — celui-ci coûte $0.93.
Moins cher et meilleur sur cet indice : GLM 5.3 Flash · Gemini 3.7 Flash · Gemini 3.7 Flash (batch) et 19 de plus
Données de benchmark par Artificial Analysis

À propos de ce modèle

Nemotron 3 Ultra est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Nemotron 3 Ultra ?

Nemotron 3 Ultra est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 38.3 sur l'indice d'intelligence d'Artificial Analysis.

Nemotron 3 Ultra est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Ultra et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,5 $ par million de jetons d'entrée et de 2,2 $ par million de jetons de sortie.

Qu'est-ce que Nemotron 3 Ultra sait faire ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de Nemotron 3 Ultra ?

Il génère environ 172.5 tokens par seconde, avec un délai médian 1.2s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Nemotron 3 Ultra ?

Oui. Nemotron 3 Ultra a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Modèles associés

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA