NVIDIA · tous les modèles ›

NNemotron 3 Ultra (free)OPEN

NVIDIA Nemotron 3 Ultra est un modèle de raisonnement et d'orchestration à la frontière ouverte de NVIDIA, avec 55B de paramètres actifs sur 550B au total (MoE).

1MFenêtre de contexte · tokens
FreePrix d'entrée · par M tokens
FreePrix de sortie · par M tokens
NVIDIAFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Nemotron 3 Ultra (gratuit), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.

5.3×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Nemotron 3 Ultra (gratuit) offre 5,3 fois plus de capacité. Les open weights signifient également que vous pouvez l'auto-héberger et ne rien payer par token.
Intelligence index38.3
Coding index49.3
GPQA86.7%
Humanity's Last Exam28.4%
Long Context Reasoning71%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking14.2%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed172.5 tokens/sec
⏱ Latency1.2s to first token
💰 Blended price$1.137 / 1M tokens
📈 Value33.7 intelligence points per $
vs. modèles mesurés icitop 31%
Scores plus élevés que 69% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Données de benchmark par Artificial Analysis

À propos de ce modèle

Nemotron 3 Ultra (free) est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Nemotron 3 Ultra (gratuit) ?

Nemotron 3 Ultra (free) est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 38.3 sur l'indice d'intelligence d'Artificial Analysis.

Nemotron 3 Ultra (free) est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Ultra (free) et ne rien payer par token. Si vous préférez une API hébergée, les prix sont gratuits par million de tokens d'entrée et gratuits par million de tokens de sortie.

À quoi Nemotron 3 Ultra (gratuit) est-il bon ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de Nemotron 3 Ultra (gratuit) ?

Il génère environ 172.5 tokens par seconde, avec un délai médian 1.2s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Nemotron 3 Ultra (free) ?

Oui. Nemotron 3 Ultra (gratuit) a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

Nemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA