NVIDIA

NNemotron 3 UltraOPEN

Nemotron 3 Ultra (NVIDIA): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.

Fenêtre de contexte
512K
tokens
Prix d'entrée
$0.5
par M tokens
Prix de sortie
$2.2
par M tokens
Fournisseur
NVIDIA

Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Nemotron 3 Ultra, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.

5.3×
Plus d'intelligence par dollar que Claude Opus 5.
Pour le même budget, Nemotron 3 Ultra offre 5.3 fois plus de capacité. Les poids ouverts signifient également que vous pouvez l'héberger vous-même et ne rien payer par jeton.
Intelligence index37.8
Coding index49.3
GPQA86.7%
Humanity's Last Exam26.6%
Long Context Reasoning67%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking13.8%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed205.3 tokens/sec
⏱ Latency0.93s to first token
💰 Blended price$1.175 / 1M tokens
📈 Value32.2 intelligence points per $
Données de benchmark par Artificial Analysis

À propos de ce modèle

Nemotron 3 Ultra est un modèle d'IA à poids ouverts de NVIDIA. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont des prix de liste d'API hébergées, suivis à l'heure, pour les moments où vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Nemotron 3 Ultra ?

Nemotron 3 Ultra est un modèle de langage IA de NVIDIA. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 37.8 sur l'indice d'intelligence d'Artificial Analysis.

Nemotron 3 Ultra est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Ultra et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,5 $ par million de jetons d'entrée et de 2,2 $ par million de jetons de sortie.

Qu'est-ce que Nemotron 3 Ultra sait faire ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de Nemotron 3 Ultra ?

Il génère environ 205.3 tokens par seconde, avec un délai médian 0.93s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Nemotron 3 Ultra ?

Oui. Nemotron 3 Ultra a des poids ouverts, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Alternatives open-source

Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.

Nemotron 3 Ultra (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIANemotron 3 SuperNVIDIA