NVIDIA

NNemotron 3 Ultra (free)OPEN

Nemotron 3 Ultra (free) (NVIDIA): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.

Fenêtre de contexte
1M
tokens
Prix d'entrée
Free
par M tokens
Prix de sortie
Free
par M tokens
Fournisseur
NVIDIA

Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Nemotron 3 Ultra (gratuit), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.

5.3×
Plus d'intelligence par dollar que Claude Opus 5.
Pour le même budget, Nemotron 3 Ultra (gratuit) offre 5,3 fois plus de capacités. Les poids ouverts signifient également que vous pouvez l'héberger vous-même et ne rien payer par jeton.
Intelligence index37.8
Coding index49.3
GPQA86.7%
Humanity's Last Exam26.6%
Long Context Reasoning67%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking13.8%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed205.3 tokens/sec
⏱ Latency0.93s to first token
💰 Blended price$1.175 / 1M tokens
📈 Value32.2 intelligence points per $
Données de benchmark par Artificial Analysis

À propos de ce modèle

Nemotron 3 Ultra (gratuit) est un modèle d'IA à poids ouverts de NVIDIA. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont des prix de liste d'API hébergées, suivis à l'heure, pour les moments où vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Nemotron 3 Ultra (gratuit) ?

Nemotron 3 Ultra (free) est un modèle de langage IA de NVIDIA. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 37.8 sur l'indice d'intelligence d'Artificial Analysis.

Nemotron 3 Ultra (free) est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Ultra (free) et ne rien payer par token. Si vous préférez une API hébergée, les prix sont gratuits par million de tokens d'entrée et gratuits par million de tokens de sortie.

À quoi est bon Nemotron 3 Ultra (gratuit) ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de Nemotron 3 Ultra (gratuit) ?

Il génère environ 205.3 tokens par seconde, avec un délai médian 0.93s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Nemotron 3 Ultra (free) ?

Oui. Nemotron 3 Ultra (free) a des poids ouverts, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Alternatives open-source

Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.

Nemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 UltraNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIANemotron 3 SuperNVIDIA