NVIDIA Nemotron™ 3 Nano Omni est un modèle multimodal ouvert de 30B-A3B conçu pour fonctionner comme un sous-agent de perception et de contexte dans les systèmes d'agents d'entreprise.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Nemotron 3 Nano Omni (gratuit), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Nemotron 3 Nano Omni (free) est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Nemotron 3 Nano Omni (free) est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 15 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Nemotron 3 Nano Omni (gratuit) et ne rien payer par token. Si vous préférez une API hébergée, les prix sont gratuits par million de tokens d'entrée et gratuits par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 46.9%, Humanity's Last Exam 4.8%, Long Context Reasoning 40.7%, SciCode 27.8%, IFBench 63.2%, τ²-Bench 45.3%, Terminal-Bench 6.7%, Terminal-Bench Hard 8.3%. Il est particulièrement utilisé pour génération de code.
Il génère environ 331.9 tokens par seconde, avec un délai médian 0.56s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Nemotron 3 Nano Omni (gratuit) a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.