NVIDIA Nemotron 3.5 Lightning est un modèle ouvert mixture-of-experts de NVIDIA, avec 3B paramètres actifs sur 30B au total.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Nemotron 3.5 Lightning (gratuit), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Nemotron 3.5 Lightning (gratuit) est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les tarifs publics de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.
Nemotron 3.5 Lightning (free) est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 23.6 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont libres et ouverts — vous pouvez auto-héberger Nemotron 3.5 Lightning (gratuit) et ne rien payer par token. Si vous préférez une API hébergée, les tarifs sont de Gratuit par million de tokens en entrée et Gratuit par million de tokens en sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 74.3%, Humanity's Last Exam 10.6%, Long Context Reasoning 55.3%, SciCode 31.6%, τ-Bench Banking 8.9%, Terminal-Bench 24.3%. Il est particulièrement utilisé pour génération de code.
Il génère environ 298.9 tokens par seconde, avec un délai médian 0.79s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Nemotron 3.5 Lightning (gratuit) a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans aucun coût par token.