NVIDIA · tous les modèles ›

NNemotron 3.5 LightningOPEN

NVIDIA Nemotron 3.5 Lightning est un modèle ouvert mixture-of-experts de NVIDIA, avec 3B paramètres actifs sur 30B au total.

262KFenêtre de contexte · tokens
$0.08Prix d'entrée · par M tokens
$0.2Prix de sortie · par M tokens
NVIDIAFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Nemotron 3.5 Lightning, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.

35×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Nemotron 3.5 Lightning offre 35 fois plus de capacité. Les open weights signifient également que vous pouvez l'auto-héberger et ne rien payer par jeton.
Intelligence index23.6
Coding index26.8
GPQA74.3%
Humanity's Last Exam10.6%
Long Context Reasoning55.3%
SciCode31.6%
τ-Bench Banking8.9%
Terminal-Bench24.3%
⚡ Speed298.9 tokens/sec
⏱ Latency0.79s to first token
💰 Blended price$0.108 / 1M tokens
📈 Value218.5 intelligence points per $
vs. modèles mesurés icitop 59%
Scores plus élevés que 41% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Les modèles à ce niveau coûtent $0.56 par 1M de tokens (médiane de 13) — celui-ci coûte $0.11.
Moins cher et meilleur sur cet indice : DeepSeek V4 Flash 0731 · DeepSeek V4 Flash 0423 · Solar Pro 4 et 2 de plus
Données de benchmark par Artificial Analysis

À propos de ce modèle

Nemotron 3.5 Lightning est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les tarifs publics de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Nemotron 3.5 Lightning ?

Nemotron 3.5 Lightning est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 23.6 sur l'indice d'intelligence d'Artificial Analysis.

Nemotron 3.5 Lightning est-il gratuit ?

Les poids sont libres et ouverts — vous pouvez auto-héberger Nemotron 3.5 Lightning et ne rien payer par token. Si vous préférez une API hébergée, les prix catalogue sont de 0,08 $ par million de tokens d'entrée et 0,2 $ par million de tokens de sortie.

Dans quoi Nemotron 3.5 Lightning excelle-t-il ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 74.3%, Humanity's Last Exam 10.6%, Long Context Reasoning 55.3%, SciCode 31.6%, τ-Bench Banking 8.9%, Terminal-Bench 24.3%. Il est particulièrement utilisé pour génération de code.

À quelle vitesse fonctionne Nemotron 3.5 Lightning ?

Il génère environ 298.9 tokens par seconde, avec un délai médian 0.79s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Nemotron 3.5 Lightning ?

Oui. Nemotron 3.5 Lightning a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA