NVIDIA · tous les modèles ›

NNemotron 3.5 Lightning (free)OPEN

NVIDIA Nemotron 3.5 Lightning est un modèle ouvert mixture-of-experts de NVIDIA, avec 3B paramètres actifs sur 30B au total.

1MFenêtre de contexte · tokens
FreePrix d'entrée · par M tokens
FreePrix de sortie · par M tokens
NVIDIAFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Nemotron 3.5 Lightning (gratuit), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.

35×
Plus d'intelligence par dollar que Claude Opus 5 (Fast).
Pour le même budget, Nemotron 3.5 Lightning (gratuit) offre 35 fois plus de capacité. Les open weights signifient également que vous pouvez l'auto-héberger et ne rien payer par jeton.
Intelligence index23.6
Coding index26.8
GPQA74.3%
Humanity's Last Exam10.6%
Long Context Reasoning55.3%
SciCode31.6%
τ-Bench Banking8.9%
Terminal-Bench24.3%
⚡ Speed298.9 tokens/sec
⏱ Latency0.79s to first token
💰 Blended price$0.108 / 1M tokens
📈 Value218.5 intelligence points per $
vs. modèles mesurés icitop 59%
Scores plus élevés que 41% des 273 modèles mesurés par Artificial Analysis et suivis ici.
Données de benchmark par Artificial Analysis

À propos de ce modèle

Nemotron 3.5 Lightning (gratuit) est un modèle d'IA open-weight de NVIDIA. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les tarifs publics de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Nemotron 3.5 Lightning (gratuit) ?

Nemotron 3.5 Lightning (free) est un modèle de langage IA de NVIDIA. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 23.6 sur l'indice d'intelligence d'Artificial Analysis.

Nemotron 3.5 Lightning (gratuit) est-il gratuit ?

Les poids sont libres et ouverts — vous pouvez auto-héberger Nemotron 3.5 Lightning (gratuit) et ne rien payer par token. Si vous préférez une API hébergée, les tarifs sont de Gratuit par million de tokens en entrée et Gratuit par million de tokens en sortie.

Dans quoi Nemotron 3.5 Lightning (gratuit) excelle-t-il ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 74.3%, Humanity's Last Exam 10.6%, Long Context Reasoning 55.3%, SciCode 31.6%, τ-Bench Banking 8.9%, Terminal-Bench 24.3%. Il est particulièrement utilisé pour génération de code.

À quelle vitesse fonctionne Nemotron 3.5 Lightning (gratuit) ?

Il génère environ 298.9 tokens par seconde, avec un délai médian 0.79s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Nemotron 3.5 Lightning (gratuit) ?

Oui. Nemotron 3.5 Lightning (gratuit) a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans aucun coût par token.

Modèles associés

Nemotron 3 Ultra (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA