NVIDIA Nemotron 3.5 Lightning ist ein offenes Mixture-of-Experts-Modell von NVIDIA, mit 3B aktiven Parametern von insgesamt 30B.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Nemotron 3.5 Lightning, gemessen von Artificial Analysis. Höher ist besser.
Nemotron 3.5 Lightning ist ein Open-Weight-KI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die unten stehenden Preise sind täglich aktualisierte Listenpreise für gehostete APIs, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.
Nemotron 3.5 Lightning ist ein KI-Sprachmodell von NVIDIA. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 23.6 im Artificial Analysis Intelligenzindex.
Die Gewichte sind frei und offen — Sie können Nemotron 3.5 Lightning selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0,08 pro Million Input-Token und $0,2 pro Million Output-Token.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 74.3%, Humanity's Last Exam 10.6%, Long Context Reasoning 55.3%, SciCode 31.6%, τ-Bench Banking 8.9%, Terminal-Bench 24.3%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 298.9 Tokens pro Sekunde, mit einer Median 0.79s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Nemotron 3.5 Lightning hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können – ohne Kosten pro Token.