NVIDIA Nemotron 3 Super ist ein 120B-Parameter offenes hybrides MoE-Modell, das nur 12B Parameter aktiviert, um maximale Recheneffizienz und Genauigkeit in komplexen Multi-Agenten-Anwendungen zu gewährleisten.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Nemotron 3 Super, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.
Nemotron 3 Super ist ein Open-Weight-KI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.
Nemotron 3 Super ist ein KI-Sprachmodell von NVIDIA. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 25.7 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Super selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.08 pro Million Eingabetokens und $0.4 pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 80%, Humanity's Last Exam 20.8%, Long Context Reasoning 60.3%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.3%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 144.2 Tokens pro Sekunde, mit einer Median 1.11s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Nemotron 3 Super hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.