NVIDIA Nemotron 3 Super ist ein 120B-Parameter offenes hybrides MoE-Modell, das nur 12B Parameter aktiviert, um maximale Recheneffizienz und Genauigkeit in komplexen Multi-Agenten-Anwendungen zu gewährleisten.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Nemotron 3 Super (kostenlos), gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.
Nemotron 3 Super (free) ist ein open-weight KI-Modell von NVIDIA. Sie können es kostenlos herunterladen und self-hosted betreiben; die unten aufgeführten Preise sind die Listenpreise der gehosteten API, die täglich aktualisiert werden, für den Fall, dass Sie den Komfort dem Self-Hosting vorziehen.
Nemotron 3 Super (free) ist ein KI-Sprachmodell von NVIDIA. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 25.7 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Super (free) selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei kostenlos pro Million Eingabetokens und kostenlos pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 80%, Humanity's Last Exam 20.8%, Long Context Reasoning 60.3%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.3%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 144.2 Tokens pro Sekunde, mit einer Median 1.11s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Nemotron 3 Super (kostenlos) hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.