NVIDIA Nemotron 3 Nano 30B A3B ist ein kleines Sprach-MoE-Modell mit höchster Recheneffizienz und Genauigkeit, um Entwicklern zu helfen, spezialisierte agentische KI-Systeme zu erstellen.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Nemotron 3 Nano 30B A3B, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.
Nemotron 3 Nano 30B A3B ist ein Open-Weight-KI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die unten angegebenen Preise sind die täglich aktualisierten Listenpreise der gehosteten APIs, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.
Nemotron 3 Nano 30B A3B ist ein KI-Sprachmodell von NVIDIA. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 14.5 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Nano 30B A3B selbst hosten und nichts pro Token zahlen. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.05 pro Million Eingabetokens und $0.2 pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 75.7%, MMLU-Pro 79.4%, Humanity's Last Exam 11.4%, Long Context Reasoning 37.3%, LiveCodeBench 74.1%, SciCode 29.6%, AIME 2025 91%, IFBench 71.1%, τ²-Bench 40.9%, τ-Bench Banking 6%, Terminal-Bench 6.7%, Terminal-Bench Hard 13.6%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 236.8 Tokens pro Sekunde, mit einer Median 0.68s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Nemotron 3 Nano 30B A3B hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.