Nemotron 3 Ultra (NVIDIA): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.
Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.
Unabhängige Benchmark-Ergebnisse für Nemotron 3 Ultra, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.
Nemotron 3 Ultra ist ein Open-Weight-AI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die untenstehenden Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.
Nemotron 3 Ultra ist ein KI-Sprachmodell von NVIDIA. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 37.8 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Ultra selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.5 pro Million Eingabetokens und $2.2 pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 205.3 Tokens pro Sekunde, mit einer Median 0.93s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Nemotron 3 Ultra hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.
Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.