NVIDIA · alle Modelle ›

NNemotron 3 UltraOPEN

NVIDIA Nemotron 3 Ultra ist ein offenes Frontier-Reasoning- und Orchestrierungsmodell von NVIDIA mit 55B aktiven Parametern von insgesamt 550B (MoE).

262KKontextfenster · Tokens
$0.5Eingabepreis · pro M Tokens
$2.2Ausgabepreis · pro M Tokens
NVIDIAAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Nemotron 3 Ultra, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.

5.3×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für dasselbe Budget bietet Nemotron 3 Ultra 5,3-mal mehr Leistung. Open weights bedeuten auch, dass Sie es selbst hosten können und nichts pro Token zahlen müssen.
Intelligence index38.3
Coding index49.3
GPQA86.7%
Humanity's Last Exam28.4%
Long Context Reasoning71%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking14.2%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed172.5 tokens/sec
⏱ Latency1.2s to first token
💰 Blended price$1.137 / 1M tokens
📈 Value33.7 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 31%
Scores höher als 69% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $1.56 pro 1M Tokens (Median von 23) — dieses kostet $0.93.
Günstiger und besser in diesem Index: GLM 5.3 Flash · Gemini 3.7 Flash · Gemini 3.7 Flash (batch) und 19 mehr
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Nemotron 3 Ultra ist ein Open-Weight-KI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist Nemotron 3 Ultra?

Nemotron 3 Ultra ist ein KI-Sprachmodell von NVIDIA. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 38.3 im Artificial Analysis Intelligenzindex.

Ist Nemotron 3 Ultra kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Ultra selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.5 pro Million Eingabetokens und $2.2 pro Million Ausgabetokens.

Worin ist Nemotron 3 Ultra gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Nemotron 3 Ultra?

Es generiert etwa 172.5 Tokens pro Sekunde, mit einer Median 1.2s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Nemotron 3 Ultra selbst hosten?

Ja. Nemotron 3 Ultra hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA