NVIDIA · alle Modelle ›

NNemotron 3 Ultra (batch)OPEN

NVIDIA Nemotron 3 Ultra ist ein offenes Frontier-Reasoning- und Orchestrierungsmodell von NVIDIA mit 55B aktiven Parametern von insgesamt 550B (MoE).

512KKontextfenster · Tokens
$0.6Eingabepreis · pro M Tokens
$3.6Ausgabepreis · pro M Tokens
NVIDIAAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks

Artificial Analysis misst 273 der 383 Modelle, die hier verfolgt werden — dieses ist noch nicht abgedeckt. Die oben angegebene Preisposition wird über den gesamten Katalog gemessen und hängt nicht von Benchmarks ab.

Über dieses Modell

Nemotron 3 Ultra (batch) ist ein Open-Weight-KI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die unten stehenden Preise sind Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist Nemotron 3 Ultra (batch)?

Nemotron 3 Ultra (batch) ist ein KI-Sprachmodell von NVIDIA. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen.

Ist Nemotron 3 Ultra (batch) kostenlos?

Die Gewichte sind frei und offen – Sie können Nemotron 3 Ultra (batch) selbst hosten und zahlen nichts pro Token. Falls Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,6 $ pro Million Input-Token und 3,6 $ pro Million Output-Token.

Kann ich Nemotron 3 Ultra (batch) selbst hosten?

Ja. Nemotron 3 Ultra (batch) hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können – ohne Kosten pro Token.

Verwandte Modelle

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIA