NVIDIA

NNemotron 3 UltraOPEN

Nemotron 3 Ultra (NVIDIA): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
512K
Tokens
Eingabepreis
$0.5
pro M Tokens
Ausgabepreis
$2.2
pro M Tokens
Anbieter
NVIDIA

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Nemotron 3 Ultra, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.

5.3×
Mehr Intelligenz pro Dollar als Claude Opus 5.
Für dasselbe Budget bietet Nemotron 3 Ultra 5,3-mal mehr Leistung. Offene Gewichte bedeuten auch, dass Sie es selbst hosten können und nichts pro Token zahlen müssen.
Intelligence index37.8
Coding index49.3
GPQA86.7%
Humanity's Last Exam26.6%
Long Context Reasoning67%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking13.8%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed205.3 tokens/sec
⏱ Latency0.93s to first token
💰 Blended price$1.175 / 1M tokens
📈 Value32.2 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Nemotron 3 Ultra ist ein Open-Weight-AI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die untenstehenden Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist Nemotron 3 Ultra?

Nemotron 3 Ultra ist ein KI-Sprachmodell von NVIDIA. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 37.8 im Artificial Analysis Intelligenzindex.

Ist Nemotron 3 Ultra kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Ultra selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.5 pro Million Eingabetokens und $2.2 pro Million Ausgabetokens.

Worin ist Nemotron 3 Ultra gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Nemotron 3 Ultra?

Es generiert etwa 205.3 Tokens pro Sekunde, mit einer Median 0.93s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Nemotron 3 Ultra selbst hosten?

Ja. Nemotron 3 Ultra hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

Nemotron 3 Ultra (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIANemotron 3 SuperNVIDIA