NVIDIA · alle Modelle ›

NNemotron 3 Ultra (free)OPEN

NVIDIA Nemotron 3 Ultra ist ein offenes Frontier-Reasoning- und Orchestrierungsmodell von NVIDIA mit 55B aktiven Parametern von insgesamt 550B (MoE).

1MKontextfenster · Tokens
FreeEingabepreis · pro M Tokens
FreeAusgabepreis · pro M Tokens
NVIDIAAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Nemotron 3 Ultra (kostenlos), gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.

5.3×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für dasselbe Budget bietet Nemotron 3 Ultra (kostenlos) 5,3-mal mehr Leistung. Open weights bedeuten auch, dass Sie es selbst hosten können und nichts pro Token bezahlen müssen.
Intelligence index38.3
Coding index49.3
GPQA86.7%
Humanity's Last Exam28.4%
Long Context Reasoning71%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking14.2%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed172.5 tokens/sec
⏱ Latency1.2s to first token
💰 Blended price$1.137 / 1M tokens
📈 Value33.7 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 31%
Scores höher als 69% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Nemotron 3 Ultra (free) ist ein open-weight KI-Modell von NVIDIA. Sie können es kostenlos herunterladen und self-hosted betreiben; die unten aufgeführten Preise sind die Listenpreise der gehosteten API, die täglich aktualisiert werden, für den Fall, dass Sie den Komfort dem Self-Hosting vorziehen.

Häufig gestellte Fragen

Was ist Nemotron 3 Ultra (kostenlos)?

Nemotron 3 Ultra (free) ist ein KI-Sprachmodell von NVIDIA. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 38.3 im Artificial Analysis Intelligenzindex.

Ist Nemotron 3 Ultra (free) kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Ultra (free) selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei kostenlos pro Million Eingabetokens und kostenlos pro Million Ausgabetokens.

Wofür ist Nemotron 3 Ultra (kostenlos) gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Nemotron 3 Ultra (kostenlos)?

Es generiert etwa 172.5 Tokens pro Sekunde, mit einer Median 1.2s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Nemotron 3 Ultra (free) selbst hosten?

Ja. Nemotron 3 Ultra (kostenlos) hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

Nemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA