NVIDIA

NNemotron 3 Ultra (free)OPEN

Nemotron 3 Ultra (free) (NVIDIA): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
1M
Tokens
Eingabepreis
Free
pro M Tokens
Ausgabepreis
Free
pro M Tokens
Anbieter
NVIDIA

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Nemotron 3 Ultra (kostenlos), gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.

5.3×
Mehr Intelligenz pro Dollar als Claude Opus 5.
Für dasselbe Budget bietet Nemotron 3 Ultra (kostenlos) 5,3-mal mehr Leistung. Offene Gewichte bedeuten auch, dass Sie es selbst hosten können und nichts pro Token zahlen müssen.
Intelligence index37.8
Coding index49.3
GPQA86.7%
Humanity's Last Exam26.6%
Long Context Reasoning67%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking13.8%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed205.3 tokens/sec
⏱ Latency0.93s to first token
💰 Blended price$1.175 / 1M tokens
📈 Value32.2 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Nemotron 3 Ultra (kostenlos) ist ein Open-Weight-AI-Modell von NVIDIA. Sie können es kostenlos herunterladen und selbst hosten; die untenstehenden Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist Nemotron 3 Ultra (kostenlos)?

Nemotron 3 Ultra (free) ist ein KI-Sprachmodell von NVIDIA. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 37.8 im Artificial Analysis Intelligenzindex.

Ist Nemotron 3 Ultra (free) kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Nemotron 3 Ultra (free) selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei kostenlos pro Million Eingabetokens und kostenlos pro Million Ausgabetokens.

Worin ist Nemotron 3 Ultra (kostenlos) gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Nemotron 3 Ultra (kostenlos)?

Es generiert etwa 205.3 Tokens pro Sekunde, mit einer Median 0.93s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Nemotron 3 Ultra (free) selbst hosten?

Ja. Nemotron 3 Ultra (free) hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

Nemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 UltraNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIANemotron 3 SuperNVIDIA