NVIDIA · tutti i modelli ›

NNemotron 3 UltraOPEN

NVIDIA Nemotron 3 Ultra è un modello di ragionamento e orchestrazione open frontier di NVIDIA, con 55B parametri attivi su 550B totali (MoE).

262KFinestra di contesto · token
$0.5Prezzo di input · per M token
$2.2Prezzo di output · per M token
NVIDIAFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Nemotron 3 Ultra, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.

5.3×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5 (Fast).
Con lo stesso budget, Nemotron 3 Ultra offre 5.3 volte più capacità. Gli open weights significano anche che può self-hostarlo e non pagare nulla per token.
Intelligence index38.3
Coding index49.3
GPQA86.7%
Humanity's Last Exam28.4%
Long Context Reasoning71%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking14.2%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed172.5 tokens/sec
⏱ Latency1.2s to first token
💰 Blended price$1.137 / 1M tokens
📈 Value33.7 intelligence points per $
vs. modelli misurati quitop 31%
Punteggi superiori a 69% dei 273 modelli misurati da Artificial Analysis e tracciati qui.
I modelli a questo livello costano $1.56 per 1M token (mediana di 23) — questo costa $0.93.
Più economico e migliore su questo indice: GLM 5.3 Flash · Gemini 3.7 Flash · Gemini 3.7 Flash (batch) e 19 in più
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Nemotron 3 Ultra è un modello AI open-weight di NVIDIA. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.

Domande frequenti

Che cos'è Nemotron 3 Ultra?

Nemotron 3 Ultra è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 38.3 sull'indice di intelligenza Artificial Analysis.

Nemotron 3 Ultra è gratuito?

I pesi sono gratuiti e aperti — puoi ospitare Nemotron 3 Ultra da solo e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono $0.5 per milione di token di input e $2.2 per milione di token di output.

A cosa serve Nemotron 3 Ultra?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Nemotron 3 Ultra?

Genera circa 172.5 token al secondo, con una mediana 1.2s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare Nemotron 3 Ultra da solo?

Sì. Nemotron 3 Ultra ha open weights, quindi può scaricarlo ed eseguirlo sul suo GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Modelli correlati

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA