NVIDIA · tutti i modelli ›

NNemotron 3 Ultra (batch)OPEN

NVIDIA Nemotron 3 Ultra è un modello di ragionamento e orchestrazione open frontier di NVIDIA, con 55B parametri attivi su 550B totali (MoE).

512KFinestra di contesto · token
$0.6Prezzo di input · per M token
$3.6Prezzo di output · per M token
NVIDIAFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark

Artificial Analysis misura 273 dei 383 modelli tracciati qui — questo non è ancora coperto. La posizione di prezzo sopra è misurata su tutto il catalogo e non dipende dai benchmark.

Informazioni su questo modello

Nemotron 3 Ultra (batch) è un modello AI open-weight di NVIDIA. Puoi scaricarlo e ospitarlo da solo (self-host) gratuitamente; i prezzi qui sotto sono i prezzi di listino delle API ospitate, monitorati quotidianamente, per quando preferisci la comodità rispetto al self-hosting.

Domande frequenti

Cos'è Nemotron 3 Ultra (batch)?

Nemotron 3 Ultra (batch) è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente.

Nemotron 3 Ultra (batch) è gratuito?

I pesi sono gratuiti e aperti: puoi eseguire Nemotron 3 Ultra (batch) in self-hosted senza pagare nulla per token. Se preferisci un'API hosted, i prezzi di listino sono $0,6 per milione di token in input e $3,6 per milione di token in output.

Posso ospitare Nemotron 3 Ultra (batch) da solo (self-host)?

Sì. Nemotron 3 Ultra (batch) ha pesi aperti (open weights), quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Modelli correlati

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIA