NVIDIA Nemotron 3 Ultra è un modello di ragionamento e orchestrazione open frontier di NVIDIA, con 55B parametri attivi su 550B totali (MoE).
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Artificial Analysis misura 273 dei 383 modelli tracciati qui — questo non è ancora coperto. La posizione di prezzo sopra è misurata su tutto il catalogo e non dipende dai benchmark.
Nemotron 3 Ultra (batch) è un modello AI open-weight di NVIDIA. Puoi scaricarlo e ospitarlo da solo (self-host) gratuitamente; i prezzi qui sotto sono i prezzi di listino delle API ospitate, monitorati quotidianamente, per quando preferisci la comodità rispetto al self-hosting.
Nemotron 3 Ultra (batch) è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente.
I pesi sono gratuiti e aperti: puoi eseguire Nemotron 3 Ultra (batch) in self-hosted senza pagare nulla per token. Se preferisci un'API hosted, i prezzi di listino sono $0,6 per milione di token in input e $3,6 per milione di token in output.
Sì. Nemotron 3 Ultra (batch) ha pesi aperti (open weights), quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.