NVIDIA Nemotron 3 Ultra è un modello di ragionamento e orchestrazione open frontier di NVIDIA, con 55B parametri attivi su 550B totali (MoE).
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Nemotron 3 Ultra (gratuito), misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Nemotron 3 Ultra (free) è un modello AI open-weight di NVIDIA. È possibile scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono i listini delle API ospitate, aggiornati giornalmente, per quando si preferisce la comodità rispetto al self-hosting.
Nemotron 3 Ultra (free) è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 38.3 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare autonomamente Nemotron 3 Ultra (free) e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono Gratuiti per milione di token in input e Gratuiti per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.
Genera circa 172.5 token al secondo, con una mediana 1.2s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Nemotron 3 Ultra (free) ha open weights, quindi può scaricarlo ed eseguirlo sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.