NVIDIA Nemotron 3 Ultra è un modello di ragionamento e orchestrazione open frontier di NVIDIA, con 55B parametri attivi su 550B totali (MoE).
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Nemotron 3 Ultra, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Nemotron 3 Ultra è un modello AI open-weight di NVIDIA. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.
Nemotron 3 Ultra è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 38.3 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare Nemotron 3 Ultra da solo e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono $0.5 per milione di token di input e $2.2 per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.
Genera circa 172.5 token al secondo, con una mediana 1.2s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Nemotron 3 Ultra ha open weights, quindi può scaricarlo ed eseguirlo sul suo GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.