NVIDIA Nemotron 3 Super è un modello MoE ibrido aperto da 120B parametri, attivando solo 12B parametri per massima efficienza computazionale e accuratezza in applicazioni multi-agente complesse.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Nemotron 3 Super (gratuito), misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Nemotron 3 Super (free) è un modello AI open-weight di NVIDIA. È possibile scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono i listini delle API ospitate, aggiornati giornalmente, per quando si preferisce la comodità rispetto al self-hosting.
Nemotron 3 Super (free) è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 25.7 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare autonomamente Nemotron 3 Super (free) e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono Gratuiti per milione di token in input e Gratuiti per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 80%, Humanity's Last Exam 20.8%, Long Context Reasoning 60.3%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.3%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. È particolarmente utilizzato per generazione di codice.
Genera circa 144.2 token al secondo, con una mediana 1.11s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Nemotron 3 Super (free) ha open weights, quindi può scaricarlo ed eseguirlo sul suo GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.