NVIDIA Nemotron 3 Super è un modello MoE ibrido aperto da 120B parametri, attivando solo 12B parametri per massima efficienza computazionale e accuratezza in applicazioni multi-agente complesse.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Nemotron 3 Super, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Nemotron 3 Super è un modello AI open-weight di NVIDIA. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.
Nemotron 3 Super è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 25.7 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare Nemotron 3 Super autonomamente e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0.08 per milione di token in ingresso e $0.4 per milione di token in uscita.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 80%, Humanity's Last Exam 20.8%, Long Context Reasoning 60.3%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.3%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. È particolarmente utilizzato per generazione di codice.
Genera circa 144.2 token al secondo, con una mediana 1.11s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Nemotron 3 Super ha open weights, quindi può essere scaricato e eseguito sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.