NVIDIA Nemotron 3 Nano 30B A3B è un piccolo modello MoE linguistico con la massima efficienza computazionale e precisione per sviluppatori che vogliono costruire sistemi AI agentici specializzati.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Nemotron 3 Nano 30B A3B, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Nemotron 3 Nano 30B A3B è un modello AI open-weight di NVIDIA. Può scaricarlo e self-hostarlo gratuitamente; i prezzi sotto sono prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisce la comodità al self-hosting.
Nemotron 3 Nano 30B A3B è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 14.5 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare Nemotron 3 Nano 30B A3B autonomamente e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0.05 per milione di token in input e $0.2 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 75.7%, MMLU-Pro 79.4%, Humanity's Last Exam 11.4%, Long Context Reasoning 37.3%, LiveCodeBench 74.1%, SciCode 29.6%, AIME 2025 91%, IFBench 71.1%, τ²-Bench 40.9%, τ-Bench Banking 6%, Terminal-Bench 6.7%, Terminal-Bench Hard 13.6%. È particolarmente utilizzato per generazione di codice.
Genera circa 236.8 token al secondo, con una mediana 0.68s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Nemotron 3 Nano 30B A3B ha open weights, quindi può essere scaricato e eseguito sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.