Nemotron 3 Ultra (NVIDIA): prezzi API live, finestra di contesto e le migliori alternative open-source, monitorate quotidianamente da OpenSourceAI.tech.
I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.
Punteggi di benchmark indipendenti per Nemotron 3 Ultra, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Nemotron 3 Ultra è un modello AI a peso aperto di NVIDIA. Puoi scaricarlo e ospitarlo autonomamente gratuitamente; i prezzi qui sotto sono i prezzi di lista delle API ospitate, monitorati ogni ora, per quando preferisci la comodità all'auto-ospitamento.
Nemotron 3 Ultra è un modello di linguaggio AI di NVIDIA. È a peso aperto: puoi scaricarlo ed eseguirlo sul tuo hardware, gratuitamente. Ottiene 37.8 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare Nemotron 3 Ultra da solo e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono $0.5 per milione di token di input e $2.2 per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.
Genera circa 205.3 token al secondo, con una mediana 0.93s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Nemotron 3 Ultra ha pesi aperti, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.
A seconda del tuo carico di lavoro, un modello a peso aperto che puoi ospitare autonomamente potrebbe ridurre drasticamente i costi o rimuovere completamente la tariffazione per token. Le nostre pagine di confronto mettono questo modello a confronto con i più forti contendenti open-source.