NVIDIA

NNemotron 3 UltraOPEN

Nemotron 3 Ultra (NVIDIA): prezzi API live, finestra di contesto e le migliori alternative open-source, monitorate quotidianamente da OpenSourceAI.tech.

Finestra di contesto
512K
token
Prezzo di input
$0.5
per M token
Prezzo di output
$2.2
per M token
Fornitore
NVIDIA

I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Nemotron 3 Ultra, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.

5.3×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5.
Con lo stesso budget, Nemotron 3 Ultra offre 5.3 volte più capacità. I pesi aperti significano anche che puoi ospitarlo autonomamente e non pagare nulla per token.
Intelligence index37.8
Coding index49.3
GPQA86.7%
Humanity's Last Exam26.6%
Long Context Reasoning67%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking13.8%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed205.3 tokens/sec
⏱ Latency0.93s to first token
💰 Blended price$1.175 / 1M tokens
📈 Value32.2 intelligence points per $
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Nemotron 3 Ultra è un modello AI a peso aperto di NVIDIA. Puoi scaricarlo e ospitarlo autonomamente gratuitamente; i prezzi qui sotto sono i prezzi di lista delle API ospitate, monitorati ogni ora, per quando preferisci la comodità all'auto-ospitamento.

Domande frequenti

Che cos'è Nemotron 3 Ultra?

Nemotron 3 Ultra è un modello di linguaggio AI di NVIDIA. È a peso aperto: puoi scaricarlo ed eseguirlo sul tuo hardware, gratuitamente. Ottiene 37.8 sull'indice di intelligenza Artificial Analysis.

Nemotron 3 Ultra è gratuito?

I pesi sono gratuiti e aperti — puoi ospitare Nemotron 3 Ultra da solo e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono $0.5 per milione di token di input e $2.2 per milione di token di output.

A cosa serve Nemotron 3 Ultra?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Nemotron 3 Ultra?

Genera circa 205.3 token al secondo, con una mediana 0.93s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare Nemotron 3 Ultra da solo?

Sì. Nemotron 3 Ultra ha pesi aperti, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Alternative open-source

A seconda del tuo carico di lavoro, un modello a peso aperto che puoi ospitare autonomamente potrebbe ridurre drasticamente i costi o rimuovere completamente la tariffazione per token. Le nostre pagine di confronto mettono questo modello a confronto con i più forti contendenti open-source.

Nemotron 3 Ultra (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIANemotron 3 SuperNVIDIA