NVIDIA · tutti i modelli ›

NNemotron 3 Ultra (free)OPEN

NVIDIA Nemotron 3 Ultra è un modello di ragionamento e orchestrazione open frontier di NVIDIA, con 55B parametri attivi su 550B totali (MoE).

1MFinestra di contesto · token
FreePrezzo di input · per M token
FreePrezzo di output · per M token
NVIDIAFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Nemotron 3 Ultra (gratuito), misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.

5.3×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5 (Fast).
Per lo stesso budget, Nemotron 3 Ultra (free) offre 5.3 volte più capacità. Gli open weights significano anche che può essere self-hosted e non pagare nulla per token.
Intelligence index38.3
Coding index49.3
GPQA86.7%
Humanity's Last Exam28.4%
Long Context Reasoning71%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking14.2%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed172.5 tokens/sec
⏱ Latency1.2s to first token
💰 Blended price$1.137 / 1M tokens
📈 Value33.7 intelligence points per $
vs. modelli misurati quitop 31%
Punteggi superiori a 69% dei 273 modelli misurati da Artificial Analysis e tracciati qui.
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Nemotron 3 Ultra (free) è un modello AI open-weight di NVIDIA. È possibile scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono i listini delle API ospitate, aggiornati giornalmente, per quando si preferisce la comodità rispetto al self-hosting.

Domande frequenti

Che cos'è Nemotron 3 Ultra (gratuito)?

Nemotron 3 Ultra (free) è un modello di linguaggio AI di NVIDIA. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 38.3 sull'indice di intelligenza Artificial Analysis.

Nemotron 3 Ultra (free) è gratuito?

I pesi sono gratuiti e aperti — puoi ospitare autonomamente Nemotron 3 Ultra (free) e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono Gratuiti per milione di token in input e Gratuiti per milione di token in output.

A cosa serve Nemotron 3 Ultra (gratuito)?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Nemotron 3 Ultra (gratuito)?

Genera circa 172.5 token al secondo, con una mediana 1.2s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare autonomamente Nemotron 3 Ultra (free)?

Sì. Nemotron 3 Ultra (free) ha open weights, quindi può scaricarlo ed eseguirlo sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Modelli correlati

Nemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA