NVIDIA

NNemotron 3 Ultra (free)OPEN

Nemotron 3 Ultra (free) (NVIDIA): preços da API ao vivo, janela de contexto e as melhores alternativas de código aberto, monitoradas diariamente pelo OpenSourceAI.tech.

Janela de contexto
1M
tokens
Preço de entrada
Free
por M tokens
Preço de saída
Free
por M tokens
Fornecedor
NVIDIA

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Nemotron 3 Ultra (gratuito), medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning.

5.3×
Mais inteligência por dólar do que Claude Opus 5.
Com o mesmo orçamento, o Nemotron 3 Ultra (gratuito) oferece 5,3 vezes mais capacidade. Pesos abertos também significam que você pode hospedá-lo e não pagar nada por token.
Intelligence index37.8
Coding index49.3
GPQA86.7%
Humanity's Last Exam26.6%
Long Context Reasoning67%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking13.8%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed205.3 tokens/sec
⏱ Latency0.93s to first token
💰 Blended price$1.175 / 1M tokens
📈 Value32.2 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

Nemotron 3 Ultra (gratuito) é um modelo de IA de peso aberto da NVIDIA. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são preços de lista de API hospedada, rastreados a cada hora, para quando você prefere conveniência em vez de auto-hospedagem.

Perguntas frequentes

O que é o Nemotron 3 Ultra (gratuito)?

Nemotron 3 Ultra (free) é um modelo de linguagem de IA da NVIDIA. Ele é de peso aberto: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 37.8 no índice de inteligência Artificial Analysis.

O Nemotron 3 Ultra (free) é gratuito?

Os pesos são gratuitos e abertos — você pode auto-hospedar o Nemotron 3 Ultra (free) e não pagar nada por token. Se preferir uma API hospedada, os preços são Gratuito por milhão de tokens de entrada e Gratuito por milhão de tokens de saída.

Para que serve o Nemotron 3 Ultra (gratuito)?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. É particularmente usado para geração de código.

Quão rápido é o Nemotron 3 Ultra (gratuito)?

Ele gera cerca de 205.3 tokens por segundo, com uma mediana 0.93s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso auto-hospedar o Nemotron 3 Ultra (free)?

Sim. O Nemotron 3 Ultra (free) tem pesos abertos, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Alternativas de código aberto

Dependendo da sua carga de trabalho, um modelo de peso aberto que você pode auto-hospedar pode reduzir os custos drasticamente ou eliminar completamente a cobrança por token. Nossas páginas de comparação colocam este modelo lado a lado com os concorrentes de código aberto mais fortes.

Nemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 UltraNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIANemotron 3 SuperNVIDIA