NVIDIA

NNemotron 3 SuperOPEN

Nemotron 3 Super (NVIDIA): preços da API ao vivo, janela de contexto e as melhores alternativas de código aberto, monitoradas diariamente pelo OpenSourceAI.tech.

Janela de contexto
1M
tokens
Preço de entrada
$0.08
por M tokens
Preço de saída
$0.4
por M tokens
Fornecedor
NVIDIA

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para o Nemotron 3 Super, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning.

12×
Mais inteligência por dólar do que Claude Opus 5.
Com o mesmo orçamento, o Nemotron 3 Super oferece 12 vezes mais capacidade. Pesos abertos também significam que você pode auto-hospedá-lo e não pagar nada por token.
Intelligence index25.4
Coding index37.7
GPQA80%
Humanity's Last Exam19.2%
Long Context Reasoning60%
SciCode36%
IFBench71.5%
τ²-Bench67.8%
τ-Bench Banking10.1%
Terminal-Bench38.6%
Terminal-Bench Hard28.8%
⚡ Speed146.8 tokens/sec
⏱ Latency1s to first token
💰 Blended price$0.35 / 1M tokens
📈 Value72.6 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

Nemotron 3 Super é um modelo de IA de peso aberto da NVIDIA. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são preços de lista de API hospedada, rastreados por hora, para quando você prefere conveniência em vez de auto-hospedagem.

Perguntas frequentes

O que é o Nemotron 3 Super?

Nemotron 3 Super é um modelo de linguagem de IA da NVIDIA. Ele é de peso aberto: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 25.4 no índice de inteligência Artificial Analysis.

O Nemotron 3 Super é gratuito?

Os pesos são gratuitos e abertos — você pode auto-hospedar o Nemotron 3 Super e não pagar nada por token. Se preferir uma API hospedada, os preços listados são $0.08 por milhão de tokens de entrada e $0.4 por milhão de tokens de saída.

Para que serve o Nemotron 3 Super?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 80%, Humanity's Last Exam 19.2%, Long Context Reasoning 60%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.1%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. É particularmente usado para geração de código.

Quão rápido é o Nemotron 3 Super?

Ele gera cerca de 146.8 tokens por segundo, com uma mediana 1s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso hospedar o Nemotron 3 Super?

Sim. O Nemotron 3 Super possui pesos abertos, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Alternativas de código aberto

Dependendo da sua carga de trabalho, um modelo de peso aberto que você pode auto-hospedar pode reduzir os custos drasticamente ou eliminar completamente a cobrança por token. Nossas páginas de comparação colocam este modelo lado a lado com os concorrentes de código aberto mais fortes.

Nemotron 3 Ultra (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 UltraNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIA