NVIDIA · todos os modelos ›

NNemotron 3 Nano 30B A3BOPEN

NVIDIA Nemotron 3 Nano 30B A3B é um pequeno modelo MoE de linguagem com a maior eficiência computacional e precisão para desenvolvedores construírem sistemas de IA agentes especializados.

262KJanela de contexto · tokens
$0.05Preço de entrada · por M tokens
$0.2Preço de saída · por M tokens
NVIDIAFornecedor

Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Nemotron 3 Nano 30B A3B, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning.

26×
Mais inteligência por dólar do que Claude Opus 5 (Fast).
Com o mesmo orçamento, o Nemotron 3 Nano 30B A3B oferece 26 vezes mais capacidade. Open weights também significam que você pode self-hosted e não pagar nada por token.
Intelligence index14.5
Coding index14.4
Math index91
GPQA75.7%
MMLU-Pro79.4%
Humanity's Last Exam11.4%
Long Context Reasoning37.3%
LiveCodeBench74.1%
SciCode29.6%
AIME 202591%
IFBench71.1%
τ²-Bench40.9%
τ-Bench Banking6%
Terminal-Bench6.7%
Terminal-Bench Hard13.6%
⚡ Speed236.8 tokens/sec
⏱ Latency0.68s to first token
💰 Blended price$0.088 / 1M tokens
📈 Value164.8 intelligence points per $
vs. modelos medidos aquitop 76%
Pontuações mais altas que 24% dos 273 modelos medidos pela Artificial Analysis e rastreados aqui.
Modelos neste nível custam $0.63 por 1M de tokens (mediana de 19) — este custa $0.09.
Mais barato e melhor neste índice: DeepSeek V4 Flash 0731 · Solar Pro 4 · Ling-3.0-flash e 3 a mais
Dados de benchmark por Artificial Analysis

Sobre este modelo

Nemotron 3 Nano 30B A3B é um modelo de IA open-weight da NVIDIA. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de API hospedada, monitorados diariamente, para quando você preferir conveniência ao self-hosting.

Perguntas frequentes

O que é o Nemotron 3 Nano 30B A3B?

Nemotron 3 Nano 30B A3B é um modelo de linguagem de IA da NVIDIA. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 14.5 no índice de inteligência Artificial Analysis.

O Nemotron 3 Nano 30B A3B é gratuito?

Os pesos são gratuitos e abertos — você pode hospedar o Nemotron 3 Nano 30B A3B e não pagar nada por token. Se preferir uma API hospedada, os preços são $0.05 por milhão de tokens de entrada e $0.2 por milhão de tokens de saída.

Para que serve o Nemotron 3 Nano 30B A3B?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 75.7%, MMLU-Pro 79.4%, Humanity's Last Exam 11.4%, Long Context Reasoning 37.3%, LiveCodeBench 74.1%, SciCode 29.6%, AIME 2025 91%, IFBench 71.1%, τ²-Bench 40.9%, τ-Bench Banking 6%, Terminal-Bench 6.7%, Terminal-Bench Hard 13.6%. É particularmente usado para geração de código.

Quão rápido é o Nemotron 3 Nano 30B A3B?

Ele gera cerca de 236.8 tokens por segundo, com uma mediana 0.68s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso hospedar o Nemotron 3 Nano 30B A3B eu mesmo?

Sim. O Nemotron 3 Nano 30B A3B tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Modelos relacionados

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIA