NVIDIA

NNemotron Nano 12B 2 VL (free)OPEN

Nemotron Nano 12B 2 VL (free) (NVIDIA): preços da API ao vivo, janela de contexto e as melhores alternativas de código aberto, monitoradas diariamente pelo OpenSourceAI.tech.

Janela de contexto
128K
tokens
Preço de entrada
Free
por M tokens
Preço de saída
Free
por M tokens
Fornecedor
NVIDIA

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para o Nemotron Nano 12B 2 VL (gratuito), medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning.

4.9×
Mais inteligência por dólar do que Claude Opus 5.
Com o mesmo orçamento, o Nemotron Nano 12B 2 VL (grátis) oferece 4,9 vezes mais capacidade. Pesos abertos também significam que você pode hospedá-lo por conta própria e não pagar nada por token.
Intelligence index9
Math index75
GPQA57.2%
MMLU-Pro75.9%
Humanity's Last Exam5.3%
Long Context Reasoning40%
LiveCodeBench69.4%
SciCode26.2%
AIME 202575%
IFBench31.9%
τ²-Bench21.3%
Terminal-Bench Hard4.5%
⚡ Speed73.6 tokens/sec
⏱ Latency3.58s to first token
💰 Blended price$0.3 / 1M tokens
📈 Value30 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

Nemotron Nano 12B 2 VL (gratuito) é um modelo de IA de peso aberto da NVIDIA. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são preços de lista de API hospedada, rastreados por hora, para quando você prefere conveniência em vez de auto-hospedagem.

Perguntas frequentes

O que é o Nemotron Nano 12B 2 VL (grátis)?

Nemotron Nano 12B 2 VL (free) é um modelo de linguagem de IA da NVIDIA. Ele é de peso aberto: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 9 no índice de inteligência Artificial Analysis.

O Nemotron Nano 12B 2 VL (grátis) é gratuito?

Os pesos são gratuitos e abertos — você pode auto-hospedar o Nemotron Nano 12B 2 VL (grátis) e não pagar nada por token. Se preferir uma API hospedada, os preços são gratuitos por milhão de tokens de entrada e gratuitos por milhão de tokens de saída.

Para que serve o Nemotron Nano 12B 2 VL (gratuito)?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 57.2%, MMLU-Pro 75.9%, Humanity's Last Exam 5.3%, Long Context Reasoning 40%, LiveCodeBench 69.4%, SciCode 26.2%, AIME 2025 75%, IFBench 31.9%, τ²-Bench 21.3%, Terminal-Bench Hard 4.5%. É particularmente usado para raciocínio matemático.

Quão rápido é o Nemotron Nano 12B 2 VL (gratuito)?

Ele gera cerca de 73.6 tokens por segundo, com uma mediana 3.58s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso auto-hospedar o Nemotron Nano 12B 2 VL (grátis)?

Sim. O Nemotron Nano 12B 2 VL (grátis) tem pesos abertos, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Alternativas de código aberto

Dependendo da sua carga de trabalho, um modelo de peso aberto que você pode auto-hospedar pode reduzir os custos drasticamente ou eliminar completamente a cobrança por token. Nossas páginas de comparação colocam este modelo lado a lado com os concorrentes de código aberto mais fortes.

Nemotron 3 Ultra (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 UltraNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIA