NVIDIA · todos los modelos ›

NNemotron 3 UltraOPEN

NVIDIA Nemotron 3 Ultra es un modelo de razonamiento y orquestación de frontera abierta de NVIDIA, con 55B de parámetros activos de un total de 550B (MoE).

262KVentana de contexto · tokens
$0.5Precio de entrada · por M tokens
$2.2Precio de salida · por M tokens
NVIDIAProveedor

Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Puntuaciones de referencia y rendimiento

Puntuaciones de referencia independientes para Nemotron 3 Ultra, medidas por Artificial Analysis. Cuanto más alto, mejor. Modo de medición: Reasoning.

5.3×
Más inteligencia por dólar que Claude Opus 5 (Fast).
Con el mismo presupuesto, Nemotron 3 Ultra ofrece 5.3 veces más capacidad. Los open weights también significan que puede autoalojarlo y no pagar nada por token.
Intelligence index38.3
Coding index49.3
GPQA86.7%
Humanity's Last Exam28.4%
Long Context Reasoning71%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking14.2%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed172.5 tokens/sec
⏱ Latency1.2s to first token
💰 Blended price$1.137 / 1M tokens
📈 Value33.7 intelligence points per $
vs. modelos medidos aquítop 31%
Puntuaciones más altas que el 69% de los 273 modelos medidos por Artificial Analysis y rastreados aquí.
Los modelos en este nivel cuestan $1.56 por 1M de tokens (mediana de 23) — este cuesta $0.93.
Más barato y mejor en este índice: GLM 5.3 Flash · Gemini 3.7 Flash · Gemini 3.7 Flash (batch) y 19 más
Datos de referencia por Artificial Analysis

Acerca de este modelo

Nemotron 3 Ultra es un modelo de IA open-weight de NVIDIA. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.

Preguntas frecuentes

¿Qué es Nemotron 3 Ultra?

Nemotron 3 Ultra es un modelo de lenguaje de IA de NVIDIA. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 38.3 en el índice de inteligencia Artificial Analysis.

¿Es Nemotron 3 Ultra gratis?

Los pesos son gratuitos y abiertos — puedes autoalojar Nemotron 3 Ultra y no pagar nada por token. Si prefieres una API alojada, los precios son $0.5 por millón de tokens de entrada y $2.2 por millón de tokens de salida.

¿En qué es bueno Nemotron 3 Ultra?

Los benchmarks independientes de Artificial Analysis le dan GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Se utiliza particularmente para generación de código.

¿Qué tan rápido es Nemotron 3 Ultra?

Genera aproximadamente 172.5 tokens por segundo, con una mediana 1.2s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.

¿Puedo autoalojar Nemotron 3 Ultra?

Sí. Nemotron 3 Ultra tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.

Modelos relacionados

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 SuperNVIDIA