NVIDIA · todos los modelos ›

NNemotron 3 Ultra (batch)OPEN

NVIDIA Nemotron 3 Ultra es un modelo de razonamiento y orquestación de frontera abierta de NVIDIA, con 55B de parámetros activos de un total de 550B (MoE).

512KVentana de contexto · tokens
$0.6Precio de entrada · por M tokens
$3.6Precio de salida · por M tokens
NVIDIAProveedor

Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Referencias

Artificial Analysis mide 273 de los 383 modelos rastreados aquí — este aún no está cubierto. La posición de precios anterior se mide a través de todo el catálogo y no depende de las referencias.

Acerca de este modelo

Nemotron 3 Ultra (batch) es un modelo de IA open-weight de NVIDIA. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la comodidad sobre el self-hosting.

Preguntas frecuentes

¿Qué es Nemotron 3 Ultra (batch)?

Nemotron 3 Ultra (batch) es un modelo de lenguaje de IA de NVIDIA. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita.

¿Es Nemotron 3 Ultra (batch) gratuito?

Los pesos son gratuitos y abiertos: puede autoalojar Nemotron 3 Ultra (batch) y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.6 por millón de tokens de entrada y $3.6 por millón de tokens de salida.

¿Puedo alojar yo mismo (self-host) Nemotron 3 Ultra (batch)?

Sí. Nemotron 3 Ultra (batch) tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.

Modelos relacionados

Nemotron 3 Ultra (free)NVIDIANemotron 3.5 Lightning (free)NVIDIANemotron 3 Super (free)NVIDIANemotron 3 UltraNVIDIANemotron 3.5 LightningNVIDIANemotron 3 Nano Omni (free)NVIDIA