NVIDIA Nemotron 3 Ultra es un modelo de razonamiento y orquestación de frontera abierta de NVIDIA, con 55B de parámetros activos de un total de 550B (MoE).
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Artificial Analysis mide 273 de los 383 modelos rastreados aquí — este aún no está cubierto. La posición de precios anterior se mide a través de todo el catálogo y no depende de las referencias.
Nemotron 3 Ultra (batch) es un modelo de IA open-weight de NVIDIA. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la comodidad sobre el self-hosting.
Nemotron 3 Ultra (batch) es un modelo de lenguaje de IA de NVIDIA. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita.
Los pesos son gratuitos y abiertos: puede autoalojar Nemotron 3 Ultra (batch) y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.6 por millón de tokens de entrada y $3.6 por millón de tokens de salida.
Sí. Nemotron 3 Ultra (batch) tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.