NVIDIA Nemotron 3 Ultra es un modelo de razonamiento y orquestación de frontera abierta de NVIDIA, con 55B de parámetros activos de un total de 550B (MoE).
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Nemotron 3 Ultra, medidas por Artificial Analysis. Cuanto más alto, mejor. Modo de medición: Reasoning.
Nemotron 3 Ultra es un modelo de IA open-weight de NVIDIA. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.
Nemotron 3 Ultra es un modelo de lenguaje de IA de NVIDIA. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 38.3 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes autoalojar Nemotron 3 Ultra y no pagar nada por token. Si prefieres una API alojada, los precios son $0.5 por millón de tokens de entrada y $2.2 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 86.7%, Humanity's Last Exam 28.4%, Long Context Reasoning 71%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 14.2%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Se utiliza particularmente para generación de código.
Genera aproximadamente 172.5 tokens por segundo, con una mediana 1.2s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Nemotron 3 Ultra tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.