NVIDIA Nemotron 3 Super es un modelo híbrido MoE de 120B parámetros, activando solo 12B de parámetros para máxima eficiencia computacional y precisión en aplicaciones complejas de múltiples agentes.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Nemotron 3 Super, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: Reasoning.
Nemotron 3 Super es un modelo de IA open-weight de NVIDIA. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.
Nemotron 3 Super es un modelo de lenguaje de IA de NVIDIA. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 25.7 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes alojar Nemotron 3 Super tú mismo y no pagar nada por token. Si prefieres una API alojada, los precios son $0.08 por millón de tokens de entrada y $0.4 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 80%, Humanity's Last Exam 20.8%, Long Context Reasoning 60.3%, SciCode 36%, IFBench 71.5%, τ²-Bench 67.8%, τ-Bench Banking 10.3%, Terminal-Bench 38.6%, Terminal-Bench Hard 28.8%. Se utiliza particularmente para generación de código.
Genera aproximadamente 144.2 tokens por segundo, con una mediana 1.11s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Nemotron 3 Super tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.