NVIDIA Nemotron 3 Nano 30B A3B es un pequeño modelo MoE de lenguaje con la mayor eficiencia computacional y precisión para que los desarrolladores construyan sistemas de IA agenciales especializados.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Nemotron 3 Nano 30B A3B, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: Reasoning.
Nemotron 3 Nano 30B A3B es un modelo de IA open-weight de NVIDIA. Puede descargarlo y alojarlo usted mismo de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados diariamente, para cuando prefiera la comodidad sobre el autohospedaje.
Nemotron 3 Nano 30B A3B es un modelo de lenguaje de IA de NVIDIA. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 14.5 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes autoalojar Nemotron 3 Nano 30B A3B y no pagar nada por token. Si prefieres una API alojada, los precios son $0.05 por millón de tokens de entrada y $0.2 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 75.7%, MMLU-Pro 79.4%, Humanity's Last Exam 11.4%, Long Context Reasoning 37.3%, LiveCodeBench 74.1%, SciCode 29.6%, AIME 2025 91%, IFBench 71.1%, τ²-Bench 40.9%, τ-Bench Banking 6%, Terminal-Bench 6.7%, Terminal-Bench Hard 13.6%. Se utiliza particularmente para generación de código.
Genera aproximadamente 236.8 tokens por segundo, con una mediana 0.68s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Nemotron 3 Nano 30B A3B tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.