NVIDIA

NNemotron 3 Ultra (free)OPEN

Nemotron 3 Ultra (free) (NVIDIA): precios de API en vivo, ventana de contexto y las mejores alternativas de código abierto, rastreadas diariamente por OpenSourceAI.tech.

Ventana de contexto
1M
tokens
Precio de entrada
Free
por M tokens
Precio de salida
Free
por M tokens
Proveedor
NVIDIA

Los precios se actualizan automáticamente — verificados cada hora contra los precios de la lista del proveedor.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Puntuaciones de referencia y rendimiento

Puntuaciones de referencia independientes para Nemotron 3 Ultra (gratis), medidas por Artificial Analysis. Cuanto más alto, mejor. Modo de medición: Reasoning.

5.3×
Más inteligencia por dólar que Claude Opus 5.
Con el mismo presupuesto, Nemotron 3 Ultra (gratis) ofrece 5.3 veces más capacidad. Los pesos abiertos también significan que puedes autoalojarlo y no pagar nada por token.
Intelligence index37.8
Coding index49.3
GPQA86.7%
Humanity's Last Exam26.6%
Long Context Reasoning67%
SciCode39.9%
IFBench81.4%
τ²-Bench83.3%
τ-Bench Banking13.8%
Terminal-Bench53.9%
Terminal-Bench Hard36.4%
⚡ Speed205.3 tokens/sec
⏱ Latency0.93s to first token
💰 Blended price$1.175 / 1M tokens
📈 Value32.2 intelligence points per $
Datos de referencia por Artificial Analysis

Acerca de este modelo

Nemotron 3 Ultra (gratis) es un modelo de IA de peso abierto de NVIDIA. Puedes descargarlo y autoalojarlo de forma gratuita; los precios a continuación son precios de lista de API alojadas, rastreados por hora, para cuando prefieras la comodidad sobre el autoalojamiento.

Preguntas frecuentes

¿Qué es Nemotron 3 Ultra (gratis)?

Nemotron 3 Ultra (free) es un modelo de lenguaje de IA de NVIDIA. Es de pesos abiertos: puedes descargarlo y ejecutarlo en tu propio hardware, de forma gratuita. Obtiene 37.8 en el índice de inteligencia Artificial Analysis.

¿Es Nemotron 3 Ultra (gratis) gratuito?

Los pesos son gratuitos y abiertos: puedes autoalojar Nemotron 3 Ultra (gratis) y no pagar nada por token. Si prefieres una API alojada, los precios son gratuitos por millón de tokens de entrada y gratuitos por millón de tokens de salida.

¿En qué es bueno Nemotron 3 Ultra (gratis)?

Los benchmarks independientes de Artificial Analysis le dan GPQA 86.7%, Humanity's Last Exam 26.6%, Long Context Reasoning 67%, SciCode 39.9%, IFBench 81.4%, τ²-Bench 83.3%, τ-Bench Banking 13.8%, Terminal-Bench 53.9%, Terminal-Bench Hard 36.4%. Se utiliza particularmente para generación de código.

¿Qué tan rápido es Nemotron 3 Ultra (gratis)?

Genera aproximadamente 205.3 tokens por segundo, con una mediana 0.93s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.

¿Puedo autoalojar Nemotron 3 Ultra (gratis)?

Sí. Nemotron 3 Ultra (gratis) tiene pesos abiertos, por lo que puedes descargarlo y ejecutarlo en tu propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.

Alternativas de código abierto

Dependiendo de tu carga de trabajo, un modelo de peso abierto que puedes alojar tú mismo puede reducir costos drásticamente o eliminar por completo la fijación de precios por token. Nuestras páginas de comparación ponen este modelo lado a lado con los competidores de código abierto más fuertes.

Nemotron 3 Super (free)NVIDIANemotron 3 Nano 30B A3B (free)NVIDIANemotron 3 UltraNVIDIANemotron 3 Nano Omni (free)NVIDIANemotron 3 Nano 30B A3BNVIDIANemotron 3 SuperNVIDIA