gpt-oss-120b es un modelo de lenguaje de open-weight y 117B de parámetros Mixture-of-Experts (MoE) de OpenAI diseñado para casos de uso de producción de razonamiento alto, agente y propósito general.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para gpt-oss-120b, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: high.
gpt-oss-120b es un modelo de IA open-weight de OpenAI. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el autoalojamiento.
gpt-oss-120b es un modelo de lenguaje de IA de OpenAI. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 24.1 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes autoalojar gpt-oss-120b y no pagar nada por token. Si prefieres una API alojada, los precios son $0.04 por millón de tokens de entrada y $0.17 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 78.2%, MMLU-Pro 80.8%, Humanity's Last Exam 19.6%, Long Context Reasoning 51%, LiveCodeBench 87.8%, SciCode 38.9%, AIME 2025 93.4%, IFBench 69%, τ²-Bench 65.8%, τ-Bench Banking 12.8%, Terminal-Bench 26.2%, Terminal-Bench Hard 23.5%. Se utiliza particularmente para generación de código.
Genera aproximadamente 167.3 tokens por segundo, con una mediana 0.53s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. gpt-oss-120b tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.