Qwen3-Next-80B-A3B-Thinking es un modelo de chat centrado en el razonamiento en la línea Qwen3-Next que produce trazas de “pensamiento” estructuradas por defecto.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Qwen3 Next 80B A3B Thinking, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: Reasoning.
Qwen3 Next 80B A3B Thinking es un modelo de IA open-weight de Alibaba. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de hosted-API, rastreados diariamente, para cuando prefiera la comodidad sobre el self-hosting.
Qwen3 Next 80B A3B Thinking es un modelo de lenguaje de IA de Alibaba. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 16.9 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos — puedes autoalojar Qwen3 Next 80B A3B Thinking y no pagar nada por token. Si prefieres una API alojada, los precios de lista son $0.15 por millón de tokens de entrada y $1.2 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 75.9%, MMLU-Pro 82.4%, Humanity's Last Exam 12.6%, Long Context Reasoning 62%, LiveCodeBench 78.4%, SciCode 38.8%, AIME 2025 84.3%, IFBench 60.7%, τ²-Bench 41.5%, τ-Bench Banking 6.2%, Terminal-Bench 6.7%, Terminal-Bench Hard 9.8%. Se utiliza particularmente para generación de código.
Genera aproximadamente 180.7 tokens por segundo, con una mediana 1.09s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Qwen3 Next 80B A3B Thinking tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.