Qwen3-Next-80B-A3B-Thinking é um modelo de chat com foco em raciocínio na linha Qwen3-Next que gera rastros de “pensamento” estruturados por padrão.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para Qwen3 Next 80B A3B Thinking, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning.
Qwen3 Next 80B A3B Thinking é um modelo de IA open-weight da Alibaba. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são os preços de lista da API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Qwen3 Next 80B A3B Thinking é um modelo de linguagem de IA da Alibaba. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 16.9 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode hospedar Qwen3 Next 80B A3B Thinking e não pagar nada por token. Se preferir uma API hospedada, os preços são $0,15 por milhão de tokens de entrada e $1,2 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 75.9%, MMLU-Pro 82.4%, Humanity's Last Exam 12.6%, Long Context Reasoning 62%, LiveCodeBench 78.4%, SciCode 38.8%, AIME 2025 84.3%, IFBench 60.7%, τ²-Bench 41.5%, τ-Bench Banking 6.2%, Terminal-Bench 6.7%, Terminal-Bench Hard 9.8%. É particularmente usado para geração de código.
Ele gera cerca de 180.7 tokens por segundo, com uma mediana 1.09s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. Qwen3 Next 80B A3B Thinking possui open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.