Qwen3-Max-Thinking é o modelo de raciocínio principal da série Qwen3, projetado para tarefas cognitivas de alto risco que exigem raciocínio profundo e de múltiplas etapas.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para Qwen3 Max Thinking, medidas pela Artificial Analysis. Quanto maior, melhor.
Qwen3 Max Thinking é um modelo de IA open-weight da Alibaba. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de hosted-API, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Qwen3 Max Thinking é um modelo de linguagem de IA da Alibaba. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 32.5 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode hospedar o Qwen3 Max Thinking e não pagar nada por token. Se preferir uma API hospedada, os preços são $0.78 por milhão de tokens de entrada e $3.9 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 86.1%, Humanity's Last Exam 28%, Long Context Reasoning 70.3%, SciCode 43.1%, IFBench 70.7%, τ²-Bench 83.6%, Terminal-Bench Hard 24.2%.
Sim. Qwen3 Max Thinking possui open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.