Alibaba

AQwen3 Next 80B A3B ThinkingOPEN

Qwen3 Next 80B A3B Thinking (Alibaba): preços da API ao vivo, janela de contexto e as melhores alternativas de código aberto, monitoradas diariamente pelo OpenSourceAI.tech.

Janela de contexto
262K
tokens
Preço de entrada
$0.15
por M tokens
Preço de saída
$1.2
por M tokens
Fornecedor
Alibaba

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Qwen3 Next 80B A3B Thinking, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning.

Intelligence index16.7
Coding index17.4
Math index84.3
GPQA75.9%
MMLU-Pro82.4%
Humanity's Last Exam11.7%
Long Context Reasoning60.3%
LiveCodeBench78.4%
SciCode38.8%
AIME 202584.3%
IFBench60.7%
τ²-Bench41.5%
τ-Bench Banking6.2%
Terminal-Bench6.7%
Terminal-Bench Hard9.8%
⚡ Speed213.5 tokens/sec
⏱ Latency1.15s to first token
💰 Blended price$1.875 / 1M tokens
📈 Value8.9 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

Qwen3 Next 80B A3B Thinking é um modelo de IA de peso aberto da Alibaba. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são preços de lista da API hospedada, monitorados por hora, para quando você prefere conveniência em vez de auto-hospedagem.

Perguntas frequentes

O que é Qwen3 Next 80B A3B Thinking?

Qwen3 Next 80B A3B Thinking é um modelo de linguagem de IA da Alibaba. Ele é de peso aberto: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 16.7 no índice de inteligência Artificial Analysis.

Qwen3 Next 80B A3B Thinking é gratuito?

Os pesos são gratuitos e abertos — você pode auto-hospedar o Qwen3 Next 80B A3B Thinking e não pagar nada por token. Se preferir uma API hospedada, os preços são $0.15 por milhão de tokens de entrada e $1.2 por milhão de tokens de saída.

Para que serve o Qwen3 Next 80B A3B Thinking?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 75.9%, MMLU-Pro 82.4%, Humanity's Last Exam 11.7%, Long Context Reasoning 60.3%, LiveCodeBench 78.4%, SciCode 38.8%, AIME 2025 84.3%, IFBench 60.7%, τ²-Bench 41.5%, τ-Bench Banking 6.2%, Terminal-Bench 6.7%, Terminal-Bench Hard 9.8%. É particularmente usado para geração de código.

Quão rápido é o Qwen3 Next 80B A3B Thinking?

Ele gera cerca de 213.5 tokens por segundo, com uma mediana 1.15s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Posso auto-hospedar Qwen3 Next 80B A3B Thinking?

Sim. Qwen3 Next 80B A3B Thinking tem pesos abertos, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Alternativas de código aberto

Dependendo da sua carga de trabalho, um modelo de peso aberto que você pode auto-hospedar pode reduzir os custos drasticamente ou eliminar completamente a cobrança por token. Nossas páginas de comparação colocam este modelo lado a lado com os concorrentes de código aberto mais fortes.

Qwen3.6 PlusAlibabaQwen3.7 PlusAlibabaQwen3.7 MaxAlibabaQwen3.5-FlashAlibabaQwen3.6 35B A3BAlibabaQwen3 235B A22B Instruct 2507Alibaba