O mesmo trabalho custa 245× mais dependendo de qual modelo você escolher
Os preços de saída em 190 modelos de IA variam de $0,03 a $15,00 por milhão de tokens. Em um mês de trabalho comum de agente, essa é a diferença entre seis centavos e treze dólares e cinquenta centavos — para uma saída que a maioria das equipes nunca compara.
TL;DR — a versão curta
Os preços de saída nos 190 modelos que monitoramos variam de $0,03 a $15,00 por milhão de tokens — uma diferença de 500×. A mediana é $0,87.
Em uma carga de trabalho concreta — 2 milhões de tokens de entrada e 500.000 tokens de saída, aproximadamente um mês movimentado de uso de agente — a conta varia de 6 centavos a $13,50. Mesma tarefa, 245× o preço.
Treze modelos não custam nada, e 59 custam menos de cinquenta centavos. O extremo caro está quase vazio: exatamente dois modelos custam mais de $10.
A precificação de modelos é cotada por milhão de tokens, que é uma unidade pela qual ninguém tem intuição. Então os números passam despercebidos: $0,60 e $6,00 ambos parecem “barato o suficiente”, e você escolhe com base em pontuações de benchmark ou no nome que viu por último.
Aqui está o que esse hábito custa.
Uma diferença de 500×, na mesma prateleira
Nos 190 modelos comerciais que precificamos, a saída varia de $0,03 por milhão de tokens (Mistral Nemo) a $15.00 (Kimi K3). A mediana é $0,87.
Estes não são produtos diferentes como uma bicicleta e um carro são diferentes. São todos APIs de texto para texto, a maioria deles lidará perfeitamente bem com seu trabalho de sumarização, e eles ficam lado a lado no mesmo menu suspenso em qualquer framework que você estiver usando.
Onde os modelos realmente se agrupam
Vale a pena dar uma segunda olhada na forma. O mercado tem um meio gordo em $1–3 — é onde 59 modelos competem, e onde a maioria dos padrões se encontra. Abaixo dele, há uma população grande e silenciosa: 72 modelos com preço abaixo de um dólar, treze deles gratuitos.
Acima de $3, a prateleira esvazia rápido. Vinte modelos entre $3 e $10, e precisamente dois acima: Kimi K3 a $15,00 e Cohere’s Command R+ a $10,00.
Como é na conta real
A precificação por milhão só se torna real quando você a aplica ao trabalho. Pegue um mês de uso moderado de agente: 2 milhões de tokens de entrada e 500.000 tokens de saída — alguns milhares de resumos de documentos, ou um desenvolvedor usando um assistente de codificação regularmente.
| Modelo | Fornecedor | Esse mês custa |
|---|---|---|
| Mistral Nemo | Mistral AI | $0.06 |
| Llama 3.1 8B Instruct | Meta | $0.14 |
| o modelo mediano | — | $0.97 |
| Qwen3.6 Max Preview | Alibaba | $5.68 |
| Kimi K3 | Moonshot AI | $13.50 |
Seis centavos contra treze dólares e cinquenta centavos. Se essa carga de trabalho for um recurso de produto rodando para dez mil usuários, as mesmas duas linhas são $600 contra $135.000.
Três hábitos que custam dinheiro sem motivo
- Um modelo para tudo. Classificação, roteamento, extração e formatação não são raciocínio. Enviá-los para um modelo topo de linha é pagar preços de raciocínio por trabalho de consulta.
- Ignorar a divisão entre entrada e saída. A saída geralmente custa de três a cinco vezes a entrada. Um prompt que pede um documento reescrito em vez de um diff pode multiplicar silenciosamente a conta.
- Nunca verificar novamente. Registramos centenas de mudanças de preço por semana. O modelo que você avaliou em março pode estar com o dobro do preço — ou metade — do que está ao lado hoje.
Como escolher sem planilhas
Ordene por preço, filtre pela janela de contexto que você realmente precisa e comece de baixo para cima. Execute seus prompts reais no modelo mais barato que possa funcionar, e suba apenas quando ele falhar visivelmente. A maioria das equipes para dois ou três degraus abaixo de onde começaram.
Nossa model leaderboard lista todos os 190 com preços de entrada e saída em tempo real, janelas de contexto e suporte a chamadas de ferramentas, e o páginas head-to-head coloca quaisquer dois lado a lado. Tudo é gratuito para ler e não é necessário criar conta.
Método
190 modelos comerciais com preços de lista publicados, coletados das páginas de preços dos provedores via OpenRouter e atualizados diariamente; os números aqui são de 7 de agosto de 2026. Os preços são em dólares americanos por milhão de tokens. “Grátis” significa um preço de saída zero no nível gratuito que o provedor publica — esses níveis têm limites de taxa que não modelamos.
O exemplo mensal é aritmética sobre preços de lista: 2 × preço de entrada mais 0.5 × preço de saída. Ignora descontos de cache, preços em lote e acordos de uso comprometido, todos os quais alteram as contas reais. Modelos self-hosted open-weight são excluídos aqui porque seu custo é hardware, não tokens — para esses, veja nossas local AI páginas.