Dois terços dos modelos de IA pagos são superados por um modelo mais barato do mesmo fornecedor
Dos 76 modelos fechados que precificamos e pontuamos, 50 são superados por outro modelo da mesma empresa que também custa menos — menos na entrada e menos na saída. Ninguém te envia um e-mail quando isso acontece.
TL;DR — a versão curta
50 dos 76 modelos fechados que rastreamos são dominados por um modelo semelhante. Mesmo fornecedor, pontuação de inteligência mais alta, preço mais baixo em tanto entrada quanto saída. Isso é 66 %.
A maior diferença é 20×. o1-pro ainda lista a $600 por milhão de tokens de saída. GPT-5.6 Solde, da mesma empresa, custa $30 e pontua 40 pontos a mais.
Seis dos 50 são superados pelo próprio modelo open-weight do fornecedor. A opção mais barata e melhor é uma que você pode baixar.
Uma lista de preços de API não é uma recomendação. É um arquivo. Os fornecedores adicionam modelos constantemente e quase nunca os aposentam, então o endpoint que você conectou há dezoito meses está na documentação ao lado de sua própria substituição, ao seu preço original, indefinidamente.
Nós precificamos e pontuamos cada modelo no catálogo todas as manhãs. Então fizemos uma pergunta mecânica sem espaço para opinião: para cada modelo pago, o mesmo fornecedor vende algo que pontua mais alto em nosso índice de inteligência e custa menos por milhão de tokens na entrada e na saída?
Não mais barato em média. Não melhor em um benchmark. Estritamente melhor e estritamente mais barato em todos os eixos ao mesmo tempo — o caso onde não há compromisso a discutir.
A resposta, em 2 de agosto de 2026: 50 de 76.
O caso 20×
A maior diferença no catálogo pertence à OpenAI. o1-pro ainda está listado a $150 na entrada e $600 na saída por milhão de tokens. GPT-5.6 Solde, do mesmo fornecedor, é $5 na entrada e $30 na saída — e pontua 58.9 em nosso índice de inteligência contra 18.9 do o1-pro.
Trinta vezes mais barato na entrada, vinte vezes mais barato na saída, quarenta pontos a mais. Não há carga de trabalho onde o o1-pro seja a resposta certa hoje, e ainda assim nada na página de preços da OpenAI diz isso.
Uma ressalva que devemos a você: o o1-pro não possui pontuação de codificação em nossos dados, então não fazemos nenhuma afirmação sobre sua capacidade de codificação. O índice de inteligência é o que medimos, e é sobre isso que a comparação se baseia.
Não é apenas a OpenAI
O padrão se mantém sempre que um fornecedor entrega rapidamente. Anthropic's Claude Opus 4.7 (Rápido) lista a $30 de entrada e $150 de saída. Claude Opus 5 custa $5 e $25 — seis vezes menos na saída — e pontua 60.7 contra 53.5.
No catálogo, os 50 modelos dominantes se dividem assim:
| Fornecedor | Modelos superados por um colega mais barato |
|---|---|
| OpenAI | 33 |
| Anthropic | 10 |
| 6 | |
| Perplexity | 1 |
A OpenAI domina esta tabela em parte porque possui o catálogo mais longo — as famílias o1, o3, o4 e GPT-5.x coexistem. O volume de lançamentos é a causa, não a descuido. Mas o efeito na fatura de um cliente é idêntico de qualquer forma.
Seis vezes, a resposta é um modelo open-weight
Seis dos 50 são superados apenas por um modelo que seu próprio fornecedor lançou com open weights. O modelo da Google Gemini 2.5 Flash é um: $0.30 de entrada, $2.50 de saída, 14.1 no índice. O próprio modelo da Google Gemma 4 31B custa $0.10 e $0.34 no host mais barato, e pontua 29.4.
Isso é algo estranho para uma lista de preços conter. O fornecedor está vendendo uma API para um modelo que seu próprio lançamento gratuito supera a um sétimo do preço. Também é, se você estiver gerenciando a fatura, a economia mais fácil nesta página: os pesos são públicos, então você pode hospedá-los você mesmo ou escolher qualquer provedor que desejar.
O que fazer na prática
- Verifique o modelo que você fixou, não o que você leu. A maioria desses 50 ainda está em produção em algum lugar, em código escrito quando eram os melhores disponíveis.
- Cuidado com a armadilha do nível médio. Sete modelos — as famílias o3 Mini, o4 Mini e GPT-5.4 Mini — são superados por GPT-5.6 Luna a $0.10 / $0.60. Pequeno e antigo não é o mesmo que barato.
- Não assuma que o modelo principal é o melhor que o fornecedor vende. Com essas medidas, frequentemente não é.
Você pode fazer a comparação você mesmo em qualquer dois modelos do catálogo na página de comparação de modelos, ou navegar pelo catálogo completo.
Método, para que você possa discutir com isso
Os preços são em dólares por milhão de tokens conforme publicado pelo fornecedor para modelos fechados, e conforme listado pelo host mais barato disponível para modelos open-weight. A inteligência é nossa fusão de referência diária, reconstruída todas as manhãs; os números acima são do arquivo gerado em 2 de agosto de 2026 e irão variar à medida que modelos forem adicionados.
Excluímos duas coisas deliberadamente. Níveis gratuitos, porque um preço de $0 torna cada razão infinita e não diz nada. Preços em lote, porque um nível de lote é um desconto no mesmo modelo, não um produto diferente — contá-lo teria inflacionado o resultado para 69 de 103. O número mais rigoroso, 50 de 76, é o que apoiamos.
Cada figura aqui é recalculada diariamente. Se um fornecedor cortar um preço amanhã, o modelo sai desta lista, e o leaderboard mostrará isso antes de nós.