Due terzi dei modelli AI a pagamento sono superati da un modello più economico dello stesso fornitore
Dei 76 modelli chiusi che valutiamo e classifichiamo, 50 sono superati da un altro modello dello stesso stesso azienda che costa anche meno — meno in input e meno in output. Nessuno le invia un'email quando ciò accade.
TL;DR — la versione breve
50 dei 76 modelli chiusi che monitoriamo sono dominati da un compagno stabile. Stesso fornitore, punteggio di intelligenza più alto, prezzo più basso su entrambi input e output. Questo è il 66 %.
Il divario peggiore è 20×. o1-pro è ancora elencato a $600 per milione di token in output. GPT-5.6 Solda parte della stessa azienda, costa $30 e ottiene 40 punti in più.
Sei dei 50 sono superati dal modello open-weight dello stesso fornitore. L'opzione più economica e migliore è quella che può scaricare.
Un listino prezzi API non è una raccomandazione. È un archivio. I fornitori aggiungono modelli costantemente e li ritirano quasi mai, quindi l'endpoint che ha collegato diciotto mesi fa si trova nella documentazione accanto alla sua sostituzione, al suo prezzo originale, indefinitamente.
Prezziamo e valutiamo ogni modello nel catalogo ogni mattina. Quindi abbiamo posto una domanda meccanica senza spazio per opinioni: per ogni modello a pagamento, lo stesso fornitore vende qualcosa che ottiene un punteggio più alto nel nostro indice di intelligenza e costa meno per milione di token in input e in output?
Non più economico in media. Non migliore su un benchmark. Strictly better e strictly cheaper su ogni asse contemporaneamente — il caso in cui non ci sono compromessi da discutere.
La risposta, il 2 agosto 2026: 50 su 76.
Il caso 20×
Il divario più grande nel catalogo appartiene a OpenAI. o1-pro è ancora elencato a $150 in e $600 out per milione di token. GPT-5.6 Solda parte dello stesso fornitore, è $5 in e $30 out — e ottiene 58.9 nel nostro indice di intelligenza contro 18.9 di o1-pro.
Trenta volte più economico in input, venti volte più economico in output, quaranta punti in più. Non c'è carico di lavoro in cui o1-pro sia la risposta giusta oggi, eppure nulla nella pagina dei prezzi di OpenAI lo dice.
Un avvertimento che le dobbiamo: o1-pro non ha punteggio di codifica nei nostri dati, quindi non facciamo alcuna affermazione sulla sua capacità di codifica. L'indice di intelligenza è ciò che abbiamo misurato, ed è su questo che si basa il confronto.
Non è solo OpenAI
Il modello si mantiene ovunque un fornitore spedisce rapidamente. Anthropic's Claude Opus 4.7 (Fast) è elencato a $30 in e $150 out. Claude Opus 5 costa $5 e $25 — sei volte meno in output — e ottiene 60.7 contro 53.5.
Nel catalogo i 50 modelli dominati si suddividono in questo modo:
| Fornitore | Modelli superati da un compagno stabile più economico |
|---|---|
| OpenAI | 33 |
| Anthropic | 10 |
| 6 | |
| Perplexity | 1 |
OpenAI domina questa tabella in parte perché ha il catalogo più lungo — le famiglie o1, o3, o4 e GPT-5.x coesistono tutte. Il volume di rilasci è la causa, non la disattenzione. Ma l'effetto sulla fattura di un cliente è identico in entrambi i casi.
Sei volte, la risposta è un modello open-weight
Sei dei 50 sono superati solo da un modello rilasciato dal proprio fornitore con open weights. Google's Gemini 2.5 Flash è uno: $0.30 in, $2.50 out, 14.1 sull'indice. Il proprio di Google Gemma 4 31B è $0.10 e $0.34 presso l'host più economico, e ottiene 29.4.
È una cosa strana da contenere in un listino prezzi. Il fornitore ti sta vendendo un'API per un modello che la sua stessa versione gratuita scaricabile supera a un settimo del prezzo. È anche, se sta gestendo la fattura, il risparmio più facile su questa pagina: i pesi sono pubblici, quindi può ospitarli da solo o scegliere qualsiasi fornitore desideri.
Cosa fare realmente
- Controlli il modello che ha fissato, non quello di cui ha letto. La maggior parte di questi 50 è ancora in produzione da qualche parte, in codice scritto quando erano i migliori disponibili.
- Fai attenzione alla trappola della fascia media. Sette modelli — le famiglie o3 Mini, o4 Mini e GPT-5.4 Mini — sono superati da GPT-5.6 Luna a $0.10 / $0.60. Piccolo e vecchio non è la stessa cosa di economico.
- Non assuma che il modello di punta sia il migliore venduto dal fornitore. Su queste misure spesso non lo è.
Può eseguire il confronto da solo su qualsiasi due modelli nel catalogo dalla pagina di confronto modelli, o sfogliare il classifica completa.
Metodo, così può discutere con esso
I prezzi sono dollari per milione di token come pubblicato dal fornitore per modelli chiusi, e come elencato dall'host più economico disponibile per modelli open-weight. L'intelligenza è la nostra fusione di benchmark quotidiana, ricostruita ogni mattina; le cifre sopra provengono dal file generato il 2 agosto 2026 e varieranno man mano che i modelli vengono aggiunti.
Abbiamo escluso deliberatamente due cose. Fasce gratuite, perché un prezzo di $0 rende ogni rapporto infinito e non dice nulla. Prezzi per batch, perché una fascia di batch è uno sconto sullo stesso modello, non un prodotto diverso — contarla avrebbe gonfiato il risultato a 69 su 103. Il numero più rigoroso, 50 su 76, è quello su cui ci schieriamo.
Ogni cifra qui viene ricalcolata quotidianamente. Se un fornitore riduce un prezzo domani, il modello esce da questo elenco, e la classifica lo mostrerà prima di noi.