Lo stesso lavoro costa 245× di più a seconda del modello che Lei sceglie
I prezzi di output per 190 modelli AI vanno da $0.03 a $15.00 per milione di token. In un mese di normale lavoro di un agente, questa è la differenza tra sei centesimi e tredici dollari e cinquanta — per un output che la maggior parte dei team non confronta mai.
TL;DR — la versione breve
I prezzi di output tra i 190 modelli che monitoriamo vanno da $0,03 a $15,00 per milione di token — una differenza di 500×. La mediana è $0,87.
Su un carico di lavoro concreto — 2 milioni di token in input e 500.000 token in output, circa un mese intenso di uso di un agente — il costo varia da 6 centesimi a $13,50. Stesso compito, 245× il prezzo.
Tredici modelli non costano nulla, e 59 costano meno di cinquanta centesimi. La fascia costosa è quasi vuota: esattamente due modelli costano più di $10.
I prezzi dei modelli sono quotati per milione di token, un'unità per cui nessuno ha un'intuizione. Quindi i numeri scivolano via: $0,60 e $6,00 vengono entrambi letti come “abbastanza economici”, e si sceglie in base ai punteggi dei benchmark o al nome visto per ultimo.
Ecco quanto costa questa abitudine.
Una differenza di 500×, sullo stesso scaffale
Tra i 190 modelli commerciali che valutiamo, l'output va da $0,03 per milione di token (Mistral Nemo) a $15.00 (Kimi K3). La mediana è $0,87.
Non sono prodotti diversi come lo sono una bicicletta e un'auto. Sono tutte API testo-in, testo-out, la maggior parte gestirà perfettamente il vostro compito di riassunto, e si trovano una accanto all'altra nello stesso menu a tendina del framework che state usando.
Dove si concentrano effettivamente i modelli
La forma merita un secondo sguardo. Il mercato ha un folto centro a $1–3 — è lì che competono 59 modelli, e dove atterrano la maggior parte delle impostazioni predefinite. Sotto c'è una popolazione ampia e silenziosa: 72 modelli con prezzo inferiore a un dollaro, tredici dei quali gratuiti.
Oltre $3 lo scaffale si svuota rapidamente. Venti modelli tra $3 e $10, e precisamente due sopra: Kimi K3 a $15,00 e Cohere’s Command R+ a $10,00.
Come appare su una fattura reale
Il prezzo per milione diventa reale solo quando lo si lega a un lavoro. Prendete un mese di uso moderato di un agente: 2 milioni di token in input e 500.000 token in output — qualche migliaio di riassunti di documenti, o uno sviluppatore che usa regolarmente un assistente di codifica.
| Modello | Fornitore | Quel mese costa |
|---|---|---|
| Mistral Nemo | Mistral AI | $0.06 |
| Llama 3.1 8B Instruct | Meta | $0.14 |
| il modello mediano | — | $0.97 |
| Qwen3.6 Max Preview | Alibaba | $5.68 |
| Kimi K3 | Moonshot AI | $13.50 |
Sei centesimi contro tredici dollari e cinquanta centesimi. Se quel carico di lavoro è una funzionalità di prodotto per diecimila utenti, le stesse due righe sono $600 contro $135.000.
Tre abitudini che costano soldi senza motivo
- Un modello per tutto. Classificazione, instradamento, estrazione e formattazione non sono ragionamento. Inviarli a un modello di punta significa pagare prezzi da ragionamento per lavoro di ricerca.
- Ignorare la suddivisione input/output. L'output costa di solito da tre a cinque volte l'input. Un prompt che chiede un documento riscritto invece di un diff può moltiplicare silenziosamente il conto.
- Mai ricontrollare. Registriamo centinaia di variazioni di prezzo a settimana. Il modello che ha confrontato a marzo potrebbe costare il doppio — o la metà — di quello accanto oggi.
Come scegliere senza fogli di calcolo
Ordini per prezzo, filtri per la finestra di contesto di cui ha effettivamente bisogno e inizi dal basso anziché dall'alto. Esegua i suoi prompt reali sul modello più economico che potrebbe plausibilmente funzionare, poi salga solo quando fallisce visibilmente. La maggior parte dei team si ferma due o tre gradini più in basso rispetto al punto di partenza.
La nostra model leaderboard elenca tutti i 190 con prezzi di input e output in tempo reale, finestre di contesto e supporto per tool-calling, e le pagine testa a testa mettono due modelli affiancati. Tutto è gratuito da leggere e non è necessario un account.
Metodo
190 modelli commerciali con prezzi di listino pubblicati, raccolti dalle pagine dei prezzi dei provider tramite OpenRouter e aggiornati quotidianamente; i dati qui sono quelli del 7 agosto 2026. I prezzi sono in dollari USA per milione di token. “Gratuito” significa un prezzo di output pari a zero sul livello gratuito pubblicato dal provider — tali livelli hanno limiti di frequenza che non modelliamo.
L'esempio mensile è un calcolo sui prezzi di listino: 2 × prezzo di input più 0.5 × prezzo di output. Ignora sconti per caching, prezzi batch e accordi di utilizzo impegnato, tutti elementi che influenzano le fatture reali. I modelli self-hosted open-weight sono esclusi qui perché il loro costo è hardware, non token — per quelli, vedi le nostre pagine local AI pagine.