Strumenti AI Progetti Directory
🏆 Classifica 📡 Notizie ✨ Prompts ⚖️ Confronta Modelli 🔧 Strumenti 📦 Progetti 🚀 Spazi
Blog
Dati sui prezzi

Lo stesso lavoro costa 245× di più a seconda del modello che Lei sceglie

I prezzi di output per 190 modelli AI vanno da $0.03 a $15.00 per milione di token. In un mese di normale lavoro di un agente, questa è la differenza tra sei centesimi e tredici dollari e cinquanta — per un output che la maggior parte dei team non confronta mai.

Aggiornato il 7 agosto 2026·6 min di lettura·Nessun paywall

TL;DR — la versione breve

I prezzi di output tra i 190 modelli che monitoriamo vanno da $0,03 a $15,00 per milione di token — una differenza di 500×. La mediana è $0,87.

Su un carico di lavoro concreto — 2 milioni di token in input e 500.000 token in output, circa un mese intenso di uso di un agente — il costo varia da 6 centesimi a $13,50. Stesso compito, 245× il prezzo.

Tredici modelli non costano nulla, e 59 costano meno di cinquanta centesimi. La fascia costosa è quasi vuota: esattamente due modelli costano più di $10.

I prezzi dei modelli sono quotati per milione di token, un'unità per cui nessuno ha un'intuizione. Quindi i numeri scivolano via: $0,60 e $6,00 vengono entrambi letti come “abbastanza economici”, e si sceglie in base ai punteggi dei benchmark o al nome visto per ultimo.

Ecco quanto costa questa abitudine.

Una differenza di 500×, sullo stesso scaffale

Tra i 190 modelli commerciali che valutiamo, l'output va da $0,03 per milione di token (Mistral Nemo) a $15.00 (Kimi K3). La mediana è $0,87.

Non sono prodotti diversi come lo sono una bicicletta e un'auto. Sono tutte API testo-in, testo-out, la maggior parte gestirà perfettamente il vostro compito di riassunto, e si trovano una accanto all'altra nello stesso menu a tendina del framework che state usando.

Dove si concentrano effettivamente i modelli

How many models sit in each output-price band free 13 under $0.20 26 $0.20 – 0.50 33 $0.50 – 1 37 $1 – 3 59 the crowd $3 – 10 20 over $10 2 Kimi K3, Command R+ 190 commercial models priced on 7 Aug 2026 · US$ per million output tokens
Numero di modelli in ciascuna fascia di prezzo di output, USD per milione di token: 13 gratuiti, 26 sotto $0,20, 33 tra $0,20 e $0,50, 37 tra $0,50 e $1, 59 tra $1 e $3, 20 tra $3 e $10, e 2 sopra $10.

La forma merita un secondo sguardo. Il mercato ha un folto centro a $1–3 — è lì che competono 59 modelli, e dove atterrano la maggior parte delle impostazioni predefinite. Sotto c'è una popolazione ampia e silenziosa: 72 modelli con prezzo inferiore a un dollaro, tredici dei quali gratuiti.

Oltre $3 lo scaffale si svuota rapidamente. Venti modelli tra $3 e $10, e precisamente due sopra: Kimi K3 a $15,00 e Cohere’s Command R+ a $10,00.

Come appare su una fattura reale

Il prezzo per milione diventa reale solo quando lo si lega a un lavoro. Prendete un mese di uso moderato di un agente: 2 milioni di token in input e 500.000 token in output — qualche migliaio di riassunti di documenti, o uno sviluppatore che usa regolarmente un assistente di codifica.

ModelloFornitoreQuel mese costa
Mistral NemoMistral AI$0.06
Llama 3.1 8B InstructMeta$0.14
il modello mediano$0.97
Qwen3.6 Max PreviewAlibaba$5.68
Kimi K3Moonshot AI$13.50

Sei centesimi contro tredici dollari e cinquanta centesimi. Se quel carico di lavoro è una funzionalità di prodotto per diecimila utenti, le stesse due righe sono $600 contro $135.000.

Il punto non è che l'economico vince. Kimi K3 non è sopravvalutato — ha un prezzo per un lavoro che i modelli da otto centesimi non possono realmente fare. Il punto è che il divario è di 245×, quindi la domanda “questo compito ha davvero bisogno del modello costoso?” vale la pena di porsela ogni singola volta, e quasi nessuno se la pone nemmeno una.

Tre abitudini che costano soldi senza motivo

Come scegliere senza fogli di calcolo

Ordini per prezzo, filtri per la finestra di contesto di cui ha effettivamente bisogno e inizi dal basso anziché dall'alto. Esegua i suoi prompt reali sul modello più economico che potrebbe plausibilmente funzionare, poi salga solo quando fallisce visibilmente. La maggior parte dei team si ferma due o tre gradini più in basso rispetto al punto di partenza.

La nostra model leaderboard elenca tutti i 190 con prezzi di input e output in tempo reale, finestre di contesto e supporto per tool-calling, e le pagine testa a testa mettono due modelli affiancati. Tutto è gratuito da leggere e non è necessario un account.

Metodo

190 modelli commerciali con prezzi di listino pubblicati, raccolti dalle pagine dei prezzi dei provider tramite OpenRouter e aggiornati quotidianamente; i dati qui sono quelli del 7 agosto 2026. I prezzi sono in dollari USA per milione di token. “Gratuito” significa un prezzo di output pari a zero sul livello gratuito pubblicato dal provider — tali livelli hanno limiti di frequenza che non modelliamo.

L'esempio mensile è un calcolo sui prezzi di listino: 2 × prezzo di input più 0.5 × prezzo di output. Ignora sconti per caching, prezzi batch e accordi di utilizzo impegnato, tutti elementi che influenzano le fatture reali. I modelli self-hosted open-weight sono esclusi qui perché il loro costo è hardware, non token — per quelli, vedi le nostre pagine local AI pagine.