Prezzi live per token per ogni modello principale — proprietario e open-weight — in un unico posto. Vedi i costi a colpo d'occhio nel grafico, calcola la tua bolletta mensile, confronta i modelli fianco a fianco e scopri quanto costerebbe eseguire lo stesso carico di lavoro sul tuo hardware: per i modelli open-weight, solo elettricità.
Prezzi estratti da dati live · monitorati nel tempo · olud.ai
Le barre si scalano al modello più costoso mostrato. Più in basso è più economico.
Ogni prezzo sopra è ciò che un fornitore addebita per eseguire un modello per te. Ma i modelli open-weight — DeepSeek, Llama, Qwen, Mistral, Gemma — sono gratuiti da scaricare e eseguire sul tuo GPU. Dopo l'hardware, il costo marginale per token è fondamentalmente elettricità. Per carichi di lavoro stabili e ad alto volume, questo cambia completamente i calcoli.
Per ogni modello a pagamento popolare, ecco il modello open-weight a cui le persone passano, e dove leggerne:
Metodo. I prezzi sono per milione di token, estratti dall'API OpenRouter e aggiornati quotidianamente. I pesi di costo “misti” input e output sono 3:1, un comune proxy a numero singolo. Il costo di auto-ospitare è marginale (elettricità) ed esclude l'hardware — le cifre effettive dipendono dalla tua GPU, utilizzo e prezzo dell'energia. La cronologia dei movimenti di prezzo è registrata dal lancio, quindi la sezione dei movimenti si riempirà nelle prossime settimane.
I prezzi ti dicono quanto costa un modello. La classifica ti dice se è valido — modelli a pesi aperti classificati in base all'uso nel mondo reale.
Apri la classifica →