Prezzi live per token per ogni modello principale — proprietario e open-weight — in un unico posto. Vedi i costi a colpo d'occhio nel grafico, calcola la tua bolletta mensile, confronta i modelli fianco a fianco e scopri quanto costerebbe eseguire lo stesso carico di lavoro sul tuo hardware: per i modelli open-weight, solo elettricità.
Prezzi estratti da dati live · monitorati nel tempo · olud.ai
Olud Ratio = Indice di Intelligenza ÷ prezzo misto per milione di token (input/output pesato 3:1) — punti di intelligenza per dollaro, più alto è meglio.Gli indici di Intelligenza e Coding sono misurati da Artificial Analysis (variante con punteggio migliore per modello); i modelli senza un benchmark pubblicato mostrano « — » e si classificano ultimi. Deterministico, senza ponderazione editoriale.
Le barre si scalano al modello più costoso mostrato. Più in basso è più economico.
Ogni prezzo sopra è ciò che un fornitore addebita per eseguire un modello per te. Ma i modelli open-weight — DeepSeek, Llama, Qwen, Mistral, Gemma — sono gratuiti da scaricare e eseguire sul tuo GPU. Dopo l'hardware, il costo marginale per token è fondamentalmente elettricità. Per carichi di lavoro stabili e ad alto volume, questo cambia completamente i calcoli.
Per ogni modello a pagamento popolare, ecco il modello open-weight a cui le persone passano, e dove leggerne:
Metodo. I prezzi sono per milione di token, estratti dall'API OpenRouter e aggiornati quotidianamente. I pesi di costo “misti” input e output sono 3:1, un comune proxy a numero singolo. Il costo di auto-ospitare è marginale (elettricità) ed esclude l'hardware — le cifre effettive dipendono dalla tua GPU, utilizzo e prezzo dell'energia. La cronologia dei movimenti di prezzo è registrata dal lancio, quindi la sezione dei movimenti si riempirà nelle prossime settimane.
I prezzi le dicono quanto costa un modello. La leaderboard le dice se è valido — modelli open-weight classificati in base all'uso nel mondo reale.
Apri la classifica →