Live-Preise pro Token für jedes wichtige Modell — proprietär und Open-Weight — an einem Ort. Sehen Sie die Kosten auf einen Blick im Diagramm, berechnen Sie Ihre monatliche Rechnung, vergleichen Sie Modelle nebeneinander und finden Sie heraus, was die gleiche Arbeitslast auf Ihrer eigenen Hardware kosten würde: für Open-Weight-Modelle, nichts außer Strom.
Preise stammen aus Live-Daten · über die Zeit verfolgt · olud.ai
Balken skalieren auf das teuerste angezeigte Modell. Niedriger ist günstiger.
Jeder Preis oben ist das, was ein Anbieter verlangt, um ein Modell auszuführen für Sie. Aber Open-Weight-Modelle — DeepSeek, Llama, Qwen, Mistral, Gemma — sind kostenlos herunterzuladen und auf Ihrer eigenen GPU auszuführen. Nach der Hardware sind die Grenzkosten pro Token im Grunde genommen Strom. Für stetige, hochvolumige Arbeitslasten ändert sich die Mathematik völlig.
Für jedes beliebte kostenpflichtige Modell ist hier das Open-Weight-Modell, zu dem die Leute wechseln, und wo Sie mehr darüber lesen können:
Methode. Preise gelten pro Million Tokens, abgerufen von der OpenRouter API und täglich aktualisiert. Die „gemischten“ Kosten gewichten Eingabe und Ausgabe 3:1, ein gängiger Einzelzahlen-Proxie. Die Selbsthosting-Kosten sind marginal (Strom) und schließen Hardware aus — tatsächliche Zahlen hängen von Ihrer GPU, Nutzung und Strompreis ab. Die Preisbewegungshistorie wird seit dem Start protokolliert, sodass der Abschnitt über Bewegungen in den kommenden Wochen ausgefüllt wird.
Preise sagen Ihnen, was ein Modell kostet. Die Rangliste sagt Ihnen, ob es gut ist — Open-Weight-Modelle, die nach realer Nutzung eingestuft sind.
Öffnen Sie die Rangliste →