KI-Modelle · Preise

AI-Modell Preise

Live-Preise pro Token für jedes wichtige Modell — proprietär und Open-Weight — an einem Ort. Sehen Sie die Kosten auf einen Blick im Diagramm, berechnen Sie Ihre monatliche Rechnung, vergleichen Sie Modelle nebeneinander und finden Sie heraus, was die gleiche Arbeitslast auf Ihrer eigenen Hardware kosten würde: für Open-Weight-Modelle, nichts außer Strom.

Preise stammen aus Live-Daten · über die Zeit verfolgt · olud.ai

Monatlicher KostenrechnerGeben Sie Ihr Token-Volumen ein — die Kosten werden live aktualisiert und die günstigsten zuerst angezeigt.

Preis auf einen BlickGünstigste Modelle nach gemischten Kosten (Eingabe + Ausgabe gewichtet 3:1). Open-Weight in Grün.

Open-WeightProprietär
Diagramm wird geladen…

Balken skalieren auf das teuerste angezeigte Modell. Niedriger ist günstiger.

Jedes Modell, jeder PreisPro Million Tokens. Aktivieren Sie die Kästchen, um Modelle nebeneinander zu vergleichen. „Gemischte“ gewichtet Eingabe/Ausgabe 3:1.

Vergleichen

Live-Preise werden geladen…

API-Kosten vs. selbst ausführenDer Teil, den niemand sonst zeigt: Open-Weight-Modelle kosten ~$0 pro Token, sobald Sie sie hosten.

Jeder Preis oben ist das, was ein Anbieter verlangt, um ein Modell auszuführen für Sie. Aber Open-Weight-Modelle — DeepSeek, Llama, Qwen, Mistral, Gemma — sind kostenlos herunterzuladen und auf Ihrer eigenen GPU auszuführen. Nach der Hardware sind die Grenzkosten pro Token im Grunde genommen Strom. Für stetige, hochvolumige Arbeitslasten ändert sich die Mathematik völlig.

Für jedes beliebte kostenpflichtige Modell ist hier das Open-Weight-Modell, zu dem die Leute wechseln, und wo Sie mehr darüber lesen können:

Führen Sie offene Modelle selbst ausKostenlos ist nur kostenlos, wenn Sie es tatsächlich ausführen können. Dies sind die Werkzeuge, um es zu tun — vollständige Anleitungen zu jedem.

Aktuelle PreisbewegungenAnbieter senken ständig die Preise. Wir protokollieren täglich einen Snapshot und zeigen die Änderungen an.

Lade Preishistorie…

Weiter erkunden

Methode. Preise gelten pro Million Tokens, abgerufen von der OpenRouter API und täglich aktualisiert. Die „gemischten“ Kosten gewichten Eingabe und Ausgabe 3:1, ein gängiger Einzelzahlen-Proxie. Die Selbsthosting-Kosten sind marginal (Strom) und schließen Hardware aus — tatsächliche Zahlen hängen von Ihrer GPU, Nutzung und Strompreis ab. Die Preisbewegungshistorie wird seit dem Start protokolliert, sodass der Abschnitt über Bewegungen in den kommenden Wochen ausgefüllt wird.

Möchten Sie auch die Fähigkeitsperspektive?

Preise sagen Ihnen, was ein Modell kostet. Die Rangliste sagt Ihnen, ob es gut ist — Open-Weight-Modelle, die nach realer Nutzung eingestuft sind.

Öffnen Sie die Rangliste →
ausgewählt — Vergleichen ↑