Derselbe Auftrag kostet je nach gewähltem Modell 245× mehr.
Die Ausgabepreise für 190 KI-Modelle reichen von $0.03 bis $15.00 pro Million Token. Bei einem Monat normaler Agentenarbeit ergibt sich ein Unterschied zwischen sechs Cent und dreizehn Dollar fünfzig — für Ausgaben, die die meisten Teams nie vergleichen.
TL;DR — die kurze Version
Die Ausgabepreise der 190 von uns verfolgten Modelle reichen von $0.03 bis $15.00 pro Million Tokens — eine 500× Spanne. Der Median liegt bei $0.87.
Bei einer konkreten Arbeitslast — 2 Millionen Eingabe-Tokens und 500.000 Ausgabe-Tokens, etwa ein arbeitsreicher Monat der Agentennutzung — liegt die Rechnung zwischen 6 Cent und $13.50. Gleiche Aufgabe, 245× der Preis.
Dreizehn Modelle kosten überhaupt nichts, und 59 liegen unter fünfzig Cent. Das teure Ende ist fast leer: genau zwei Modelle kosten mehr als $10.
Die Modellpreise werden pro Million Tokens angegeben, eine Einheit, für die niemand ein Gefühl hat. Also gleiten die Zahlen vorbei: $0.60 und $6.00 lesen sich beide als “günstig genug”, und Sie wählen nach Benchmark-Ergebnissen oder nach dem Namen, den Sie zuletzt gesehen haben.
Hier ist, was diese Gewohnheit kostet.
Eine 500× Spanne, im selben Regal
Bei den 190 kommerziellen Modellen, die wir bepreisen, reichen die Ausgabepreise von $0.03 pro Million Tokens (Mistral Nemo) bis $15.00 (Kimi K3). Der Median liegt bei $0.87.
Dies sind nicht unterschiedliche Produkte wie ein Fahrrad und ein Auto. Sie sind alle Text-in, Text-out-APIs, die meisten von ihnen werden Ihre Zusammenfassungsaufgabe problemlos bewältigen, und sie sitzen nebeneinander im selben Dropdown-Menü, egal welches Framework Sie verwenden.
Wo die Modelle tatsächlich clusterieren
Die Form ist einen zweiten Blick wert. Der Markt hat eine dicke Mitte bei $1–3 — dort konkurrieren 59 Modelle, und dort landen die meisten Standardeinstellungen. Darunter sitzt eine große, ruhige Population: 72 Modelle für unter einen Dollar, dreizehn davon kostenlos.
Über $3 leert sich das Regal schnell. Zwanzig Modelle zwischen $3 und $10, und genau zwei darüber: Kimi K3 für $15.00 und Cohere’s Command R+ für $10.00.
Wie es auf einer echten Rechnung aussieht
Die Preisgestaltung pro Million wird erst real, wenn Sie sie mit Arbeit verbinden. Nehmen Sie einen Monat moderater Agentennutzung: 2 Millionen Eingabe-Tokens und 500.000 Ausgabe-Tokens — ein paar tausend Dokumentzusammenfassungen oder ein Entwickler, der regelmäßig einen Codierungsassistenten verwendet.
| Modell | Anbieter | Dieser Monat kostet |
|---|---|---|
| Mistral Nemo | Mistral AI | $0.06 |
| Llama 3.1 8B Instruct | Meta | $0.14 |
| das Median-Modell | — | $0.97 |
| Qwen3.6 Max Vorschau | Alibaba | $5.68 |
| Kimi K3 | Moonshot AI | $13.50 |
Sechs Cent gegen dreizehn Dollar und fünfzig Cent. Wenn diese Arbeitslast eine Produktfunktion ist, die für zehntausend Benutzer läuft, sind dieselben zwei Zeilen $600 gegen $135.000.
Drei Gewohnheiten, die ohne Grund Geld kosten
- Ein Modell für alles. Klassifikation, Routing, Extraktion und Formatierung sind kein Reasoning. Sie an ein Flaggschiff zu senden, bedeutet, Reasoning-Preise für Nachschlagearbeit zu zahlen.
- Ignorieren der Eingabe-/Ausgabe-Aufteilung. Die Ausgabe kostet normalerweise das Drei- bis Fünffache der Eingabe. Ein Prompt, der ein neu geschriebenes Dokument anstelle eines Diffs verlangt, kann die Rechnung leise vervielfachen.
- Nie erneut prüfen. Wir erfassen Hunderte von Preisänderungen pro Woche. Das Modell, das Sie im März getestet haben, kann heute den doppelten Preis — oder die Hälfte — des Modells daneben haben.
So wählen Sie ohne Tabellenkalkulationen
Sortieren Sie nach Preis, filtern Sie nach dem Kontextfenster, das Sie tatsächlich benötigen, und beginnen Sie von unten statt von oben. Führen Sie Ihre echten Prompts gegen das günstigste Modell aus, das plausibel funktionieren könnte, und gehen Sie erst dann nach oben, wenn es sichtbar scheitert. Die meisten Teams bleiben zwei oder drei Stufen tiefer stehen, als sie begonnen haben.
Unsere model leaderboard listet alle 190 mit Live-Eingabe- und Ausgabepreisen, Kontextfenstern und Tool-Calling-Support sowie die Gegenüberstellungsseiten Stellen Sie zwei beliebige nebeneinander. Alles ist kostenlos lesbar und es gibt kein Konto.
Methode
190 kommerzielle Modelle mit veröffentlichten Listenpreisen, gesammelt von den Preisseiten der Anbieter über OpenRouter und täglich aktualisiert; die Zahlen hier sind die vom 7. August 2026. Preise sind US-Dollar pro Million Token. “Free” bedeutet einen Ausgabepreis von null auf der kostenlosen Stufe, die der Anbieter veröffentlicht — diese Stufen haben Ratenbegrenzungen, die wir nicht modellieren.
Das monatliche Beispiel ist eine Rechnung auf Basis der Listenpreise: 2 × Eingabepreis plus 0,5 × Ausgabepreis. Es ignoriert Caching-Rabatte, Batch-Preise und Commitments-Nutzungsvereinbarungen, die alle die tatsächlichen Kosten beeinflussen. Selbst gehostete Open-Weight-Modelle sind hier ausgeschlossen, da ihre Kosten Hardware sind, nicht Token — für diese siehe unsere Lokale KI Seiten.