DeepSeek V4 Flash (DeepSeek): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.
Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.
Unabhängige Benchmark-Ergebnisse für DeepSeek V4 Flash, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning, Max Effort.
DeepSeek V4 Flash ist ein Open-Weight-AI-Modell von DeepSeek. Sie können es kostenlos herunterladen und selbst hosten; die untenstehenden Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.
DeepSeek V4 Flash ist ein KI-Sprachmodell von DeepSeek. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 40.3 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können DeepSeek V4 Flash selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.14 pro Million Eingabetokens und $0.28 pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 89.4%, Humanity's Last Exam 32.1%, Long Context Reasoning 63%, SciCode 44.9%, IFBench 79.2%, τ²-Bench 95%, τ-Bench Banking 22.9%, Terminal-Bench 61.8%, Terminal-Bench Hard 35.6%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 117.7 Tokens pro Sekunde, mit einer Median 0.92s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. DeepSeek V4 Flash hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.
Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.