DeepSeek V4 Flash ist ein effizientheitsoptimiertes Mixture-of-Experts-Modell von DeepSeek mit insgesamt 284B Parametern und 13B aktivierten Parametern, das ein 1M-Token-Kontextfenster unterstützt.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für DeepSeek V4 Flash 0423, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning, Max Effort.
DeepSeek V4 Flash 0423 ist ein open-weight KI-Modell von DeepSeek. Sie können es kostenlos herunterladen und self-hosted betreiben; die unten aufgeführten Preise sind die Listenpreise der gehosteten API, die täglich aktualisiert werden, für den Fall, dass Sie den Komfort dem Self-Hosting vorziehen.
DeepSeek V4 Flash 0423 ist ein KI-Sprachmodell von DeepSeek. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 51.8 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können DeepSeek V4 Flash 0423 selbst hosten und nichts pro Token bezahlen. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,14 $ pro Million Eingabetokens und 0,28 $ pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 112.1 Tokens pro Sekunde, mit einer Median 0.97s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. DeepSeek V4 Flash 0423 hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.