DeepSeek V4 Flash 0731 ist ein sparsames Mischmodell aus Experten von DeepSeek mit 13B aktiven Parametern von insgesamt 284B.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für DeepSeek V4 Flash 0731, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning, Max Effort.
DeepSeek V4 Flash 0731 ist ein open-weight KI-Modell von DeepSeek. Sie können es kostenlos herunterladen und self-hosted betreiben; die unten aufgeführten Preise sind die Listenpreise der gehosteten API, die täglich aktualisiert werden, für den Fall, dass Sie den Komfort dem Self-Hosting vorziehen.
DeepSeek V4 Flash 0731 ist ein KI-Sprachmodell von DeepSeek. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 51.8 im Artificial Analysis Intelligenzindex.
Die Gewichte sind frei und offen — Sie können DeepSeek V4 Flash 0731 selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.08 pro Million Eingabe-Token und $0.18 pro Million Ausgabe-Token.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 112.1 Tokens pro Sekunde, mit einer Median 0.97s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. DeepSeek V4 Flash 0731 hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.