DeepSeek V4 Flash est un modèle Mixture-of-Experts optimisé pour l'efficacité de DeepSeek avec 284B de paramètres totaux et 13B de paramètres activés, prenant en charge une fenêtre de contexte de 1M de tokens.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour DeepSeek V4 Flash 0423, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning, Max Effort.
DeepSeek V4 Flash 0423 est un modèle d'IA open-weight de DeepSeek. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
DeepSeek V4 Flash 0423 est un modèle de langage IA de DeepSeek. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 51.8 sur l'indice d'intelligence d'Artificial Analysis.
Les weights sont gratuits et ouverts — vous pouvez auto-héberger DeepSeek V4 Flash 0423 et ne rien payer par token. Si vous préférez une API hébergée, les prix de liste sont de 0,14 $ par million de tokens d'entrée et de 0,28 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. Il est particulièrement utilisé pour génération de code.
Il génère environ 112.1 tokens par seconde, avec un délai médian 0.97s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. DeepSeek V4 Flash 0423 a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.