DeepSeek V4.1 Flash est un modèle à mélange d'experts épars de DeepSeek, et le premier construit sur l'architecture Causal Encoder-Decoder (CED) de l'entreprise.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour DeepSeek V4.1 Flash, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning, Max Effort.
DeepSeek V4.1 Flash est un modèle d'IA open-weight de DeepSeek. Vous pouvez le télécharger et l'auto-héberger gratuitement ; les prix ci-dessous sont les prix catalogue de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité à l'auto-hébergement.
DeepSeek V4.1 Flash est un modèle de langage IA de DeepSeek. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 39.5 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger DeepSeek V4.1 Flash et ne rien payer par jeton. Si vous préférez une API hébergée, les tarifs publics sont de 0,3 $ par million de jetons d'entrée et 1,2 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent Humanity's Last Exam 39.2%, Long Context Reasoning 84%, SciCode 51.9%.
Il génère environ 219.8 tokens par seconde, avec un délai médian 0.84s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. DeepSeek V4.1 Flash a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.