DeepSeek V4 Flash é um modelo Mixture-of-Experts otimizado para eficiência da DeepSeek com 284B de parâmetros totais e 13B de parâmetros ativados, suportando uma janela de contexto de 1M tokens.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para DeepSeek V4 Flash 0423, medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning, Max Effort.
DeepSeek V4 Flash 0423 é um modelo de IA open-weight da DeepSeek. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços públicos de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
DeepSeek V4 Flash 0423 é um modelo de linguagem de IA da DeepSeek. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 51.8 no índice de inteligência Artificial Analysis.
Os weights são gratuitos e abertos — você pode self-host DeepSeek V4 Flash 0423 e não pagar nada por token. Se você preferir uma API hospedada, os preços de lista são $0.14 por milhão de tokens de entrada e $0.28 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. É particularmente usado para geração de código.
Ele gera cerca de 112.1 tokens por segundo, com uma mediana 0.97s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. DeepSeek V4 Flash 0423 tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.