DeepSeek V4 Flash es un modelo Mixture-of-Experts optimizado para eficiencia de DeepSeek con 284B de parámetros totales y 13B de parámetros activados, que admite una ventana de contexto de 1M tokens.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para DeepSeek V4 Flash 0423, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: Reasoning, Max Effort.
DeepSeek V4 Flash 0423 es un modelo de IA open-weight de DeepSeek. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el autoalojamiento.
DeepSeek V4 Flash 0423 es un modelo de lenguaje de IA de DeepSeek. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 51.8 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puede autoalojar DeepSeek V4 Flash 0423 y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.14 por millón de tokens de entrada y $0.28 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. Se utiliza particularmente para generación de código.
Genera aproximadamente 112.1 tokens por segundo, con una mediana 0.97s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. DeepSeek V4 Flash 0423 tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.