DeepSeek V4 Flash 0731 es un modelo de mezcla de expertos disperso de DeepSeek, con 13B de parámetros activos de un total de 284B.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para DeepSeek V4 Flash 0731, medidas por Artificial Analysis. Cuanto más alto, mejor. Modo de medición: Reasoning, Max Effort.
DeepSeek V4 Flash 0731 es un modelo de IA open-weight de DeepSeek. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el autoalojamiento.
DeepSeek V4 Flash 0731 es un modelo de lenguaje de IA de DeepSeek. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 51.8 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puede self-hosted DeepSeek V4 Flash 0731 y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.08 por millón de tokens de entrada y $0.18 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. Se utiliza particularmente para generación de código.
Genera aproximadamente 112.1 tokens por segundo, con una mediana 0.97s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. DeepSeek V4 Flash 0731 tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.