DeepSeek V4 Flash (DeepSeek): precios de API en vivo, ventana de contexto y las mejores alternativas de código abierto, rastreadas diariamente por olud.ai.
Los precios se actualizan automáticamente — verificados cada hora contra los precios de la lista del proveedor.
Puntuaciones de referencia independientes para DeepSeek V4 Flash, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: Reasoning, Max Effort.
DeepSeek V4 Flash es un modelo de IA de peso abierto de DeepSeek. Puedes descargarlo y autoalojarlo de forma gratuita; los precios a continuación son precios de lista de API alojadas, rastreados por hora, para cuando prefieras la comodidad sobre el autoalojamiento.
DeepSeek V4 Flash es un modelo de lenguaje de IA de DeepSeek. Es de pesos abiertos: puedes descargarlo y ejecutarlo en tu propio hardware, de forma gratuita. Obtiene 40.3 en el índice de inteligencia Artificial Analysis.
Los pesos son gratuitos y abiertos: puedes alojar DeepSeek V4 Flash de forma local y no pagar nada por token. Si prefieres una API alojada, los precios de lista son $0.14 por millón de tokens de entrada y $0.28 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 89.4%, Humanity's Last Exam 32.1%, Long Context Reasoning 63%, SciCode 44.9%, IFBench 79.2%, τ²-Bench 95%, τ-Bench Banking 22.9%, Terminal-Bench 61.8%, Terminal-Bench Hard 35.6%. Se utiliza particularmente para generación de código.
Genera aproximadamente 116.5 tokens por segundo, con una mediana 0.89s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. DeepSeek V4 Flash tiene pesos abiertos, así que puedes descargarlo y ejecutarlo en tu propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.