DeepSeek V4 Flash è un modello Mixture-of-Experts ottimizzato per l'efficienza di DeepSeek con 284B parametri totali e 13B parametri attivati, supportando una finestra di contesto di 1M-token.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per DeepSeek V4 Flash 0423, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning, Max Effort.
DeepSeek V4 Flash 0423 è un modello AI open-weight di DeepSeek. È possibile scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono i listini delle API ospitate, aggiornati giornalmente, per quando si preferisce la comodità rispetto al self-hosting.
DeepSeek V4 Flash 0423 è un modello di linguaggio AI di DeepSeek. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 51.8 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — può self-hosted DeepSeek V4 Flash 0423 e non pagare nulla per token. Se preferisce un'API ospitata, i prezzi di lista sono $0.14 per milione di token di input e $0.28 per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. È particolarmente utilizzato per generazione di codice.
Genera circa 115.9 token al secondo, con una mediana 0.99s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. DeepSeek V4 Flash 0423 ha open weights, quindi può scaricarlo ed eseguirlo sulla sua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.