DeepSeek V4 Flash 0731 è un modello sparse mixture-of-experts di DeepSeek, con 13B parametri attivi su 284B totali.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per DeepSeek V4 Flash 0731, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning, Max Effort.
DeepSeek V4 Flash 0731 è un modello AI open-weight di DeepSeek. È possibile scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono i listini delle API ospitate, aggiornati giornalmente, per quando si preferisce la comodità rispetto al self-hosting.
DeepSeek V4 Flash 0731 è un modello di linguaggio AI di DeepSeek. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 51.8 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — può self-hostare DeepSeek V4 Flash 0731 e non pagare nulla per token. Se preferisce un'API hosted, i prezzi di listino sono $0.08 per milione di token in input e $0.18 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. È particolarmente utilizzato per generazione di codice.
Genera circa 112.1 token al secondo, con una mediana 0.97s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. DeepSeek V4 Flash 0731 ha open weights, quindi può scaricarlo ed eseguirlo sul suo GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.