DeepSeek V4 Flash 0731 è un modello sparse mixture-of-experts di DeepSeek, con 13B parametri attivi su 284B totali.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per DeepSeek V4 Flash 0731, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning, Max Effort.
DeepSeek V4 Flash 0731 è un modello AI open-weight di DeepSeek. È possibile scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono i listini delle API ospitate, aggiornati giornalmente, per quando si preferisce la comodità rispetto al self-hosting.
DeepSeek V4 Flash 0731 è un modello di linguaggio AI di DeepSeek. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 51.8 sull'indice di intelligenza Artificial Analysis.
I pesi sono liberi e open — puoi eseguire DeepSeek V4 Flash 0731 in self-hosted e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0.05 per milione di token in input e $0.1 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 90.8%, Humanity's Last Exam 38.6%, Long Context Reasoning 74.3%, SciCode 49.9%, τ-Bench Banking 39.4%, Terminal-Bench 78.7%. È particolarmente utilizzato per generazione di codice.
Genera circa 137.3 token al secondo, con una mediana 1s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. DeepSeek V4 Flash 0731 ha open weights, quindi può scaricarlo ed eseguirlo sul suo GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.