DeepSeek V4 Flash 0423 vs Mercury 2 comparados — preço por token, janela de contexto, multimodalidade, abertura e qual escolher. O modelo open-source pode substituir o pago? Análise completa de 2026.
Preços & especificações atualizados a partir de dados ao vivo · olud.ai
Preços de modelos abertos = provedor mais barato via OpenRouter; as taxas do fabricante oficial podem ser mais altas.
| Especificação | DeepSeek V4 Flash 0423 | Mercury 2 | Vencedor |
|---|---|---|---|
| Fabricante | DeepSeek | Inception | – |
| Tipo | Open-weight | Proprietário | |
| Janela de contexto | 1M tokens | 128K tokens | |
| Preço de entrada | $0.14/M · auto-hospedagem gratuita | $0.25/M | |
| Preço de saída | $0.28/M · auto-hospedagem gratuita | $0.75/M | |
| Visão / multimodal | Não | Não | – |
| Chamada de ferramenta / função | Sim | Sim | = Empate |
| Auto-hospedável | Sim | Não (somente API) | |
| Licença | MIT | Proprietário |
DeepSeek V4 Flash 0423 é ~2.7× mais barato que Mercury 2 em tokens de saída ($0.28 vs $0.75 por M tokens).
| Capacidade | DeepSeek V4 Flash 0423 | Mercury 2 |
|---|---|---|
| Open weights (baixáveis) | ✓ | ✗ |
| Auto-hospedável | ✓ | ✗ |
| Funciona totalmente offline | ✓ | ✗ |
| Visão / multimodal | ✗ | ✗ |
| Chamada de ferramenta / função | ✓ | ✓ |
| Janela de contexto de 1M+ | ✓ | ✗ |
Pontuações de benchmark independentes medidas pela Artificial Analysis. Quanto maior, melhor (exceto latência).
Dados de benchmark por Artificial Analysis.
| Critério | DeepSeek V4 Flash 0423 | Mercury 2 |
|---|---|---|
| Custo-eficiência | 5.0 | 5.0 |
| Janela de contexto | 5.0 | 3.5 |
| Abertura | 5.0 | 1.5 |
| Auto-hospedagem | 5.0 | 1.0 |
| Multimodalidade | 3.5 | 3.5 |
As pontuações vêm de dados ao vivo — preço de saída (custo), comprimento do contexto, pesos abertos vs fechados (abertura & auto-hospedagem) e suporte a visão/ferramenta (multimodalidade). A qualidade bruta da tarefa não é pontuada aqui; depende do seu benchmark — veja o veredicto.
DeepSeek V4 Flash é um modelo Mixture-of-Experts otimizado para eficiência da DeepSeek com 284B de parâmetros totais e 13B de parâmetros ativados, suportando uma janela de contexto de 1M tokens. É projetado para inferência rápida e...
Mercury 2 é um LLM de raciocínio extremamente rápido, e o primeiro LLM de difusão de raciocínio (dLLM). Em vez de gerar tokens sequencialmente, Mercury 2 produz e refina múltiplos tokens em paralelo, alcançando...
Essas variantes são rastreadas, mas não comparadas aqui — uma página por família mantém a comparação legível.
DeepSeek V4 Flash 0423 é open-weight e competitivo em muitas tarefas, mas Mercury 2 pode ainda liderar nas tarefas mais difíceis de raciocínio e trabalho agente. A diferença continua diminuindo — faça benchmark de ambos em seu caso de uso real antes de decidir.
Sim. DeepSeek V4 Flash 0423 tem open weights, então você pode auto-hospedá-lo em suas próprias GPUs ou rodá-lo através de uma API de baixo custo. Mercury 2 é apenas API e não pode ser auto-hospedado.
DeepSeek V4 Flash 0423 custa $0.28/M de saída vs $0.75/M para Mercury 2 — aproximadamente 3x mais barato via API, e gratuito se você auto-hospedar.
Escolha DeepSeek V4 Flash 0423 se você deseja auto-hospedar, manter seus dados privados e evitar taxas por token — é open-weight e roda no seu próprio hardware. Escolha Mercury 2 se você deseja capacidade de fronteira através de uma API gerenciada com zero infraestrutura para rodar.
Navegue pela tabela completa de modelos de código aberto, milhares de ferramentas e benchmarks ao vivo — tudo em um só lugar.
Abra a classificação →