DeepSeek V4 Flash lançado: modelo MoE de 284B de alto rendimento, agora no MuiRouter
O DeepSeek V4 Flash traz 284B de parâmetros, contexto de 1M tokens e custo de prompt caching incrivelmente baixo. O MuiRouter já oferece o modelo pela API.
Em 31 de julho de 2026, a DeepSeek lançou oficialmente o DeepSeek V4 Flash (versão DeepSeek-V4-Flash-0731). Projetado na família DeepSeek V4 como um modelo MoE focado em altíssimo rendimento e respostas ultra-rápidas, o V4 Flash utiliza 284 bilhões de parâmetros totais e 13 bilhões ativos para oferecer desempenho impressionante em programação por agentes, autocompletar código e raciocínio de contexto longo.
Pouco mais de um mês após o lançamento do DeepSeek V4, é impressionante ver como conseguiram elevar a inteligência do modelo em tarefas complexas sem grandes mudanças estruturais, superando até o DeepSeek V4 Pro em diversos testes. Lançá-lo a um custo tão acessível é algo admirável.
Já liberamos o suporte oficial ao deepseek-v4-flash no MuiRouter. Seja no seu agente de IA no terminal ou por APIs compatíveis com a OpenAI (/v1/chat/completions), você pode usar o DeepSeek V4 Flash com uma única chave de API a partir de US$ 0,14 por 1 milhão de tokens de entrada.
Destaques do DeepSeek V4 Flash
Principais especificações segundo os dados oficiais da DeepSeek:
| Recurso | DeepSeek V4 Flash |
|---|---|
| Arquitetura | MoE com 284B parâmetros totais, 13B ativos por token |
| Janela de Contexto | 1.048.576 tokens (1M) |
| Atenção em Contexto Longo | Híbrido de Compressed Sparse Attention (CSA) e Heavily Compressed Attention (HCA) |
| Recursos | Modo de Raciocínio ("Thinking"), Chamadas de Ferramentas, JSON Mode & Saídas Estruturadas |
| Implantação | Pesos abertos (execução local em GGUF / Ollama) e API Oficial |
| Preço Oficial da API | Entrada US$ 0.14 / 1M tokens (US$ 0.0028 acerto no cache); Saída US$ 0.28 / 1M tokens |
1. Janela de Contexto de 1M e Custo Mínimo de Prompt Caching
O DeepSeek V4 Flash suporta nativamente 1 milhão de tokens de contexto. Em longas sessões de código e análise de repositórios, com o Prompt Caching oficial, os tokens de entrada em cache custam apenas US$ 0,0028 por 1M de tokens (98% de desconto).
Isso reduz drasticamente os custos diários quando seu agente lê repetidamente bases de código extensas.
2. Otimizado para Agentes e Programação Autônoma
A atualização DeepSeek-V4-Flash-0731 traz melhorias de pós-treinamento focadas em fluxos de trabalho de agentes. A alta velocidade de resposta permite ciclos rápidos de iteração enquanto o agente planeja, escreve código, executa comandos no terminal e corrige erros autonomamente.
Preços Oficiais e Faturamento no MuiRouter
Tarifas oficiais da API DeepSeek:
| Tipo de Token | Preço (por 1M de tokens) |
|---|---|
| Entrada (Falha no Cache) | US$ 0.14 |
| Entrada (Acerto no Cache) | US$ 0.0028 |
| Saída / Raciocínio | US$ 0.28 |
No MuiRouter, mantemos faturamento transparente baseado no uso real sem mensalidades ou assinaturas.
Conclusão
O DeepSeek V4 Flash redefine a velocidade e a eficiência de custo entre os modelos abertos. Combinado com o MuiRouter, desenvolvedores ganham acesso a capacidades avançadas de programação autônoma a um preço extremamente acessível.
Experimente o deepseek-v4-flash hoje mesmo no MuiRouter Playground ou direto no seu agente de terminal!
Fontes de referência
Fonte principal publicada em 31 de julho de 2026.
Prepare-se para a próxima mudança em IA
Comece com uma API Key e um caminho mais claro para manter o acesso a modelos estável enquanto ferramentas e disponibilidade upstream mudam.