Lanzamiento de DeepSeek V4 Flash: modelo MoE de 284B, ya disponible en MuiRouter
DeepSeek V4 Flash ofrece 284B de parámetros, ventana de contexto de 1M y costes de almacenamiento en caché de prompt ultra bajos. Disponible en MuiRouter.
El 31 de julio de 2026, DeepSeek lanzó oficialmente su nuevo modelo insignia ligero DeepSeek V4 Flash (versión DeepSeek-V4-Flash-0731). Diseñado dentro de la familia DeepSeek V4 como un modelo MoE centrado en alto rendimiento y respuesta ultra rápida, V4 Flash utiliza una arquitectura de 284 mil millones de parámetros totales y 13 mil millones activos para ofrecer resultados excepcionales en programación de agentes, autocompletado de código y razonamiento de contexto largo.
Poco más de un mes después del lanzamiento de DeepSeek V4, resulta sorprendente cómo han logrado incrementar la inteligencia del modelo y su capacidad para tareas complejas sin grandes cambios arquitectónicos, superando incluso en ciertos benchmarks a DeepSeek V4 Pro. Lanzarlo a un precio tan accesible es verdaderamente notable.
Hemos integrado oficialmente deepseek-v4-flash en MuiRouter. Ya sea en tu agente de IA en la terminal o mediante la API estándar compatible con OpenAI (/v1/chat/completions), ahora puedes utilizar DeepSeek V4 Flash con una sola clave de API a partir de tan solo $0,14 por cada millón de tokens de entrada.
Aspectos clave de DeepSeek V4 Flash
Según los datos y especificaciones oficiales de DeepSeek:
| Característica | DeepSeek V4 Flash |
|---|---|
| Arquitectura | MoE de 284B parámetros totales, 13B activos por token |
| Ventana de contexto | 1.048.576 tokens (1M) |
| Atención en contexto largo | Híbrido de Compressed Sparse Attention (CSA) y Heavily Compressed Attention (HCA) |
| Capacidades | Modo de razonamiento ("Thinking"), llamadas a herramientas, modo JSON y salida estructurada |
| Despliegue | Pesos abiertos (ejecución local en GGUF / Ollama) y API oficial |
| Precios oficiales de API | Entrada $0.14 / 1M tokens ($0.0028 acierto en caché); Salida $0.28 / 1M tokens |
1. Ventana de contexto de 1M y costes de Prompt Caching mínimos
DeepSeek V4 Flash admite de forma nativa una ventana de contexto de 1M de tokens. En sesiones largas de programación y análisis de repositorios, junto con el Prompt Caching oficial de DeepSeek, los tokens de entrada en caché cuestan solo $0,0028 por 1M de tokens (un 98% de descuento).
Esto reduce drásticamente los costes diarios cuando tu agente de terminal lee repetidamente código fuente extenso.
2. Optimizado para agentes y programación de ciclo largo
La actualización DeepSeek-V4-Flash-0731 incluye mejoras en el postentrenamiento diseñadas específicamente para flujos de trabajo con agentes. La alta velocidad de salida permite iteraciones rápidas mientras el agente planifica, escribe código, ejecuta comandos en la terminal y corrige errores de forma autónoma.
Precios oficiales y facturación en MuiRouter
Tarifas oficiales de la API de DeepSeek:
| Tipo de token | Precio (por 1M de tokens) |
|---|---|
| Entrada (Fallo en caché) | $0.14 |
| Entrada (Acierto en caché) | $0.0028 |
| Salida / Razonamiento | $0.28 |
En MuiRouter, mantenemos una facturación transparente por uso real sin suscripciones mensuales.
Conclusión
DeepSeek V4 Flash establece un nuevo estándar de velocidad y rentabilidad entre los modelos abiertos. Combinado con MuiRouter, los desarrolladores obtienen acceso a capacidades avanzadas de programación autónoma a un precio extremadamente accesible.
Prueba deepseek-v4-flash hoy mismo en el Playground de MuiRouter o en tu agente de terminal.
Fuentes de referencia
Fuente principal publicada el 31 de julio de 2026.
Prepárate para el próximo cambio de la IA
Empieza con una API Key y una ruta más clara para mantener estable el acceso a modelos mientras cambian las herramientas y la disponibilidad upstream.