El 10 de septiembre de 2026, DeepSeek presentó V4.1 Flash, un modelo de lenguaje multimodal que introduce una nueva arquitectura y corta bruscamente los precios de API.
Una nueva arquitectura causal de encoder-decoder
La empresa llama V4.1 Flash el modelo más pequeño en una nueva familia. Utiliza un diseño “Causal Encoder–Decoder” con un núcleo de mezcla de 552 millones de euros, de los cuales DeepSeek dice que sólo 8 mil millones de parámetros están activos en la entrada y 16 mil millones en la salida. En comparación con la generación anterior, el modelo supuestamente necesita sólo una cuarta parte del HBM y un octavo del almacenamiento SSD para su caché KV.
Multimodal, pesos abiertos, precios bajos
V4.1 Flash entiende las imágenes nativamente y es accesible a través de la deepseek-flash endpoint con una ventana de contexto de un millón. DeepSeek publica los pesos como un modelo de peso abierto en Hugging Face, junto con un informe técnico. Los precios bajaron en el lanzamiento: durante las horas pico, las cotizaciones de la lista de precios entran en 0,30 dólares por millón de fichas (falta) y la salida a $1,20, con las tasas de descuento fijadas a la mitad de eso.
Las reclamaciones de rendimiento vienen con cavernas
DeepSeek apunta a “pruebas por múltiples partes” que colocan V4.1 Flash por delante del V4-Pro saliente sobre rendimiento, costo, velocidad y tiempo de ejecución total – cifras de proveedores que aún no han sido verificadas independientemente. Desde el 14 de septiembre de 2026, DeepSeek planea trazar las solicitudes V4-Pro automáticamente al nuevo modelo hasta que llegue una variante V4.1-Pro.
Fuentes: DeepSeek – Presentando DeepSeek-V4.1-Flash y el anuncio en el DeepSeek API Docs.



















