DeepSeek lanzó el modelo multimodal V4.1-Flash con 552 mil millones de parámetros. Según datos de The Decoder, utiliza cuatro veces menos memoria de caché KV que su predecesora y activa 16 mil millones de parámetros en cada token.

En el resumen de The Decoder también se afirma que V4.1-Flash superó ligeramente a Opus 5 y a GPT-5.6 Sol en la prueba de programación DeepSWE. El modelo se distribuye bajo licencia MIT y está orientado a abaratar los agentes de IA.

La implicación práctica de la noticia es una posible reducción de los requisitos de memoria al operar sistemas de agentes con contextos largos. Sin embargo, el paquete contiene únicamente un resumen de metadatos de una publicación independiente, no el texto completo ni una confirmación primaria, por lo que los resultados y el impacto económico requieren verificación adicional.