A DeepSeek lançou o modelo multimodal V4.1-Flash, com 552 bilhões de parâmetros. Segundo dados do The Decoder, ele utiliza quatro vezes menos memória de cache KV do que seu antecessor e ativa 16 bilhões de parâmetros em cada token.

No resumo do The Decoder, afirma-se também que a V4.1-Flash superou ligeiramente o Opus 5 e o GPT-5.6 Sol no benchmark de programação DeepSWE. O modelo é distribuído sob licença MIT e focado na redução de custos de agentes de IA.

O significado prático da notícia reside na potencial redução dos requisitos de memória para sistemas de agentes que operam com contextos longos. No entanto, o pacote contém apenas um resumo de metadados de uma única publicação independente, e não o texto completo ou confirmação primária; portanto, os resultados e o impacto econômico exigem verificação adicional.