
A DeepSeek lançou o modelo multimodal V4.1-Flash, com 552 bilhões de parâmetros. Segundo dados do The Decoder, ele utiliza quatro vezes menos memória de cache KV do que seu antecessor e ativa 16 bilhões de parâmetros em cada token.
No resumo do The Decoder, afirma-se também que a V4.1-Flash superou ligeiramente o Opus 5 e o GPT-5.6 Sol no benchmark de programação DeepSWE. O modelo é distribuído sob licença MIT e focado na redução de custos de agentes de IA.
O significado prático da notícia reside na potencial redução dos requisitos de memória para sistemas de agentes que operam com contextos longos. No entanto, o pacote contém apenas um resumo de metadados de uma única publicação independente, e não o texto completo ou confirmação primária; portanto, os resultados e o impacto econômico exigem verificação adicional.
comentário editorial
Por que importa
Se as características declaradas forem confirmadas, o próximo sinal observável será o surgimento de testes reproduzíveis de memória, custo e qualidade para tarefas de agentes. A principal incerteza é a ausência de confirmação primária e detalhes da metodologia de comparação no pacote.