DeepSeek выпустила мультимодальную модель V4.1-Flash с 552 млрд параметров. По данным The Decoder, она использует в четыре раза меньше памяти KV-кэша, чем предшественница, а на каждом токене активирует 16 млрд параметров.

В пересказе The Decoder также утверждается, что V4.1-Flash немного обошла Opus 5 и GPT-5.6 Sol на тесте программирования DeepSWE. Модель распространяется по лицензии MIT и ориентирована на удешевление ИИ-агентов.

Практический смысл новости — потенциально более низкие требования к памяти при работе агентных систем с длинным контекстом. Однако пакет содержит только синопсис метаданных одного независимого издания, а не полный текст или первичное подтверждение, поэтому результаты и экономический эффект требуют дополнительной проверки.