DeepSeek hat das multimodale Modell V4.1-Flash mit 552 Mrd. Parametern veröffentlicht. Laut The Decoder soll es im Vergleich zum Vorgänger viermal weniger Speicher des KV-Caches nutzen, und pro Token werden 16 Mrd. Parameter aktiviert.

In der Wiedergabe von The Decoder wird außerdem behauptet, dass V4.1-Flash DeepSWE leicht über Opus 5 und GPT-5.6 Sol abschneidet, was den Programmierbenchmark DeepSWE betrifft. Die Lizenz der Modellveröffentlichung ist MIT und sie richtet sich an kostengünstigere KI-Agenten.

Der praktische Sinn der Nachricht liegt in potenziell geringeren Speicheranforderungen für Agentensysteme mit langem Kontext. Das Paket enthält jedoch nur einen Metadaten-Synopsis eines unabhängigen Mediums und keinen vollständigen Text oder eine primäre Bestätigung; Ergebnisse und wirtschaftliche Auswirkungen bedürfen weiterer Prüfung.