
DeepSeek hat das multimodale Modell V4.1-Flash mit 552 Mrd. Parametern veröffentlicht. Laut The Decoder soll es im Vergleich zum Vorgänger viermal weniger Speicher des KV-Caches nutzen, und pro Token werden 16 Mrd. Parameter aktiviert.
In der Wiedergabe von The Decoder wird außerdem behauptet, dass V4.1-Flash DeepSWE leicht über Opus 5 und GPT-5.6 Sol abschneidet, was den Programmierbenchmark DeepSWE betrifft. Die Lizenz der Modellveröffentlichung ist MIT und sie richtet sich an kostengünstigere KI-Agenten.
Der praktische Sinn der Nachricht liegt in potenziell geringeren Speicheranforderungen für Agentensysteme mit langem Kontext. Das Paket enthält jedoch nur einen Metadaten-Synopsis eines unabhängigen Mediums und keinen vollständigen Text oder eine primäre Bestätigung; Ergebnisse und wirtschaftliche Auswirkungen bedürfen weiterer Prüfung.
redaktioneller Kommentar
Warum es wichtig ist
Wenn die behaupteten Merkmale bestätigt werden, wird als nächstes beobachtbares Signal das Auftauchen reproduzierbarer Tests zu Speicher, Kosten und Qualität der agentischen Aufgaben sein. Die größte Unsicherheit besteht darin, dass es keine primäre Bestätigung im Paket gibt und keine Details zur Vergleichsmethode.