DeepSeek hat das experimentelle multimodale Modell V4-Flash-Vision-Exp veröffentlicht. Laut The Decoder ergänzt es das Textverständnis der V4-Flash-Modelle um die Verarbeitung von Bildern.

Bei eigenen multimodalen Tests für Aufgaben von Agenten kam V4-Flash-Vision-Exp Opus 4.8 nahe und übertraf ihn in einigen Fällen. Diese Ergebnisse werden über die Metadaten der Veröffentlichung The Decoder kommuniziert und sollten nicht als unabhängige Bestätigung oder vollständige Qualitätsbewertung angesehen werden.