DeepSeek lanzó la modelo multimodal experimental V4-Flash-Vision-Exp. Según The Decoder, añade comprensión de imágenes a las capacidades textuales de V4-Flash.

En pruebas multimodales propias para tareas de agentes, la modelo se acercó a Opus 4.8 y, en algunos casos, lo superó. Estos resultados se presentan a través de los metadatos de la publicación de The Decoder, por lo que no deben considerarse una confirmación independiente ni una evaluación completa de la calidad.