Google DeepMind anunció el lanzamiento de la comprensión de video impulsada por agentes en los últimos modelos Gemini. Según la empresa, la actualización está orientada a aumentar la precisión, así como a reducir los costos y el uso de tokens.

La fuente no revela qué modelos específicos recibieron la función, cuándo estará disponible para los usuarios y en qué pruebas se basan las mejoras declaradas. La información presentada aparece solo en los metadatos de la entrada del Google DeepMind Blog.

El valor práctico del lanzamiento dependerá de cuán notable sea la mejora de la precisión en tareas de video reales y si compensa las posibles limitaciones de disponibilidad.