Google DeepMind a annoncé le lancement de la compréhension agentique de la vidéo dans les dernières modèles Gemini. Selon l’entreprise, la mise à jour vise à augmenter la précision et à réduire les coûts et l’utilisation des jetons.

La source ne révèle pas quelles sont exactement les modèles qui ont reçu la fonction, quand elle sera accessible aux utilisateurs et sur quels tests reposent les améliorations annoncées. Les informations présentées ne figurent que dans les métadonnées de l’enregistrement du Google DeepMind Blog.

La valeur pratique du lancement dépendra de la manière dont l’amélioration de la précision sera visible dans les tâches vidéo réelles et de savoir si elle compensera les éventuelles limites d’accessibilité.