
Google DeepMind anunciou o lançamento do entendimento de vídeo agentivo nos modelos Gemini mais recentes. Segundo a empresa, a atualização visa aumentar a precisão, bem como reduzir os custos e o uso de tokens.
A fonte não revela quais modelos específicos receberam a função, quando ela estará disponível aos usuários e em quais testes baseiam as melhorias declaradas. As informações apresentadas estão contidas apenas nos metadados da entrada do Google DeepMind Blog.
O valor prático do lançamento dependerá de quão perceptível a melhoria de precisão se mostrará em tarefas reais de vídeo e se compensará as limitações de disponibilidade.
comentário editorial
Por que importa
Provavelmente isso resultará em um fortalecimento do papel da análise de vídeo em produtos baseados em Gemini, se as melhorias declaradas forem confirmadas na prática. O próximo sinal observável serão os detalhes técnicos, os resultados dos testes ou informações sobre a disponibilidade da função. Uma incerteza significativa está relacionada ao fato de que, no momento, apenas uma descrição curta dos metadados de uma única fonte está disponível.