
Google DeepMind объявила о запуске агентного понимания видео в последних моделях Gemini. По заявлению компании, обновление направлено на повышение точности, а также снижение затрат и использования токенов.
Источник не раскрывает, какие именно модели получили функцию, когда она станет доступна пользователям и на каких тестах основаны заявленные улучшения. Представленные сведения опубликованы только в метаданных записи Google DeepMind Blog.
Практическое значение запуска будет зависеть от того, насколько заметно улучшение точности проявится в реальных видеозадачах и компенсирует ли оно возможные ограничения доступности.
комментарий редакции
Что это значит
Вероятное последствие — усиление роли анализа видео в продуктах на базе Gemini, если заявленные улучшения подтвердятся на практике. Следующим наблюдаемым сигналом станут технические детали, результаты тестирования или сведения о доступности функции. Существенная неопределённость связана с тем, что сейчас доступно только краткое описание из метаданных одного источника.