Google DeepMind kündigte die Einführung des agentischen Video-Verständnisses in den neuesten Gemini-Modellen an. Laut dem Unternehmen zielt das Update darauf ab, die Genauigkeit zu erhöhen sowie Kosten und Token-Nutzung zu senken.

Die Quelle nennt nicht, welche Modelle die Funktion erhalten haben, wann sie Nutzenden zur Verfügung stehen wird oder auf welchen Tests die gemachten Verbesserungen basieren. Die dargestellten Informationen stammen lediglich aus den Metadaten des Eintrags im Google DeepMind Blog.

Die praktische Bedeutung des Starts hängt davon ab, wie deutlich die Genauigkeit in realen Videoaufgaben steigt und ob dies die potenziellen Einschränkungen der Verfügbarkeit ausgleichen kann.