Das Unternehmen Google DeepMind hat die Veröffentlichung seines neuesten Sprachmodells mit dem Namen Gemini 3.1 Flash Live angekündigt. Laut Aussage der Entwickler lag der Fokus bei der Erstellung dieser Version auf der Erhöhung der Genauigkeit bei der Spracherkennung und -synthese.

Die wichtigste technische Errungenschaft des neuen Modells ist eine erhebliche Reduzierung der Datenübertragungsverzögerung (Latenz). Diese Änderung zielt darauf ab, den Dialog zwischen Benutzer und künstlicher Intelligenz flüssiger zu gestalten und ihn mehr einem lebendigen Gespräch anzunähern.

Die Entwickler betonen, dass die Aktualisierungen darauf abzielen, die Zuverlässigkeit von Sprachinteraktionen zu erhöhen. Das Modell wird als Werkzeug positioniert, das ein natürlicheres Tempo und eine natürlichere Intonation in den Reaktionen des Systems gewährleisten kann.