La empresa Google DeepMind anunció el lanzamiento de su último modelo de voz, denominado Gemini 3.1 Flash Live. Según la declaración de los desarrolladores, el enfoque principal en la creación de esta versión fue aumentar la precisión del reconocimiento y la síntesis de voz.

El logro técnico clave del nuevo modelo fue una reducción significativa en la latencia de transmisión de datos. Este cambio tiene como objetivo hacer que el diálogo entre el usuario y la inteligencia artificial sea más fluido y se asemeje más a una conversación en vivo.

Los desarrolladores enfatizan que las actualizaciones están diseñadas para aumentar la fiabilidad de las interacciones de voz. El modelo se posiciona como una herramienta capaz de proporcionar un ritmo y una entonación más naturales en las respuestas del sistema.