
The Verge informa que Google ha actualizado Gemini Audio y presentado los modelos Gemini 3.5 Live, Gemini 3.5 Live Experimental y Gemini 3.5 Transcribe. Las nuevas capacidades de transcripción reconocen vocabulario especializado y más de 85 idiomas.
Según la publicación, los modelos están diseñados para un funcionamiento más preciso de las funciones de voz de Google en presencia de ruido de fondo y en situaciones donde el habla del usuario se interrumpe. El titular de The Verge también indica la eliminación automática de muletillas como «eh» y «ah».
La importancia práctica de esta actualización radica en la reducción del procesamiento manual de transcripciones y en la mejora de la comodidad de la entrada por voz, especialmente en entornos profesionales. Sin embargo, el material disponible se presenta únicamente en forma de metadatos y no contiene pruebas, ejemplos de calidad o detalles sobre el lanzamiento.
comentario editorial
Por qué importa
La consecuencia probable es una aplicación más cómoda de las funciones de voz en escenarios laborales donde son importantes los términos y una transcripción limpia. La siguiente señal observable serán datos sobre disponibilidad, idiomas y pruebas independientes de calidad. Persiste una incertidumbre sustancial debido a la fuente única y a los metadatos sin resultados detallados.