
Nature Machine Intelligence a publié un article sur le développement de l’intelligence auditive générale pour l’écoute et la parole par les machines. Dans la description, il est dit que l’informatique d’écoute englobe la compréhension, le traitement et la génération de la parole, des sons ambiants et de la musique.
Selon l’éditeur, la direction va au-delà des approches traditionnelles et cherche à exploiter les capacités des modèles fondamentaux pour une compréhension plus complète, une génération plus naturelle et une interaction plus proche de celle des humains.
Pourquoi est-ce important: l’audio contient des signaux sémantiques, émotionnels et contextuels, il est donc considéré comme une partie importante de l’intelligence artificielle naturelle et incarnée. Le texte complet de la publication et les informations sur des systèmes concrets ne sont pas fournis dans le pack disponible.
commentaire éditorial
Pourquoi c’est important
Conséquence probable : l’audio sera plus souvent considéré comme un canal autonome pour des systèmes qui nécessitent une compréhension sémantique, émotionnelle et contextuelle. Le prochain signal observé sera des méthodes spécifiques, des évaluations comparatives et des démonstrations de tels systèmes dans le texte intégral de la publication ou dans des recherches ultérieures. Une grande incertitude est liée au fait que les informations actuelles ne présentent que des métadonnées et ne permettent pas de juger de la faisabilité pratique des approches.