Un grupo de investigadores presentó un artículo en la Conferencia Internacional sobre Aprendizaje Automático, celebrada este mes. El trabajo afirma que es imposible hacer que los grandes modelos de lenguaje estén completamente protegidos contra hackeos.

Los autores del documento vinculan este problema con un defecto fundamental en los principios de funcionamiento de dichos sistemas. Según su opinión, la propia arquitectura de los modelos crea una brecha ineliminable para posibles ataques.

El material se basa en conclusiones publicadas en un informe para uno de los eventos profesionales más destacados. La publicación MIT Technology Review cubre estas declaraciones como un desafío serio para la industria de la inteligencia artificial.