
Un grupo de investigadores presentó un artículo en la Conferencia Internacional sobre Aprendizaje Automático, celebrada este mes. El trabajo afirma que es imposible hacer que los grandes modelos de lenguaje estén completamente protegidos contra hackeos.
Los autores del documento vinculan este problema con un defecto fundamental en los principios de funcionamiento de dichos sistemas. Según su opinión, la propia arquitectura de los modelos crea una brecha ineliminable para posibles ataques.
El material se basa en conclusiones publicadas en un informe para uno de los eventos profesionales más destacados. La publicación MIT Technology Review cubre estas declaraciones como un desafío serio para la industria de la inteligencia artificial.
comentario editorial
Por qué importa
La consecuencia más probable será un cambio de paradigma en el desarrollo de la IA, pasando de la búsqueda de una protección ideal a la creación de sistemas capaces de funcionar incluso con una compromisión parcial. La siguiente señal observable serán las reacciones de las grandes empresas tecnológicas a este informe y los posibles cambios en las hojas de ruta de seguridad. Persiste una incertidumbre material respecto a cuán ampliamente aplicable es el defecto identificado a diferentes tipos de arquitecturas de modelos.