Группа исследователей представила статью на Международной конференции по машинному обучению, состоявшейся в этом месяце. В работе утверждается, что крупные языковые модели невозможно сделать полностью защищенными от взломов.

Авторы документа связывают эту проблему с фундаментальным недостатком в принципах работы таких систем. По их мнению, сама архитектура моделей создает неустранимую брешь для потенциальных атак.

Материал основан на выводах, опубликованных в докладе для ведущего профильного мероприятия. Издание MIT Technology Review освещает эти заявления как серьезный вызов для индустрии искусственного интеллекта.