AWS Machine Learning Blog описал настраиваемый детектор персональных данных, который использует большие языковые модели Amazon Bedrock для выявления PII. Категории данных задаются в конфигурации, а не фиксируются в программном коде.

По данным синопсиса публикации, такой детектор адаптируется к новым типам сущностей без дополнительного обучения. В заявленном сравнении он превзошёл готовый инструмент на пяти общедоступных корпусах и среди девяти детекторов на основе больших языковых моделей.

Практический смысл подхода — возможность менять перечень проверяемых типов данных без переобучения системы. При этом в доступном пакете нет подробностей о наборах тестов, метриках, моделях и ограничениях применения.