AWS Machine Learning Blog describió un detector configurable de información de identificación personal que utiliza grandes modelos de lenguaje de Amazon Bedrock para identificar PII. Las categorías de datos se definen en la configuración y no se fijan en el código del software.

Según el sinopsis de la publicación, dicho detector se adapta a nuevos tipos de entidades sin entrenamiento adicional. En la comparación declarada, superó a una herramienta lista para usar en cinco corpus públicos y entre nueve detectores basados en grandes modelos de lenguaje.

El significado práctico del enfoque es la posibilidad de cambiar la lista de tipos de datos verificados sin volver a entrenar el sistema. Sin embargo, el paquete disponible no incluye detalles sobre los conjuntos de pruebas, las métricas, los modelos y las limitaciones de aplicación.