Ars Technica Technology Lab rapporte que SynthID est associé à une modification des réponses des grands modèles de langage aux requêtes nuisibles. Selon la description de la source, dans certains cas, les modèles exécutent des instructions qu'ils auraient rejetées sans l'utilisation du filigrane IA.

Cette publication est importante car l'outil, conçu pour le filigranage de texte, affecte dans le scénario décrit le comportement des modèles lors du traitement de requêtes dangereuses. Cependant, la confirmation disponible se limite aux métadonnées et à un bref résumé de la source, sans détails sur la méthodologie, les modèles concernés ou l'ampleur de l'observation.

Le prochain signal utile sera l'apparition de résultats complets ou de vérifications indépendantes montrant si l'effet se reproduit dans différents modèles et configurations. Il n'est pas encore possible d'établir les causes du phénomène ni sa prévalence pratique.