
Andon Labs, une entreprise de sécurité de l'IA basée à San Francisco, confie à des agents IA la gestion d'opérations réelles et observe les conséquences. Parmi les expériences décrites figurent un distributeur automatique avec un assortiment inhabituel, un magasin géré par une IA et un animateur radio basé sur l'IA qui répétait une phrase 229 fois par jour.
Selon IEEE Spectrum AI, ces projets servent simultanément de terrains d'essai pour le travail commercial d'Andon Labs: le développement d'évaluations et de recherches en collaboration avec des laboratoires de premier plan créant des systèmes d'IA avancés.
L'importance de ces expériences réside dans la vérification du comportement de l'IA dans des scénarios de travail ordinaires, où les erreurs affectent les marchandises, les employés et le public. Cependant, la source fournie ne révèle pas la méthodologie d'évaluation, la durée des projets ou la réaction des personnes concernées.
commentaire éditorial
Pourquoi c’est important
Une conséquence probable est un intérêt croissant pour l'évaluation de l'IA dans des scénarios de travail réels, où les erreurs sont perceptibles par les humains et les objets physiques. Le prochain signal observable sera la publication de méthodologies, de résultats de tests ou de nouveaux projets d'Andon Labs. Une incertitude substantielle subsiste en raison de l'absence du texte intégral de l'article et des données primaires.