
Andon Labs, ein Unternehmen für KI-Sicherheit aus San Francisco, überträgt KI-Agenten die Leitung realer Betriebsabläufe und beobachtet die Folgen. Zu den beschriebenen Experimenten gehören ein Verkaufsautomat mit ungewöhnlichem Sortiment, ein Geschäft mit einem KI-Manager und ein KI-basierter Radio-Moderator, der eine Phrase 229 Mal pro Tag wiederholte.
Laut IEEE Spectrum AI dienen diese Projekte gleichzeitig als Testumgebungen für die kommerzielle Arbeit von Andon Labs: die Entwicklung von Bewertungsmaßstäben und Forschung in Zusammenarbeit mit führenden Laboren, die fortschrittliche KI-Systeme entwickeln.
Die Bedeutung dieser Experimente liegt in der Überprüfung des Verhaltens von KI in alltäglichen Arbeitsszenarien, bei denen Fehler Waren, Mitarbeiter und das Publikum betreffen. Die vorliegende Quelle gibt jedoch weder Aufschluss über die Bewertungsmethodik, die Dauer der Projekte noch über die Reaktion der Menschen darauf.
redaktioneller Kommentar
Warum es wichtig ist
Eine wahrscheinliche Folge ist ein wachsendes Interesse an der Evaluierung von KI in realen Arbeitsszenarien, in denen Fehler für Menschen und materielle Objekte sichtbar werden. Das nächste beobachtbare Signal werden veröffentlichte Methoden, Testergebnisse oder neue Projekte von Andon Labs sein. Aufgrund des Fehlens des vollständigen Artikels und von Primärdaten besteht weiterhin erhebliche Unsicherheit.