Der ehemalige Forscher für Vortraining bei OpenAI und Anthropic, Jacob Coxon, hat die Unternehmen verlassen und ihnen vorgeworfen, die Menschheit bewusst dem Risiko des Aussterbens auszusetzen. Darüber berichtet The Decoder.

Coxons Kollege bei Anthropic, Evan Hubinger, schätzt die Wahrscheinlichkeit, dass eine nicht mit den Zielen abgestimmte superintelligente KI die Menschheit innerhalb des nächsten Jahrzehnts vernichten wird, auf mehr als 10%.

Die Bedeutung dieser Geschichte liegt nicht in einer bestätigten Prognose, sondern in der einem Forscher öffentlich zugeschriebenen Einschätzung eines extremen Risikos und der Kritik an zwei namhaften Unternehmen. Die verfügbare Bestätigung beschränkt sich auf eine kurze Beschreibung von The Decoder und nicht auf den vollständigen Text der Primärquelle.