
Der ehemalige Forscher für Vortraining bei OpenAI und Anthropic, Jacob Coxon, hat die Unternehmen verlassen und ihnen vorgeworfen, die Menschheit bewusst dem Risiko des Aussterbens auszusetzen. Darüber berichtet The Decoder.
Coxons Kollege bei Anthropic, Evan Hubinger, schätzt die Wahrscheinlichkeit, dass eine nicht mit den Zielen abgestimmte superintelligente KI die Menschheit innerhalb des nächsten Jahrzehnts vernichten wird, auf mehr als 10%.
Die Bedeutung dieser Geschichte liegt nicht in einer bestätigten Prognose, sondern in der einem Forscher öffentlich zugeschriebenen Einschätzung eines extremen Risikos und der Kritik an zwei namhaften Unternehmen. Die verfügbare Bestätigung beschränkt sich auf eine kurze Beschreibung von The Decoder und nicht auf den vollständigen Text der Primärquelle.
redaktioneller Kommentar
Warum es wichtig ist
Die wahrscheinliche Folge ist eine Verschärfung der Debatten über Sicherheit und Verantwortung von KI-Entwicklern, dies ist jedoch keine bestätigte Prognose. Als nächstes zu beobachtendes Signal gelten die Antworten von OpenAI und Anthropic sowie die Veröffentlichung der Methodik oder der Primärmaterialien, auf denen die Aussagen basieren. Aufgrund des Fehlens des vollständigen Textes und einer unabhängigen Bestätigung im Quellenpaket bleibt eine erhebliche Unsicherheit bestehen.