Ancien chercheur en pré-entraînement chez OpenAI et Anthropic, Jacob Coxon a quitté les entreprises et les a accusées de mettre sciemment l'humanité en danger d'extinction. Selon The Decoder.

Le collègue de Coxon chez Anthropic, Evan Hubinger, évalue la probabilité que l'IA superintelligente non alignée détruise l'humanité au cours de la prochaine décennie à plus de 10%.

L'importance de cette histoire ne réside pas dans une prévision confirmée, mais dans l'évaluation extrême attribuée publiquement au chercheur et dans la critique des deux entreprises notables. La confirmation disponible est limitée au bref descriptif de The Decoder, et non au texte intégral des sources primaires.