
Ancien chercheur en pré-entraînement chez OpenAI et Anthropic, Jacob Coxon a quitté les entreprises et les a accusées de mettre sciemment l'humanité en danger d'extinction. Selon The Decoder.
Le collègue de Coxon chez Anthropic, Evan Hubinger, évalue la probabilité que l'IA superintelligente non alignée détruise l'humanité au cours de la prochaine décennie à plus de 10%.
L'importance de cette histoire ne réside pas dans une prévision confirmée, mais dans l'évaluation extrême attribuée publiquement au chercheur et dans la critique des deux entreprises notables. La confirmation disponible est limitée au bref descriptif de The Decoder, et non au texte intégral des sources primaires.
commentaire éditorial
Pourquoi c’est important
Une conséquence probable est l’accentuation des débats sur la sécurité et la responsabilité des développeurs d’IA, mais ce n’est pas une prévision confirmée. Les prochains signaux à observer seront les réponses d’OpenAI et d’Anthropic, ainsi que la publication de méthodologies ou de documents primaires sur lesquels reposent ces déclarations. Une incertitude substantielle demeure en raison de l’absence dans le paquet de sources d’un texte complet et d’une vérification indépendante.