Le PDG d'Anthropic, Dario Amodei, a présenté un plan visant à « modérer le rythme » des développements avancés en matière d'IA. Ce plan inclut des évaluateurs de sécurité indépendants et une coordination entre les laboratoires d'IA des pays démocratiques.

Selon TechCrunch AI, l'initiative a déjà reçu le soutien d'une partie du secteur, mais elle s'est heurtée aux critiques de Jensen Huang, de Nvidia. Cette proposition fait suite à l'avertissement lancé la semaine précédente par un chercheur d'Anthropic concernant un scénario catastrophique, qui avait inquiet l'industrie de l'IA.

La portée de cette initiative est pour l'instant définie non pas par des résultats annoncés, mais par l'architecture de surveillance proposée: des vérifications externes et une coordination destinées à compléter les décisions internes des laboratoires. Toutefois, le matériel disponible ne constitue qu'un bref résumé de la publication; par conséquent, les détails, les critères d'évaluation et le statut pratique du plan restent inconnus.