
O ex-pesquisador de pré-treinamento na OpenAI e na Anthropic, Jacob Coxon, deixou as empresas e acusou-as de conscientemente expor a humanidade ao risco de extinção. É o que reporta o The Decoder.
O colega de Coxon na Anthropic, Evan Hubinger, estima em mais de 10% a probabilidade de uma IA superinteligente não alinhada com os objetivos humanos destruir a humanidade na próxima década.
A relevância desta história não reside numa previsão confirmada, mas na avaliação pública atribuída a um pesquisador sobre um risco extremo e na crítica a duas empresas proeminentes. A confirmação disponível limita-se a uma breve descrição do The Decoder, e não ao texto completo da fonte original.
comentário editorial
Por que importa
A provável consequência é o aumento das disputas sobre segurança e responsabilidade dos desenvolvedores de IA, mas isto não constitui uma previsão confirmada. O próximo sinal observável serão as respostas da OpenAI e da Anthropic, bem como a publicação da metodologia ou dos materiais primários nos quais se baseiam as declarações. Mantém-se uma incerteza substancial devido à ausência, no pacote de fontes, do texto completo e de confirmação independente.