Os pesquisadores desenvolveram uma metodologia de quatro fases para verificar se os modelos de linguagem utilizam sinais de sua própria confiança ao escolher entre responder ou se abster. Na primeira fase, a confiança dos modelos foi medida sem a possibilidade de recusar a resposta.

A pesquisa foi publicada na Nature Machine Intelligence sob o título «Causal evidence that language models use confidence to drive behaviour». Na descrição do trabalho, a metacognição é considerada como uma avaliação da qualidade das próprias ações cognitivas, associada ao comportamento adaptativo em diferentes espécies.

A fonte disponível contém apenas um resumo editorial e não reporta os resultados das demais fases, os nomes dos modelos investigados ou métricas quantitativas. Portanto, até o momento, confirma-se apenas a concepção do teste causal, mas não o seu resultado.