A Apple Machine Learning Research apresentou um estudo sobre o quão consistentemente grandes modelos de linguagem atualizam suas crenças probabilísticas quando novas evidências surgem. Os autores descrevem essa questão por meio de desvios em relação à atualização bayesiana.

O trabalho propõe uma abordagem que encara os modelos de linguagem como regras de processamento de informação e mede a diferença entre suas atualizações e a atualização bayesiana. Na descrição do estudo, medicina, ciência e direito são citadas como áreas onde, com base nos dados disponíveis, muitas vezes não há uma única resposta correta.

O valor prático da abordagem está ligado à verificação do comportamento dos modelos em tarefas com incerteza. No entanto o conjunto fornecido contém apenas um resumo editorial: não há dados sobre os modelos testados, experimentos, resultados numéricos ou comparações entre sistemas.