Apple Machine Learning Research presentó un estudio sobre qué tan consistentemente las grandes modelos de lenguaje actualizan sus creencias probabilísticas ante la aparición de nuevas evidencias. Los autores describen la cuestión a través de la desviación respecto a la actualización bayesiana.

En el trabajo se propone un enfoque que considera a los modelos de lenguaje como reglas de procesamiento de información y mide la brecha entre sus actualizaciones y la actualización bayesiana. En la descripción del estudio, la medicina, la ciencia y el derecho se mencionan como áreas en las que a menudo no basta una única respuesta correcta con los datos disponibles.

El valor práctico del enfoque está relacionado con verificar el comportamiento de los modelos en tareas con incertidumbre. Pero el paquete proporcionado contiene solo un resumen editorial: no incluye datos sobre modelos evaluados, experimentos, resultados numéricos o comparaciones entre sistemas.