Исследователи разработали четырёхфазную методику, чтобы проверить, используют ли языковые модели сигналы собственной уверенности при выборе между ответом и воздержанием. На первом этапе уверенность моделей измеряли без возможности отказаться от ответа.

Исследование опубликовано в Nature Machine Intelligence под заголовком «Causal evidence that language models use confidence to drive behaviour». В описании работы метакогниция рассматривается как оценка качества собственных когнитивных действий, связанная с адаптивным поведением у разных видов.

Доступный источник содержит только издательское резюме и не сообщает результаты остальных этапов, названия исследованных моделей или количественные показатели. Поэтому пока подтверждена постановка причинного теста, но не его итог.