MIT Technology Review AI опубликовал материал о семи тестах, связанных с головоломками и играми. Из описания следует, что они предназначены для проверки того, насколько хорошо модели справляются с задачами, которые могут выявлять пробелы в их интеллектуальных возможностях.

Практическая ценность публикации — в предложении проверить эти задания самостоятельно и сопоставить человеческое решение с результатами ИИ. Однако доступный источник представлен только метаданными страницы и не содержит подробностей о конкретных моделях, ответах или методике.

Поэтому нельзя сделать вывод о том, какие системы ошибались, насколько часто это происходило и превосходит ли человек модели в этих тестах.