GPT-6 Astra получил противоречивые оценки в тестах. Epoch AI поставила модель впереди с результатом 169 баллов, тогда как Artificial Analysis оценила ее не выше предшественника и ниже Claude Fable 5.1.

Наибольшее внимание привлек ARC-AGI-3: согласно представленному описанию, Astra впервые работала эффективнее среднего человека. Глава ARC Prize Франсуа Шолле не считает это доказательством AGI, но заявил, что прогресс идет примерно вдвое быстрее его ожиданий и пересмотрел свой прогноз по срокам AGI.

Для интерпретации результата важно учитывать ограниченность доступных данных: в пакете есть только синопсис The Decoder, а не полные методики тестов или первичные заявления участников. Поэтому сопоставлять цифры разных оценок напрямую пока нельзя.