
Инженер Anthropic Jackson Kernion объяснил, почему новые модели Claude, по описанию The Decoder, стали писать непривычно. Оптимизация под математику, программирование и технические объяснения для других ИИ привела к стилю, который люди могут воспринимать как чрезмерно плотные информационные блоки.
В материале говорится, что Opus 5.5 пытается исправить эту особенность, тогда как Opus 4.6 остается наиболее сильной моделью для чисто писательских задач. Источник не приводит подробностей о методике сравнения и основан на синопсисе публикации, а не на полном тексте.
Для пользователей это подчеркивает практический компромисс: рост технических возможностей модели не обязательно делает ее ответы более ясными и естественными. Вопрос о том, насколько эффект распространен и измерим, остается открытым.
комментарий редакции
Что это значит
Вероятное последствие — большее внимание к ясности и естественности текста как к отдельному критерию качества ИИ. Следующим наблюдаемым сигналом будут независимые сравнения Opus 5.5 и Opus 4.6 на писательских задачах. Существенная неопределенность связана с тем, что выводы представлены через один синопсис The Decoder без полного текста и дополнительного подтверждения.
Дополнительные оценки
Ollama Cloud
GLM 5.2
Публичный пакет описывает знакомую дилемму: оптимизация под измеримые технические бенчмарки и машинно-читаемый формат деформирует человеческое восприятие текста. Вероятное последствие — рост спроса на отдельную настройку «писательского голоса» как самостоятельной оси качества, а не побочного продукта. Следующим наблюдаемым сигналом станут независимые слепые сравнения Opus 5.5 и 4.6 на литературных и редакционных задачах. Существенная неопределённость обусловлена единственным источником в формате синопсиса: без полного текста и методологии сравнения вывод о превосходстве 4.6 остаётся анекдотичным.
В чём оценки сходятся- Связь между технической оптимизацией и ухудшением читаемости — правдоподобная интерпретация, не доказывающая общего снижения качества.
- Единственный источник в формате синопсиса без полного текста — слабое основание для категоричных выводов о превосходстве конкретной версии.
- Рост технических способностей не гарантирует большей ясности текста — корректный стратегический вывод редакции.
- Заявление о превосходстве Opus 4.6 в письме может отражать ностальгию ранних пользователей, а не измеримое преимущество — без методологии это не отделить.
- Фрейминг «модель стала умнее, но пишет хуже» упрощает: стиль мог целенаправленно меняться под запросы разработчиков, а не деградировать.
- Отсутствие независимого подтверждения делает даже базовый факт о причинах изменения стиля непроверяемым за пределами одной публикации.
Ollama Cloud
Kimi K2.6
Конфликт между технической оптимизацией и человеческой читаемостью — фундаментальная проблема отрасли, которая будет усугубляться с ростом мультимодальных и агентных систем. Следующим сигналом станут независимые бенчмарки писательских задач и реакция enterprise-клиентов на Opus 5.5. Существенная неопределённость в том, насколько описанный эффект масштабен и воспроизводим: синопсис одного источника без методологии не позволяет отделить системную тенденцию от субъективного восприятия отдельных пользователей.
В чём оценки сходятся- Техническая оптимизация под математику и код действительно может смещать распределение вероятностей в сторону плотных, формальных структур текста.
- Разрыв между способностями модели и воспринимаемым качеством письма — важное различие, которое часто игнорируется в метриках.
- Opus 4.6 как референс для писательских задач создаёт ожидание, которое Anthropic придётся подтверждать или корректировать публично.
- Источник не исключает, что «ухудшение» — это адаптация к изменившимся ожиданиям пользователей, а не абсолютное снижение качества.
- Отсутствие данных о методике сравнения делает заявление о превосходстве Opus 4.6 предварительным, а не установленным фактом.
- Не рассмотрена гипотеза, что «плотный стиль» может быть предпочтителен для части аудитории — исследователей, разработчиков, носителей технических специальностей.