
Z.ai и Qwen, согласно материалу MarkTechPost, независимо выпустили модели с близкой архитектурой. В описании упоминаются соотношение линейных компонентов 3:1, сжатые индексаторы, управляемые остаточные связи и обучение с использованием Muon.
Речь идет о GLM-5.3-Flash и Qwen3.8-Flash-Next. Источник представляет их как пример самостоятельного сходства архитектурных решений двух китайских AI-лабораторий.
Практическое значение такого сближения пока нельзя оценить по имеющимся данным: в пакете нет результатов тестов, подробностей о продуктах или подтверждений от самих Z.ai и Qwen. Поэтому открытым остается вопрос, дают ли эти решения сопоставимые преимущества в скорости, качестве или стоимости.
комментарий редакции
Что это значит
Вероятное следствие — дальнейшее внимание к сходным конструкциям быстрых моделей и их практической эффективности. Следующим наблюдаемым сигналом станут первичные технические материалы, тесты или заявления Z.ai и Qwen. Существенная неопределенность сохраняется из-за единственного источника и отсутствия подробных измерений.