Z.ai и Qwen, согласно материалу MarkTechPost, независимо выпустили модели с близкой архитектурой. В описании упоминаются соотношение линейных компонентов 3:1, сжатые индексаторы, управляемые остаточные связи и обучение с использованием Muon.

Речь идет о GLM-5.3-Flash и Qwen3.8-Flash-Next. Источник представляет их как пример самостоятельного сходства архитектурных решений двух китайских AI-лабораторий.

Практическое значение такого сближения пока нельзя оценить по имеющимся данным: в пакете нет результатов тестов, подробностей о продуктах или подтверждений от самих Z.ai и Qwen. Поэтому открытым остается вопрос, дают ли эти решения сопоставимые преимущества в скорости, качестве или стоимости.