Alibaba представила Qwen3.8-Flash-Next как предварительный показ архитектуры Qwen4. По данным The Decoder, это модель типа mixture-of-experts: для каждого токена активируются 6 из 125 млрд параметров.

В описании источника говорится, что обучение модели обошлось в девять раз дешевле, чем у сопоставимой базы, а на тестах программирования и офисных задач она превзошла более крупные DeepSeek-V4-Flash и Claude Opus 4.6.

Если эти результаты подтвердятся, разработчики моделей столкнутся с дополнительным давлением на стоимость своих предложений. Но источник представлен только метаданными и синопсисом, поэтому независимое подтверждение результатов и деталей сравнения отсутствует.