Лаборатория Tongyi, входящая в состав Alibaba, объявила о выпуске системы синтеза речи Qwen-Audio-3.0-TTS. Новая модель ориентирована на производственное использование и доступна исключительно в виде облачного сервиса через платформу Alibaba Cloud Model Studio, без возможности загрузки весов модели локально.

Разработчики предлагают две вариации системы из единой линейки. Версия Flash оптимизирована для задач, требующих взаимодействия в реальном времени, тогда как версия Plus нацелена на генерацию аудио высокого качества. Обе версии поддерживают работу с текстом на 16 языках.

Доступ к новым инструментам осуществляется через хостинг провайдера, что определяет архитектуру их внедрения в сторонние приложения. Информация о релизе основана на сообщениях технологических изданий, отслеживающих обновления в сфере искусственного интеллекта.