Alibaba добавила синтез речи в Qwen Chat: ответы звучат как живые
Компания Alibaba Cloud сделала шаг вперед в развитии голосовых интерфейсов, интегрировав в чат-бот Qwen Chat функцию озвучивания ответов. Теперь при нажатии на иконку динамика под сообщением текст преобразуется в речь с помощью новой модели Qwen3-TTS . Функция уже работает в веб-версии, а также в приложениях для iOS и Android.
Технология Qwen3-TTS
Qwen3-TTS предлагает 17 голосов — от мягких женских до энергичных мужских. Среди них Cherry, Ethan и Katerina, которые умеют передавать интонации и эмоции. Задержка минимальна: аудио генерируется за 97 миллисекунд , что делает воспроизведение почти мгновенным.
Модель поддерживает мультиязычность : от китайского с девятью диалектами до английского, испанского, русского, итальянского, французского, корейского, японского, немецкого и португальского. Это делает Qwen Chat удобным инструментом для глобальной аудитории, а также полезным для людей, которым сложно читать текст — например, водителей или слабовидящих.
Открытый доступ и API
Для разработчиков доступна версия Qwen3-TTS-Flash , ориентированная на скорость. Она работает через API Alibaba Cloud и стоит всего 0,1 доллара за 10 тысяч символов (≈9 рублей). Модель распространяется с открытым кодом под лицензией Apache 2.0 , что дает возможность интегрировать ее в приложения, ассистентов или образовательные сервисы.
Значение для рынка
Эксперты отмечают, что Qwen усиливает позиции Alibaba в гонке голосового ИИ, догоняя и в чем-то опережая конкурентов вроде GPT-4o от OpenAI . Поддержка русского языка делает сервис актуальным для пользователей в России и СНГ: он подойдет и для обучения, и для развлечений, и для рабочих задач.
Alibaba уже заявила, что планирует улучшать Qwen3-TTS, добавив эмоциональную адаптацию и возможность интеграции с видео. А пока любой желающий может попробовать функцию прямо на chat.qwen.ai .