
Лаборатория Tongyi, входящая в состав Alibaba, объявила о выпуске системы синтеза речи Qwen-Audio-3.0-TTS. Новая модель ориентирована на производственное использование и доступна исключительно в виде облачного сервиса через платформу Alibaba Cloud Model Studio, без возможности загрузки весов модели локально.
Разработчики предлагают две вариации системы из единой линейки. Версия Flash оптимизирована для задач, требующих взаимодействия в реальном времени, тогда как версия Plus нацелена на генерацию аудио высокого качества. Обе версии поддерживают работу с текстом на 16 языках.
Доступ к новым инструментам осуществляется через хостинг провайдера, что определяет архитектуру их внедрения в сторонние приложения. Информация о релизе основана на сообщениях технологических изданий, отслеживающих обновления в сфере искусственного интеллекта.
комментарий редакции
Что это значит
Вероятным следствием станет рост зависимости разработчиков приложений от экосистемы Alibaba Cloud для функций синтеза речи. Следующим наблюдаемым сигналом станет появление интеграций этой модели в популярные сторонние сервисы или снижение цен на конкурирующие открытые решения. Неопределенность сохраняется относительно реальной производительности системы по сравнению с аналогами из-за отсутствия независимых тестов.