🤖 Alibaba выпустила Qwen-Audio-3.0-TTS - новую модель для синтеза речи
Alibaba Group представила систему Qwen-Audio-3.0-TTS, занявшую первое место в рейтинге Artificial Analysis TTS Arena. Модель доступна в версиях Flash для реального времени и Plus для максимально естественного звучания. Система поддерживает 16 языков и позволяет управлять эмоциями через 86 специальных тегов.
🌍 Выход SOTA-модели задает новый стандарт для коммерческих AI-ассистентов. Использование низкочастотного токенизатора (12.5 Hz) значительно снижает стоимость инференса.
👤 Теперь можно создавать качественную озвучку с передачей эмоций и клонировать голос по зашумленным записям.
Источник 1: https://funaudiollm.github.io/qwen-audio-3.0-tts/ Источник 2: https://www.alibabacloud.com/help/en/model-studio/realtime-tts-user-guide
