🔥 Alibaba выкатила Qwen-Audio-3.1-TTS
Теперь один запрос = готовый аудиоэпизод: диалоги, фоновые звуки, эффекты — всё в одном.
🔗Источник тут
✅ 16 языков (в т. ч. русский) + 20 китайских диалектов.
✅ Кросс-языковой тембр — голос остаётся узнаваемым при смене языка.
✅ Управление интонацией текстом + 86 тегов для вздохов, пауз и др.
✅ До 3 минут аудио за раз, качество 48 кГц.
✅ Клонирование голоса по 10–20 сек записи, работает даже с шумом.
✅ TTS-Next: диалоги + эффекты + атмосфера из одного сценария (пока англ. и кит.).
✅ Цены снижены на ~70%, доступ через Alibaba Cloud.
Модель пока в облаке (Alibaba Cloud), русского системного голоса почти нет — зато можно клонировать свой. Идеально для подкастов, озвучки туториалов и контента.
Как говорится: «слово — серебро, а голос — золото!» 💎
Теперь один запрос = готовый аудиоэпизод: диалоги, фоновые звуки, эффекты — всё в одном.
🔗Источник тут
✅ 16 языков (в т. ч. русский) + 20 китайских диалектов.
✅ Кросс-языковой тембр — голос остаётся узнаваемым при смене языка.
✅ Управление интонацией текстом + 86 тегов для вздохов, пауз и др.
✅ До 3 минут аудио за раз, качество 48 кГц.
✅ Клонирование голоса по 10–20 сек записи, работает даже с шумом.
✅ TTS-Next: диалоги + эффекты + атмосфера из одного сценария (пока англ. и кит.).
✅ Цены снижены на ~70%, доступ через Alibaba Cloud.
Модель пока в облаке (Alibaba Cloud), русского системного голоса почти нет — зато можно клонировать свой. Идеально для подкастов, озвучки туториалов и контента.
Как говорится: «слово — серебро, а голос — золото!» 💎