N-Hub. Нейросети и ИИ. Нейро новости. Технологии

@channel_NHub
Фото 🔥 Alibaba выкатила Qwen-Audio-3.1-TTS Теперь один запрос = готовый аудиоэпизод: диалоги, фоновые звуки, эффекты — всё в одном. 🔗Источник тут ✅ 16 языков (в т. ч. русский) + 20 китайских диалектов. ✅ Кросс-языковой тембр — голос остаётся узнаваемым при смене языка. ✅ Управление интонацией текстом + 86 тегов для вздохов, пауз и др. ✅ До 3 минут аудио за раз, качество 48 кГц. ✅ Клонирование голоса по 10–20 сек записи, работает даже с шумом. ✅ TTS-Next: диалоги + эффекты + атмосфера из одного сценария (пока англ. и кит.). ✅ Цены снижены на ~70%, доступ через Alibaba Cloud. Модель пока в облаке (Alibaba Cloud), русского системного голоса почти нет — зато можно клонировать свой. Идеально для подкастов, озвучки туториалов и контента. Как говорится: «слово — серебро, а голос — золото!» 💎
Если у вас установлено приложение,
вы можете сразу перейти в канал