Alibaba представила мощный движок синтеза речи Qwen-Audio-3.0-TTS Команда Qwen выпустила…
Alibaba представила мощный движок синтеза речи Qwen-Audio-3.0-TTS
Команда Qwen выпустила облачную модель для генерации аудио. Релиз сразу разделили на две версии: Flash для минимальных задержек и Plus для высокого качества тембра.
Заявлена поддержка 16 языков, включая русский. Модель умеет клонировать голос по шумной записи и выдает до трёх минут звука за один проход. По данным тестов, система лидирует в рейтинге Artificial Analysis.
Стоит учитывать, что часть громких обещаний пока остается маркетинговыми формулировками. Перед внедрением лучше проверить, как заявленные функции работают через API.
Похожие записи
- «Узкое место» в пространственной биологии: почему модели ИИ терпят неудачу при работе со сложными тканями и что на самом деле помогает это исправить.
- Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта
- Нейронку БЕЗ ЦЕНЗУРЫ выпустили в открытый доступ — Gemma 4…
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
