Hume AI показала быструю голосовую модель с естественным звучанием Исследователи…
Hume AI показала быструю голосовую модель с естественным звучанием
Исследователи из Hume AI представили новую систему синтеза речи, ориентированную на естественное звучание и высокую скорость генерации.
Главная особенность технологии — жёсткая синхронизация текста и аудио, благодаря чему модель работает примерно в пять раз быстрее многих аналогичных решений.
Как это устроено:
— используется точное соответствие между текстовыми токенами и аудио-векторами
— модель генерирует полный речевой сегмент для каждого текстового токена за один шаг
— генерация не привязана к фиксированной частоте, как у многих классических TTS-моделей
Такой подход позволяет избежать распространённых проблем синтеза речи:
— модель не добавляет лишние слова
— не пропускает фрагменты текста
— лучше сохраняет смысл и структуру длинных фраз
Ещё одна важная особенность — компактность моделей. Версии на 2B и 4B параметров могут работать локально на устройствах, включая смартфоны, без подключения к облаку.
Благодаря этому система подходит для:
— голосовых ассистентов
— локальных ИИ-агентов
— офлайн-озвучки длинных текстов
— мобильных приложений с синтезом речи.
Похожие записи
Оцените материал:
Похожие записи
Нидерландцы подали коллективный судебный иск от имени 1,7 млн пользователей…
16.07.2026
ИИ начинает «игнорировать» команды — и это уже фиксируют исследования…
11.04.2026
PinchBench — бенчмарк для оценки LLM-моделей в работе с OpenClaw….
11.03.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
