Gemini 3.5 Transcribe превращает речь в чистый текст Google выпустила…
Gemini 3.5 Transcribe превращает речь в чистый текст
Google выпустила Gemini 3.5 Transcribe — новую модель для распознавания речи, которая уже претендует на место среди лучших в классе.
Она не просто переводит аудио в текст, а сразу приводит речь в нормальный вид: убирает «эээ», слова-паразиты, оговорки и понимает, когда человек исправляет себя прямо во время фразы.
На выходе получается не сырая стенограмма, а аккуратный отформатированный абзац. То есть меньше ощущения, что вы читаете расшифровку созвона, где все говорили одновременно и забыли тему встречи.
Что умеет:
— различает до трёх спикеров
— поддерживает 85+ языков
— понимает смешение языков в одной фразе
— чистит сбивчивую речь
— форматирует результат
— быстрее отдаёт финальную расшифровку
По тестам Artificial Analysis, в нестриминговом режиме Word Error Rate составляет всего 2,6%, а время до готового текста сократилось на 70% по сравнению с предыдущей моделью Chirp 3.
Модель уже доступна в API, Gboard на Android и приложении Gemini для macOS.
Похожие записи
Оцените материал:
Похожие записи
Минцифры объявило о коммерческом запуске 5G в России. Но сеть…
15.09.2026
GPT-6 ASTRA: НОВАЯ ЭРА ИЛИ ОЧЕРЕДНОЙ ХАЙП? 3 сентября, пока…
15.09.2026
Чтобы РАЗОГНАТЬ мозг, достаточно всего 10 минут бега со скоростью…
15.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
