OpenAI открыла исходники голосового компонента для приложений на gpt-realtime-1.5

OpenAI открыла исходники голосового компонента для приложений на gpt-realtime-1.5
OpenAI опубликовала на GitHub открытый React-компонент под названием realtime-voice-component. Это готовая основа для разработчиков, которые хотят добавить голосовое управление в свои приложения на базе модели gpt-realtime-1.5.
Вместо того чтобы пользователь кликал по кнопкам и заполнял формы, он просто говорит голосом и управляет состоянием приложения через речь. Компонент берет на себя всю работу с микрофоном, подключением к API и обработкой аудиопотока.
Сама модель gpt-realtime-1.5 вышла в феврале этого года. По сравнению с предыдущей версией: точность распознавания буквенно-цифровых последовательностей выросла на 10%, следование инструкциям улучшилось на 7%, вызов инструментов стал надежнее.
Цена осталась прежней: 32 доллара за миллион аудио-токенов на входе и 64 на выходе.
Похожие записи
- На фоне падения акций Reddit генеральный директор ставит под сомнение целесообразность инвестиций в ИИ от Google.
- Новые способы обучения и преподавания с помощью ChatGPT Work и Codex | OpenAI
- Пока все обсуждали закон об ИИ, Россия успела запустить агента на треть офиса и взяться за раздел дата-центров
Оцените материал:
Похожие записи
Италия первой в ЕС утвердила закон об ИИ 18 сентября…
04.10.2025
Dia: новый ИИ-браузер — альтернатива Perplexity Comet для умного поиска…
15.10.2025
Яндекс выпустил самое МОЩНОЕ обновление Алисы за всю её историю…
28.10.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
