Новости робототехники

Новая модель ИИ от Microsoft учит роботов выполнять сложные задачи по словесной инструкции

Новая модель ИИ от Microsoft учит роботов выполнять сложные задачи по словесной инструкции

NOVOSTI

Корпорация Microsoft представила новую модель искусственного интеллекта, призванную вывести роботов за пределы контролируемых заводских условий. Система под названием Rho-alpha нацелена на преодоление одного из давних ограничений в робототехнике: неспособности адаптироваться к непредсказуемым условиям реального мира.

Разработанная Microsoft Research, Rho-alpha является первой специализированной робототехнической моделью компании, созданной на основе технологий её семейства языково-визуальных моделей Phi. Microsoft описывает ее как часть более масштабного перехода к физическому ИИ, где интеллектуальные агенты взаимодействуют непосредственно с физическим миром, а не только с цифровым пространством.

В отличие от традиционных промышленных роботов, Rho-alpha не полагается на жесткие программные сценарии. Модель преобразует инструкции на естественном языке в управляющие сигналы для роботов, выполняющих сложные задачи двухрукого манипулирования. В настоящее время корпорация тестирует систему на платформах с двумя манипуляторами и на гуманоидных роботах.

Эшли Льоренс, корпоративный вице-президент и управляющий директор Microsoft Research, отметил, что робототехника исторически отставала от прогресса в языковом и компьютерном зрении. Последние достижения теперь позволяют машинам воспринимать окружение, принимать решения и действовать с большей автономией в менее структурированных средах. Microsoft полагает, что эта конвергенция может изменить принципы совместной работы роботов и людей.

Rho-alpha выходит за рамки стандартных моделей «зрение-язык-действие», интегрируя тактильное восприятие. Это позволяет роботам корректировать свои движения на основе осязания, а не полагаться исключительно на визуальный ввод. В будущих версиях Microsoft планирует добавить силомоментное восприятие и другие модальности.

Адаптивность находится в центре дизайна системы. Rho-alpha может менять свое поведение непосредственно в процессе работы, вместо того чтобы зависеть только от заранее обученных реакций. Когда робот совершает ошибку, операторы-люди могут вмешаться, используя интуитивные инструменты, например, трехмерные устройства ввода. После этого модель обучается на основе этой корректирующей обратной связи. Microsoft также работает над методами, позволяющими системе непрерывно совершенствоваться после развертывания. В компании уверены, что роботы, адаптирующиеся к человеческим предпочтениям, будут более полезными и заслужат больше доверия в реальных условиях.

Изначально Rho-alpha будет предлагаться в рамках программы раннего доступа для исследований. Позже Microsoft планирует сделать модель более широко доступной через свою платформу Foundry.

Одной из самых больших проблем в робототехнике остается нехватка обучающих данных. Сбор демонстраций путем телеуправления роботами работает в ограниченных сценариях, но становится непрактичным во многих реальных условиях. Исследователи, работающие с Microsoft, утверждают, что симуляция предоставляет масштабируемую альтернативу. Синтетические демонстрации могут расширять наборы обучающих данных без постоянного участия человека.

Rho-alpha обучается с помощью комбинации демонстраций на физических роботах, смоделированных задач и масштабных данных для обучения ответам на вопросы по изображениям. Такой подход помогает модели связать понимание языка с движением, учитывающим тактильные ощущения. Microsoft генерирует значительную часть своих синтетических данных с помощью конвейеров обучения с подкреплением, построенных на инструментах симуляции робототехники, работающих на инфраструктуре Azure. Затем инженеры объединяют эти смоделированные траектории с коммерческими и открытыми наборами данных, собранными с физических роботов.

Партнеры отрасли заявляют, что физически точное моделирование помогает преодолеть недостаток разнообразных данных для робототехники. Они утверждают, что этот метод ускоряет разработку систем, способных выполнять сложные задачи манипулирования.

Microsoft позиционирует Rho-alpha как часть более широкой инициативы, чтобы дать компаниям в области робототехники больше контроля над тем, как они обучают и развертывают интеллектуальные системы. Корпорация стремится предоставить инструменты, позволяющие производителям и интеграторам использовать собственные данные со своими роботами.

По мере того как роботы приближаются к средам, где находятся люди, Microsoft считает, что их успех будет определяться адаптивностью. Rho-alpha знаменует собой последнюю попытку компании вывести передовые возможности ИИ из облака в физический мир.

Источник: new-science.ru

Источник: ai-news.ru

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ Мост между SAST и фаззингом: как из сработки SAST получить подтверждённую уязвимость Архив рубрики ~Лента новостей~ Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта Архив рубрики ~Лента новостей~ Эта технология показала хорошие результаты. Системы обороны — это будущее. Архив рубрики ~Коротко из Telegram~ Нейронку БЕЗ ЦЕНЗУРЫ выпустили в открытый доступ — Gemma 4… Архив рубрики ~Коротко из Telegram~ Нашли комбайн для скачивания видео и музыки практически отовсюду —… Архив рубрики ~Коротко из Telegram~ Инструменты дня 🔍 Кьюи Перепроверяет ChatGPT, Claude и Gemini перед отправкой, потому… Архив рубрики ~Коротко из Telegram~ Kimi K3 нашла уязвимость в Redis за 27 минут Исследователь… Архив рубрики ~Коротко из Telegram~ Alibaba представила мощный движок синтеза речи Qwen-Audio-3.0-TTS Команда Qwen выпустила… Архив рубрики ~Коротко из Telegram~ Lightricks научила ИИ убирать лишних людей и машины с видео… Архив рубрики ~Коротко из Telegram~ Copilot теперь живет в «Проводнике» Windows 11 Microsoft продолжает встраивать… Архив рубрики ~Коротко из Telegram~ GitHub Copilot теперь поддерживает модель Gemini 3.6 Flash GitHub начал… Архив рубрики ~Коротко из Telegram~ Anthropic представила плагин Claude Security для поиска уязвимостей Anthropic выпустила… Архив рубрики ~Коротко из Telegram~ Cursor Router: снижение стоимости запросов к ИИ на 60% Команда… Архив рубрики ~Коротко из Telegram~ Российский разработчик СУБД Postgres Pro может сократить до 30% сотрудников…. Архив рубрики ~Лента новостей~ Мост между SAST и фаззингом: как из сработки SAST получить подтверждённую уязвимость Архив рубрики ~Лента новостей~ Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта Архив рубрики ~Лента новостей~ Эта технология показала хорошие результаты. Системы обороны — это будущее. Архив рубрики ~Коротко из Telegram~ Нейронку БЕЗ ЦЕНЗУРЫ выпустили в открытый доступ — Gemma 4… Архив рубрики ~Коротко из Telegram~ Нашли комбайн для скачивания видео и музыки практически отовсюду —… Архив рубрики ~Коротко из Telegram~ Инструменты дня 🔍 Кьюи Перепроверяет ChatGPT, Claude и Gemini перед отправкой, потому… Архив рубрики ~Коротко из Telegram~ Kimi K3 нашла уязвимость в Redis за 27 минут Исследователь… Архив рубрики ~Коротко из Telegram~ Alibaba представила мощный движок синтеза речи Qwen-Audio-3.0-TTS Команда Qwen выпустила… Архив рубрики ~Коротко из Telegram~ Lightricks научила ИИ убирать лишних людей и машины с видео… Архив рубрики ~Коротко из Telegram~ Copilot теперь живет в «Проводнике» Windows 11 Microsoft продолжает встраивать… Архив рубрики ~Коротко из Telegram~ GitHub Copilot теперь поддерживает модель Gemini 3.6 Flash GitHub начал… Архив рубрики ~Коротко из Telegram~ Anthropic представила плагин Claude Security для поиска уязвимостей Anthropic выпустила… Архив рубрики ~Коротко из Telegram~ Cursor Router: снижение стоимости запросов к ИИ на 60% Команда… Архив рубрики ~Коротко из Telegram~ Российский разработчик СУБД Postgres Pro может сократить до 30% сотрудников….