Закажи экспресс-аудит своего дела онлайн всего за 199 ₽
и получи рекомендации по улучшению - Жми сюда !

Google представила модель Gemini, которая заполняет в браузере формы и играет в 2048

Компания Google представила предварительную версию новой ИИ-модели Gemini 2.5 с функцией Computer Use, которая способна взаимодействовать с веб-сайтами через браузер, имитируя действия человека. Модель применяет визуальное понимание и логическое рассуждение для выполнения, например, таких задач, как заполнение и отправка форм без использования API или другого программного интерфейса.

 Источник изображения: Solen Feyissa/Unsplash

Источник изображения: Solen Feyissa/Unsplash

Как сообщает The Verge, модель Gemini 2.5 Computer Use предназначена для работы с пользовательскими интерфейсами, созданными для людей, а не для автоматизированных систем. По заявлению Google, технология уже применялась в агентских функциях AI Mode и в исследовательском прототипе Project Mariner, где ИИ-агенты самостоятельно выполняли задачи в браузере, например, добавляли товары в корзину на основе списка ингредиентов.

Интересно, что анонс новой модели состоялся спустя день после того, как OpenAI представила новые приложения для ChatGPT в рамках ежегодного мероприятия Dev Day, продолжив развитие функции ChatGPT Agent, способной выполнять сложные задачи от имени пользователя. При этом Anthropic ещё в прошлом году выпустила версию модели Claude с функцией Computer Use. Однако Google заявляет, что её модель «превосходит ведущие аналоги по нескольким веб- и мобильным бенчмаркам».

В отличие от ChatGPT Agent и инструмента Anthropic, Gemini 2.5 Computer Use имеет доступ только к браузеру, а не ко всей операционной системе. Google подчеркнула, что решение «пока не оптимизировано для управления на уровне настольной ОС» и поддерживает 13 действий, включая открытие веб-браузера, ввод текста, а также перетаскивание элементов.

Сообщается, что модель уже доступна разработчикам через платформы Google AI Studio и Vertex AI. Кроме того, публичная демонстрация размещена в виртуальном браузере BrowserBase, где можно наблюдать, как ИИ выполняет такие задачи, как «сыграть в игру 2048» или «просмотреть Hacker News в поисках обсуждаемых тем».

Источник: 3dnews.ru

Источник: ai-news.ru

✅ Найденные теги: Google, новости

Нет других записей в этой рубрике.

Новости других рубрик

Архив рубрики ~Лента новостей~: Системный промпт или галлюцинация: как я проверял AI-ассистентов и что ответили bug bounty-команды Архив рубрики ~Лента новостей~: Метаанализ указал на максимальную эффективную дозу лекарств при СДВГ. И позволил оценить риск отказа от лекарств в зависимости от дозы Архив рубрики ~Лента новостей~: Microsoft и Atom Computing делятся своими достижениями в области квантовых вычислений. Архив рубрики ~Лента новостей~: Производные кумарина научили бороться с бактериальными биопленками: Химия и науки о материалах Архив рубрики ~Лента новостей~: Отработанные батареи роботакси Waymo будут использоваться в качестве накопителей энергии для электросетей. Архив рубрики ~Лента новостей~: «Калашников» торжественно открыл уникальный высокотехнологичный завод по производству АСХ и промышленных роботов в Санкт-Петербурге Архив рубрики ~Лента новостей~: Немецкие геймеры больше не обращают внимание на платформу AMD AM4 Архив рубрики ~Лента новостей~: МегаФон запустит первую private 5G в промышленности