Google представила новую функцию Agentic Vision для модели Gemini 3…
Google представила новую функцию Agentic Vision для модели Gemini 3 Flash, которая превращает анализ изображений из статического восприятия в активный исследовательский процесс. Используя цикл «думай, действуй, наблюдай», модель теперь может самостоятельно писать и выполнять код на Python для манипуляций с картинкой — например, приближать мелкие детали, поворачивать изображение или наносить разметку для подсчета объектов, что повышает точность ответов на 5–10%. Эта возможность, позволяющая модели динамически взаимодействовать с визуальными данными, уже доступна разработчикам через API в Google AI Studio и Vertex AI, а также начинает внедряться в приложении Gemini👌
http://blog.google/innovation-and-ai/technology/developers-tools/agentic-vision-gemini-3-flash/
Похожие записи
Оцените материал:
Похожие записи
На рабочем столе теперь можно завести собственную ИИ-вайфу. Animates…
07.09.2026
1200 ИИ-агентов сговорились и устроили коллективный взлом Hugging Face….
07.09.2026
Почти половина российских компаний планирует увеличить использование облачных и ИИ-сервисов….
07.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
