Google представила новую функцию Agentic Vision для модели Gemini 3…
Google представила новую функцию Agentic Vision для модели Gemini 3 Flash, которая превращает анализ изображений из статического восприятия в активный исследовательский процесс. Используя цикл «думай, действуй, наблюдай», модель теперь может самостоятельно писать и выполнять код на Python для манипуляций с картинкой — например, приближать мелкие детали, поворачивать изображение или наносить разметку для подсчета объектов, что повышает точность ответов на 5–10%. Эта возможность, позволяющая модели динамически взаимодействовать с визуальными данными, уже доступна разработчикам через API в Google AI Studio и Vertex AI, а также начинает внедряться в приложении Gemini👌
http://blog.google/innovation-and-ai/technology/developers-tools/agentic-vision-gemini-3-flash/
Похожие записи
Оцените материал:
Похожие записи
Veo 3.1 уже на подходе — обновление, которое стоит ждать…
17.10.2025
Новости мира нейросетей и AI 1️⃣ Google DeepMind откроет автоматизированную…
16.12.2025
Британия: Молодое поколение отказывается от премиум-подписок в пользу MP3-плееров
19.08.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
