Google представила новую функцию Agentic Vision для модели Gemini 3…
Google представила новую функцию Agentic Vision для модели Gemini 3 Flash, которая превращает анализ изображений из статического восприятия в активный исследовательский процесс. Используя цикл «думай, действуй, наблюдай», модель теперь может самостоятельно писать и выполнять код на Python для манипуляций с картинкой — например, приближать мелкие детали, поворачивать изображение или наносить разметку для подсчета объектов, что повышает точность ответов на 5–10%. Эта возможность, позволяющая модели динамически взаимодействовать с визуальными данными, уже доступна разработчикам через API в Google AI Studio и Vertex AI, а также начинает внедряться в приложении Gemini👌
http://blog.google/innovation-and-ai/technology/developers-tools/agentic-vision-gemini-3-flash/
Похожие записи
Оцените материал:
Похожие записи
‼️Российский интернет ОТКЛЮЧАТ от мирового при вмешательстве в выборы-2026 —…
11.11.2025
⚡️ NVIDIA анонсировала DLSS 5 — нейросеть теперь сама дорисовывает…
22.03.2026
В Сан-Франциско открылся целый магазин, которым управляет нейросеть — и…
15.04.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
