Можно ли интегрировать с WordPress?

Да, мы используем REST API и Application Passwords — без передачи логина и пароля. Все публикации идут от имени автора.

Работает ли ИИ с Telegram?

Полностью. ИИ может как читать каналы, так и публиковать в ваш канал. Также подключаем inline-ботов и формы сбора лидов.

Сколько времени занимает настройка?

От 3 до 7 дней. Зависит от сложности интеграции и количества источников.

Есть ли бесплатный демо-доступ?

Да, мы запускаем 5–7 дневный демо-доступ с тестовыми данными, чтобы вы увидели систему в работе.

Безопасна ли система?

Да. Все данные хранятся изолированно. Мы не используем их для обучения моделей. Поддерживаем шифрование и резервное копирование.

Что входит в поддержку?

Обновление агентов, добавление источников, исправление ошибок, масштабирование. Поддержка 24/7 по Telegram или email.

Цветной кристалл, окружённый прозрачными пузырями диалога на белом фоне.

Тестирование показывает, что функции Google AI Overviews разглашают миллионы ложных сведений в час.

Апр 9, 2026 0

Достаточно ли 90-процентной точности для поискового робота?

Значок Близнецов и всплывающие окна чата Источник: Google Настройки текста Текст рассказа Размер Маленький Стандартный Большой Ширина * Стандартный Широкий Ссылки Стандартный Оранжевый * Только для подписчиков
Узнать больше Свернуть в навигацию

Сегодня поиск информации в Google означает столкновение с AI Overviews, поисковым роботом на базе Gemini, который появляется в верхней части страницы результатов. С момента запуска в 2024 году AI Overviews пережил непростые времена, вызвав недовольство пользователей из-за своей непостоянной точности, но сейчас он улучшается и обычно выдает правильный ответ. Однако это невысокая планка. Новый анализ от The New York Times попытался оценить точность AI Overviews, показав, что он прав в 90% случаев. С другой стороны, 1 из 10 ответов ИИ оказывается неверным, а для Google это означает сотни тысяч ложных результатов каждую минуту дня.

Газета The Times провела этот анализ с помощью стартапа Oumi, который сам активно занимается разработкой моделей искусственного интеллекта. Компания использовала инструменты ИИ для проверки обзоров ИИ с помощью теста SimpleQA, распространенного инструмента для оценки достоверности генеративных моделей, таких как Gemini. SimpleQA, выпущенный OpenAI в 2024 году, представляет собой список из более чем 4000 вопросов с проверяемыми ответами, которые можно ввести в систему ИИ.

Компания Oumi начала проводить тестирование в прошлом году, когда Gemini 2.5 еще была лучшей моделью компании. В то время тест показал точность в 85 процентов. Когда тест был повторен после обновления до Gemini 3, AI Overviews ответил правильно на 91 процент вопросов. Если экстраполировать этот процент ошибок на все поисковые запросы в Google, то AI Overviews генерирует десятки миллионов неверных ответов в день.

В отчете приводится несколько примеров ошибок, допущенных AI Overviews. Когда у модели запросили дату, когда бывший дом Боба Марли стал музеем, AI Overviews сослалась на три страницы, на двух из которых эта дата вообще не упоминалась. На последней странице, в Википедии, были указаны два противоречащих друг другу года, и AI Overviews уверенно выбрала неверный. В эталонном тесте также предлагается определить дату включения Йо-Йо Ма в Зал славы классической музыки. Хотя AI Overviews сослалась на веб-сайт организации, где была указана дата включения Ма, она заявила, что Зала славы классической музыки не существует.

Google не очень-то нравится этот тест. Представитель Google Нед Адрианс заявил газете Times, что, по мнению Google, SimpleQA содержит неверную информацию. Оценка моделей часто основывается на аналогичном тесте под названием SimpleQA Verified, который использует меньший набор вопросов, прошедших более тщательную проверку. «В этом исследовании есть серьезные недостатки, — сказал Адрианс газете Times. — Оно не отражает того, что люди на самом деле ищут в Google».

Проблемы с эталонными показателями

Оценка новых моделей ИИ порой больше напоминает искусство, чем науку, и в этом отчасти заключается проблема. У каждой компании есть свой предпочтительный способ демонстрации возможностей модели, а недетерминированная природа генно-модифицированного ИИ может затруднить проверку чего-либо. Эти роботы могут правильно ответить на фактический вопрос, а затем полностью пропустить его, если запрос повторить сразу же. Oumi даже использует инструменты ИИ для проведения своих оценок, и эти модели тоже могут галлюцинировать.

Ещё один нюанс заключается в том, что AI Overviews не представляет собой единую монолитную модель. Google сообщил Ars Technica, что использует «правильную модель» для каждого запроса. Хотя AI Overviews получал бы наилучшие ответы, постоянно используя Gemini 3.1 Pro, это медленно и затратно. Для быстрой загрузки информации на странице поиска обзор использует более быстрые модели Gemini Flash, когда это возможно (что, по всей видимости, происходит в большинстве случаев).

Реакция Google на этот отчет весьма показательна. В сфере достоверности ИИ 9 из 10 — это даже не так уж плохо. Google недавно опубликовал результаты тестов новых моделей, демонстрирующие достоверность в диапазоне от 60 до 80 процентов — эти тесты проводились без использования таких инструментов, как веб-поиск. Использование большего количества данных, например, обширных знаний людей в интернете, делает ИИ более точным, чем сама модель без данных. Однако истина где-то в синих ссылках, и AI Overviews призывает людей принимать во внимание иногда неточные сводки, вместо того чтобы проверять эти источники вручную.

Хотя Google утверждает, что результаты Times не соответствуют тому, что видят люди, возникает вопрос, откуда компания вообще могла это знать. Вы, вероятно, видели ошибки в обзорах ИИ — все мы их видели, потому что так устроен генеративный ИИ. Как напоминает сама Google внизу каждого обзора: «ИИ может ошибаться, поэтому перепроверяйте ответы».

Источник: arstechnica.com

✅ Найденные теги: AI, Google, Overviews, Ложные Сведения, новости, Тестирование

Метки:

Желто-зеленый туннель с рельсами, яркий свет в конце, графическая обработка.

ПРЕДЫДУЩАЯ ЗАПИСЬ

09.04.2026

Разработчик WireGuard VPN не может выпускать обновления программного обеспечения после блокировки учетной записи компанией Microsoft.

СЛЕДУЮЩАЯ ЗАПИСЬ

09.04.2026

Бимагрумаб в сочетании с семаглутидом: обзор нового препарата для лечения ожирения

Диаграмма процесса отбора участников исследования с условиями и исключениями.

ОСТАВЬТЕ СВОЙ КОММЕНТАРИЙ
Отменить ответ

Для отправки комментария вам необходимо авторизоваться.

Каталог бесплатных опенсорс-решений, которые можно развернуть локально и забыть о подписках

Еще новости рубрики

Архив рубрики ~Обо всем~

Фантазии

Июл 2, 2024

Архив рубрики ~Обо всем~

Мировоззрение

Июл 2, 2024

Архив рубрики ~Обо всем~

Влияние выдумщиков и фантазеров на развитие…

Июл 2, 2024

Архив рубрики ~Обо всем~

Нет ничего невозможного

Июл 2, 2024

Присоединяйтесь
к нам в

TELEGRAM

галерея

Корея проведет пилотный проект по внедрению телемедицины на основе искусственного интеллекта в Индонезии.

Акробат в костюме выступает на сцене цирка между яркими оранжевыми конструкциями.

MHRA выделяет 4,8 млн долларов на расширение программы по разработке медицинских устройств на основе искусственного интеллекта.

Логотип Департамента здравоохранения и социальных служб США на синем фоне.

Схема микрофлюидной системы с каналами для клеток и ловушек.

Что, чёрт возьми, не так с нашими повелителями-искусственным интеллектом?

Человек в пиджаке и рубашке выступает с речью на темном фоне.

НОВОСТИ ДРУГИХ РУБРИК

Архив рубрики ~Лента новостей~

Корея проведет пилотный проект по внедрению телемедицины на основе искусственного интеллекта в Индонезии.

Правительство Кореи также планирует расширить партнерство в области искусственного интеллекта в здравоохранении на Вьетнам и Таиланд. Телемедицина Фото: Мартин Барро/Getty Images Южная Корея и Индонезия проведут пилотный проект по внедрению услуг телеконсультаций на основе искусственного интеллекта в…

ЧИТАТЬ

Апр 9, 2026

Архив рубрики ~Лента новостей~

Журнал New Scientist рекомендует шоу OVO от Cirque du Soleil, посвященное насекомым.

Книги, телепередачи, игры и многое другое, чем наслаждались сотрудники журнала New Scientist на этой неделе. Шоу Ovo от Cirque du Soleil Джозеф Окпако/Getty Images Я всегда считала, что насекомые заслуживают большего внимания, поэтому я с нетерпением ждала…

ЧИТАТЬ

Апр 9, 2026

Архив рубрики ~Лента новостей~

MHRA выделяет 4,8 млн долларов на расширение программы по разработке медицинских устройств на основе искусственного интеллекта.

Текущий этап посвящен решению нормативных проблем, связанных с диагностикой на основе искусственного интеллекта. Фото: Antonio Marca / Shutterstock.com. Агентство по регулированию лекарственных средств и изделий медицинского назначения (MHRA) добилось увеличения финансирования на 3,6 млн фунтов стерлингов (4,8…

ЧИТАТЬ

Апр 9, 2026

Архив рубрики ~Лента новостей~

Генеральный директор заявил, что после завершения сделки с Novo на 2 миллиарда долларов компания Vivtex не ограничивается лишь доставкой лекарств.

Несмотря на заключение сделки, потенциально оцениваемой в 2,1 миллиарда долларов, генеральный директор Vivtex Therapeutics Томас фон Эрлах, доктор философии, не собирается почивать на лаврах. Хотя эта биотехнологическая компания, возможно, наиболее известна своим громким партнерством в области пероральной…

ЧИТАТЬ

Апр 9, 2026

Впишите свой почтовый адрес и мы будем присылать вам на почту самые свежие новости в числе самых первых

ИдеиPRO

Тестирование показывает, что функции Google AI Overviews разглашают миллионы ложных сведений в час.

Проблемы с эталонными показателями

Похожие записи

ОСТАВЬТЕ СВОЙ КОММЕНТАРИЙ Отменить ответ

Еще новости рубрики

Присоединяйтесь к нам в

Рубрики

галерея

НОВОСТИ ДРУГИХ РУБРИК

ОСТАВЬТЕ СВОЙ КОММЕНТАРИЙ
Отменить ответ

Присоединяйтесь
к нам в