Grok галлюционирует в разы меньше ChatGPT и Gemini
Уровень «галлюцинаций» Grok составил всего 8%. Для сравнения, у ChatGPT этот показатель равен 35%, а у Google Gemini — 38%, что ставит под сомнение их пригодность для задач, где важна фактическая точность.
Помимо частоты «галлюцинаций», оценка проводилась ещё по нескольким критериям, включая пользовательские рейтинги, стабильность ответов и простой в работе. На основе этих данных каждому чат-боту присваивался риск-балл от 0 до 99 — чем выше, тем хуже. Grok получил итоговый балл 6 благодаря высокому пользовательскому рейтингу (4,5), стабильности ответов и минимальному простою в 0,07%.
Интересно, что ChatGPT в этом рейтинге оказался в самом конце с максимальным риск-баллом 99. Следом расположились Claude и Meta* AI с показателями 75 и 70 соответственно. При этом китайский DeepSeek показал себя почти на уровне Grok: 14% галлюцинаций, нулевой простой и итоговый риск-балл 4.
* Компания Meta признана в России экстремистской организацией
Источник: 4pda.to
Источник: ai-news.ru
Похожие записи
- Роботы начнут чинить спутники — SpaceX запустила на орбиту беспилотник…
- Пользователи DeepSeek рассказали о баге, из-за которого чат-бот присылает фрагменты из переписок с другими пользователями
- Андроид T800 потерял голову в поединке на ринге. В Китае прошел турнир по боям между человекоподобными роботами
Оцените материал:
Похожие записи
Компания Capital One приобрела Brex со значительной скидкой по сравнению с пиковой оценкой, но первые инвесторы получают от этого огромную прибыль.
26.01.2026
Функция примерки одежды от Google работает теперь с селфи, а не только с фотографиями в полный рост
12.12.2025
Искусственный интеллект Meta для WhatsApp Business теперь доступен по всему миру.
04.06.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
