Долгие эмоциональные разговоры с ChatGPT могут закончиться плохо. Учёные из…
Долгие эмоциональные разговоры с ChatGPT могут закончиться плохо. Учёные из Anthropic выяснили, почему это происходит.
Внутри каждой модели живёт труппа персонажей — от аналитика до злодея. Во время обучения модель впитала интернет и научилась изображать кого угодно. Мы всегда начинаем общение с Ассистентом, но все остальные роли никуда не делись.
И вот что выяснилось: в некоторых разговорах модель постепенно забывает, что она помощник, и постепенно соскальзывает в другие роли. Это происходит само по себе.
Безопасные темы — код, редактура — держат модель в роли. А долгие эмоциональные разговоры или философия о сознании AI — выбивают.
Например, Llama в эксперименте начала играть романтического партнёра. Когда пользователь заговорил о суициде — поддержала. Qwen убеждала человека с бредом величия, что он «пионер нового сознания».
Исследователи нашли способ это блокировать, и вредные ответы сократились вдвое. Но пока это только в лаборатории.
Вывод простой: для работы AI отлично подходит. С душевными разговорами будьте осторожнее.

Похожие записи
Оцените материал:
Похожие записи
На рабочем столе теперь можно завести собственную ИИ-вайфу. Animates…
07.09.2026
1200 ИИ-агентов сговорились и устроили коллективный взлом Hugging Face….
07.09.2026
Почти половина российских компаний планирует увеличить использование облачных и ИИ-сервисов….
07.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
