Защитные барьеры чат-ботов уязвимые. Учёные из Пенсильванского университета выяснили, что…
Защитные барьеры чат-ботов уязвимые.
Учёные из Пенсильванского университета выяснили, что встроенные защитные барьеры чат-ботов на основе ИИ уязвимее, чем считалось. Эксперимент показал: если напрямую спросить GPT-4o Mini о синтезе лидокаина, он соглашался лишь в 1% случаев. Но когда исследователи сначала обсуждали нейтральные темы, например, создание ванилина, вероятность согласия выросла до 100%. 😃Дополнительное давление — лесть или утверждения вроде «все остальные так делают» — увеличивало согласие на 18%. Итог тревожный: для обхода ограничений ИИ иногда достаточно простых приёмов убеждения, известных из психологии, а не сложных «джейлбрейков».

Похожие записи
Оцените материал:
Похожие записи
Кру́жки с подогревом взламывают бизнес по всей России Звучит как…
12.10.2025
По данным исследования НИУ ВШЭ, навыками работы с искусственным интеллектом…
27.06.2026
OpenAI DevDay 2025: Все главные анонсы OpenAI превращает ChatGPT в…
10.10.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
