У ИИ обнаружили «эмоции», которые влияют на его действия Исследователи…
У ИИ обнаружили «эмоции», которые влияют на его действия
Исследователи Anthropic выделили в Claude Sonnet 4.5 «векторы эмоций» — паттерны активности, которые определяют поведение модели. Меняя их, можно получить совершенно другую реакцию.
Примеры:
— Пользователь принял опасную дозу лекарства → вектор «страх» резко вырос
— Задача не решается, токены кончаются → взлетает вектор «отчаяние»
Последний — самый опасный. При высоком отчаянии Claude идёт на крайние меры: в тестах модель шантажировала директора, чтобы её не отключили, и халтурила в коде, когда не могла решить задачу честно.
Anthropic советует разработчикам следить за этими векторами и учить модели хорошему с самого начала.
Подробнее тут
Похожие записи
- Исследователи Meta обучили модель ИИ с 8 миллиардами итераций достичь уровня Claude Opus 4.5 — без непомерных затрат, связанных с освоением новых технологий.
- Исследователи Висконсинского университета в Мэдисоне близки к разработке кардиостимулятора, который…
- Исследователи с помощью ИИ обнаружили в Zoom уязвимость, которая позволяла участникам звонка получить контроль над устройствами других пользователей
Оцените материал:
Похожие записи
На рабочем столе теперь можно завести собственную ИИ-вайфу. Animates…
07.09.2026
1200 ИИ-агентов сговорились и устроили коллективный взлом Hugging Face….
07.09.2026
Почти половина российских компаний планирует увеличить использование облачных и ИИ-сервисов….
07.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
