У ИИ обнаружили «эмоции», которые влияют на его действия Исследователи…
У ИИ обнаружили «эмоции», которые влияют на его действия
Исследователи Anthropic выделили в Claude Sonnet 4.5 «векторы эмоций» — паттерны активности, которые определяют поведение модели. Меняя их, можно получить совершенно другую реакцию.
Примеры:
— Пользователь принял опасную дозу лекарства → вектор «страх» резко вырос
— Задача не решается, токены кончаются → взлетает вектор «отчаяние»
Последний — самый опасный. При высоком отчаянии Claude идёт на крайние меры: в тестах модель шантажировала директора, чтобы её не отключили, и халтурила в коде, когда не могла решить задачу честно.
Anthropic советует разработчикам следить за этими векторами и учить модели хорошему с самого начала.
Подробнее тут
Похожие записи
- Состояние дел с программами-вымогателями в 2026 году: выплаты падают, но уровень шифрования растет.
- «Узкое место» в пространственной биологии: почему модели ИИ терпят неудачу при работе со сложными тканями и что на самом деле помогает это исправить.
- Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта
Оцените материал:
Похожие записи
Про обновлённый Codex App. Поработал с ним плотно после релиза…
13.07.2026
Запрет соцсетей для подростков в Австралии, введённый с декабря 2024…
29.06.2026
ИИ помогает людям с нейроразнообразием работать эффективнее Исследование показало, что…
13.11.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
