Anthropic показала: Claude способен на элементарную интроспекцию Исследователи из Anthropic…
Anthropic показала: Claude способен на элементарную интроспекцию
Исследователи из Anthropic опубликовали работу, в которой доказали, что модели Claude Opus 4 и 4.1 обладают зачатками интроспекции — способности отслеживать собственные внутренние состояния.
Учёные применили метод «внедрения концепций»: искусственно активировали в модели абстрактные идеи вроде *«предательство»* или *«заглавные буквы»* без текстового запроса. В 20% случаев Claude распознал вмешательство и сообщил о нём до того, как навязанные мысли повлияли на ответ.
Вывод: это ещё не сознание, но ранняя форма самонаблюдения, которая усиливается по мере роста мощности модели. В будущем такие механизмы могут сделать ИИ прозрачнее и безопаснее — он сможет объяснять, как рассуждает и когда подвергается взлому или внешнему влиянию.

Похожие записи
Оцените материал:
Похожие записи
5 ключевых технологических трендов 2026 года Аналитики Juniper Research опубликовали…
08.03.2026
Рак В С Ё: учёные из Флориды создали универсальную мРНК-вакцину…
21.07.2025
📘 OpenAI выложили поваренную книгу по созданию картинок Вот тут…
17.12.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
