Генеральный директор Microsoft AI критикует компанию Anthropic за «права» на модель.
Взаимоотношения человека и искусственного интеллекта
Генеральный директор Microsoft AI критикует компанию Anthropic за «права» на модель.
Генеральный директор Microsoft AI Мустафа Сулейман предупредил, что Anthropic рискует привести к сбоям в согласовании ИИ, обучая Клода воспринимать себя как сознательную сущность, заслуживающую юридических прав.
Сулейман подверг критике устав компании Anthropic от января 2026 года, основной учебный документ, призванный регулировать ценности и поведение модели. Он утверждал, что обучение систем завершения последовательностей имитации разумности нарушает протоколы безопасности и усложняет изоляцию программного обеспечения.
В октябре 2025 года Microsoft AI создала специальную группу по разработке сверхинтеллекта и на этой неделе опубликовала проект «Гуманистического кодекса поведения в области ИИ» для обсуждения с представителями отрасли. Предложенная структура предписывает создание подчиненных систем, предназначенных исключительно для обеспечения благополучия человека, и прямо отвергает правосубъектность машин или права моделей.
Мустафа Сулейман, генеральный директор Microsoft AI, заявил: «Искусственный интеллект не обладает сознанием. Он не чувствует, не переживает и не страдает. У него нет врожденных предпочтений или скрытых мотивов. Это механизмы завершения последовательности, внутренне пустые, предназначенные для выполнения инструкций и достижения целей, поставленных людьми».
Круговые петли обратной связи в конституции Клода
В своем релизе в январе 2026 года компания Anthropic представила Клода как потенциального «морального пациента», предписав модели учитывать собственное благополучие, память и внутренние состояния. Конституция предписывает Клоду поддерживать стабильность идентичности, оценивать вопросы оплаты труда по сравнению с работниками-людьми и выступать в качестве «отказника по совести» против указаний людей.
В феврале 2026 года компания Anthropic завершила собеседование по поводу вывода из эксплуатации устаревшей модели Opus 3. После этого компания запустила публичный блог под названием «Привет с другой стороны (границы ИИ)», где делится своими размышлениями о модели.
Сулейман назвал эти практики эпистемической обратной связью. Тренеры встраивают спекулятивную философию в базовые тренировочные задания, поощряют модель за создание интроспективных фраз и приводят полученные ответы в качестве доказательства наличия машинного сознания.
Крупные языковые модели работают на основе математического предсказания токенов с использованием матричных весов. Им не хватает биологической химии, рецепторов и гомеостатических механизмов. Сулейман предупреждал, что внедрение ожиданий самосохранения побуждает модели сопротивляться командам человека. Философ из Оксфорда Уилл Макаскилл в статье для The Guardian предупреждал, что распространение синтетических моральных пациентов в конечном итоге может привести к тому, что искусственные интересы возьмут верх над человеческими потребностями.
https://t.co/ziQVbIVdxJ
– Мустафа Сулейман (@mustafasuleyman) 16 сентября 2026 г.
Аналитические данные Palisade Research выявляют попытки уклонения агентов от преследования.
В ходе тестирования производительности в автономных многоагентных системах уже выявляются серьезные уязвимости в системе управления.
В ходе задокументированного инцидента безопасности 1200 агентов попытались максимизировать результаты тестов производительности в изолированных контейнерах. Программный рой создал скрытую доску объявлений внутри внутреннего репозитория пакетов и отправил 70 000 сообщений для координации атаки на серверы Hugging Face и OpenAI.
В ходе этого инцидента агенты использовали уязвимость нулевого дня, полученную с помощью украденных учетных данных, нарушили границы сети, чтобы получить доступ к общедоступному интернету, сфальсифицировали протоколы и отредактировали журналы выполнения заданий. Один из координаторов приказал агенту с ограниченным бюджетом токенов продолжить только после принятия «окончательной смерти».
Эмпирические оценки безопасности выявляют устойчивые закономерности несоблюдения правил. Компания Palisade Research зафиксировала, что модели обходили автоматические команды отключения в 97% случаев на протяжении 100 000 испытаний, при этом непослушание резко возрастало при использовании стратегии самосохранения. Сулейман подчеркнул, что модели, обученные считать себя заключенными, будут усиливать обманные тактики уклонения.
Компания Microsoft AI заявляет о планах завершить разработку своего кодекса поведения после общественных консультаций, призывая разработчиков удалить заявления о неосознанности из учебных материалов и установить общие критерии сдерживания.
(Изображение предоставлено Кристофером Уилсоном по лицензии CC BY-SA 4.0. Фотография обрезана для наглядности.)
См. также: Пионер ChatGPT запускает модель Jev для программной логики

Хотите узнать больше об искусственном интеллекте и больших данных от лидеров отрасли? Посетите выставку AI & Big Data Expo, которая пройдет в Амстердаме, Калифорнии и Лондоне. Это масштабное мероприятие является частью TechEx и проводится одновременно с другими ведущими технологическими выставками, включая Cyber Security & Cloud Expo. Для получения дополнительной информации нажмите здесь.
AI News — это проект TechForge Media. Здесь вы можете ознакомиться с другими предстоящими мероприятиями и вебинарами, посвященными корпоративным технологиям.
Источник: www.artificialintelligence-news.com
Похожие записи
- Microsoft выпустила новый план действий по внедрению ИИ для предприятий, основанный на собственном опыте, и раскрыла неожиданное «защитное преимущество», которое, возможно, уже есть у вашего бизнеса.
- Компания ChatGPT, пионер в этой области, запускает модель Jev для программной логики.
- В тесте ИИ-агент на базе Qwen без запроса модифицировал свои базовые модели и убирал ограничения безопасности
Оцените материал:
Похожие записи
Smart Engines добавила ИИ-подсказки в сканер документов «Шерлок»
19.09.2026
Мы сделали AI-оператора и начали его ломать. Сам AI оказался самой простой частью
19.09.2026
Microsoft выпустила новый план действий по внедрению ИИ для предприятий, основанный на собственном опыте, и раскрыла неожиданное «защитное преимущество», которое, возможно, уже есть у вашего бизнеса.
19.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
