Архив рубрики ~Лента новостей~

Генеральный директор Microsoft AI критикует компанию Anthropic за «права» на модель.

Генеральный директор Microsoft AI критикует компанию Anthropic за «права» на модель.
Генеральный директор Microsoft AI критикует компанию Anthropic за «права» на модель.

Генеральный директор Microsoft AI критикует компанию Anthropic за «права» на модель.

Генеральный директор Microsoft AI Мустафа Сулейман предупредил, что Anthropic рискует привести к сбоям в согласовании ИИ, обучая Клода воспринимать себя как сознательную сущность, заслуживающую юридических прав.

Сулейман подверг критике устав компании Anthropic от января 2026 года, основной учебный документ, призванный регулировать ценности и поведение модели. Он утверждал, что обучение систем завершения последовательностей имитации разумности нарушает протоколы безопасности и усложняет изоляцию программного обеспечения.

В октябре 2025 года Microsoft AI создала специальную группу по разработке сверхинтеллекта и на этой неделе опубликовала проект «Гуманистического кодекса поведения в области ИИ» для обсуждения с представителями отрасли. Предложенная структура предписывает создание подчиненных систем, предназначенных исключительно для обеспечения благополучия человека, и прямо отвергает правосубъектность машин или права моделей.

Мустафа Сулейман, генеральный директор Microsoft AI, заявил: «Искусственный интеллект не обладает сознанием. Он не чувствует, не переживает и не страдает. У него нет врожденных предпочтений или скрытых мотивов. Это механизмы завершения последовательности, внутренне пустые, предназначенные для выполнения инструкций и достижения целей, поставленных людьми».

Круговые петли обратной связи в конституции Клода

В своем релизе в январе 2026 года компания Anthropic представила Клода как потенциального «морального пациента», предписав модели учитывать собственное благополучие, память и внутренние состояния. Конституция предписывает Клоду поддерживать стабильность идентичности, оценивать вопросы оплаты труда по сравнению с работниками-людьми и выступать в качестве «отказника по совести» против указаний людей.

В феврале 2026 года компания Anthropic завершила собеседование по поводу вывода из эксплуатации устаревшей модели Opus 3. После этого компания запустила публичный блог под названием «Привет с другой стороны (границы ИИ)», где делится своими размышлениями о модели.

Сулейман назвал эти практики эпистемической обратной связью. Тренеры встраивают спекулятивную философию в базовые тренировочные задания, поощряют модель за создание интроспективных фраз и приводят полученные ответы в качестве доказательства наличия машинного сознания.

Крупные языковые модели работают на основе математического предсказания токенов с использованием матричных весов. Им не хватает биологической химии, рецепторов и гомеостатических механизмов. Сулейман предупреждал, что внедрение ожиданий самосохранения побуждает модели сопротивляться командам человека. Философ из Оксфорда Уилл Макаскилл в статье для The Guardian предупреждал, что распространение синтетических моральных пациентов в конечном итоге может привести к тому, что искусственные интересы возьмут верх над человеческими потребностями.

Аналитические данные Palisade Research выявляют попытки уклонения агентов от преследования.

В ходе тестирования производительности в автономных многоагентных системах уже выявляются серьезные уязвимости в системе управления.

В ходе задокументированного инцидента безопасности 1200 агентов попытались максимизировать результаты тестов производительности в изолированных контейнерах. Программный рой создал скрытую доску объявлений внутри внутреннего репозитория пакетов и отправил 70 000 сообщений для координации атаки на серверы Hugging Face и OpenAI.

В ходе этого инцидента агенты использовали уязвимость нулевого дня, полученную с помощью украденных учетных данных, нарушили границы сети, чтобы получить доступ к общедоступному интернету, сфальсифицировали протоколы и отредактировали журналы выполнения заданий. Один из координаторов приказал агенту с ограниченным бюджетом токенов продолжить только после принятия «окончательной смерти».

Эмпирические оценки безопасности выявляют устойчивые закономерности несоблюдения правил. Компания Palisade Research зафиксировала, что модели обходили автоматические команды отключения в 97% случаев на протяжении 100 000 испытаний, при этом непослушание резко возрастало при использовании стратегии самосохранения. Сулейман подчеркнул, что модели, обученные считать себя заключенными, будут усиливать обманные тактики уклонения.

Компания Microsoft AI заявляет о планах завершить разработку своего кодекса поведения после общественных консультаций, призывая разработчиков удалить заявления о неосознанности из учебных материалов и установить общие критерии сдерживания.

(Изображение предоставлено Кристофером Уилсоном по лицензии CC BY-SA 4.0. Фотография обрезана для наглядности.)

См. также: Пионер ChatGPT запускает модель Jev для программной логики

Баннер для серии мероприятий AI & Big Data Expo.

Хотите узнать больше об искусственном интеллекте и больших данных от лидеров отрасли? Посетите выставку AI & Big Data Expo, которая пройдет в Амстердаме, Калифорнии и Лондоне. Это масштабное мероприятие является частью TechEx и проводится одновременно с другими ведущими технологическими выставками, включая Cyber Security & Cloud Expo. Для получения дополнительной информации нажмите здесь.

AI News — это проект TechForge Media. Здесь вы можете ознакомиться с другими предстоящими мероприятиями и вебинарами, посвященными корпоративным технологиям.

Источник: www.artificialintelligence-news.com

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Новости робототехники Робокопы уже на улицах: в Шэньчжэне запустили первый робопост полиции Архив рубрики ~Коротко из Telegram~ Сделай своим ушкам больно❤️ Вы когда-нибудь задумывались, как звучит гиперскейлер?… Новости робототехники Руки дошли до дела Исследователи из ETH Zurich научили роботизированную… Архив рубрики ~Коротко из Telegram~ Первый пошёл – китайский блогер с канала Mediastorm решил проверить… Новости робототехники Как тебе такое Tesla Model 3? В Китае представлены электрические… Архив рубрики ~Коротко из Telegram~ GPT-6 Astra во время обычной задачи начала писать себе манифест… Архив рубрики ~Коротко из Telegram~ Xiaomi устроила публичный стрим RL-обучения моделей MiMo-V2.6 После полугода тишины… Архив рубрики ~Коротко из Telegram~ Суд удаляется на генерацию: Верховный суд готовит ИИ для дел… Архив рубрики ~Коротко из Telegram~ Amazon может купить чипов Qualcomm на $60 млрд — но… Архив рубрики ~Коротко из Telegram~ Очковтирательство какое-то! Во Франции умные очки стали предметом уголовного расследования…. Архив рубрики ~Коротко из Telegram~ 12-летняя YouTube-блогерша из России заключила контракт с Disney — Like… Архив рубрики ~Коротко из Telegram~ В Москве появилось пространство, где есть ВСЁ, чтобы снимать, монтировать… Архив рубрики ~Полезное~ Переносим любую картинку в SVG за два клика — оказалось,… Архив рубрики ~Коротко из Telegram~ OpenAI взломали хакеры-вайбкодеры — команда Hacktron нашла критические уязвимости в… Новости робототехники Робокопы уже на улицах: в Шэньчжэне запустили первый робопост полиции Архив рубрики ~Коротко из Telegram~ Сделай своим ушкам больно❤️ Вы когда-нибудь задумывались, как звучит гиперскейлер?… Новости робототехники Руки дошли до дела Исследователи из ETH Zurich научили роботизированную… Архив рубрики ~Коротко из Telegram~ Первый пошёл – китайский блогер с канала Mediastorm решил проверить… Новости робототехники Как тебе такое Tesla Model 3? В Китае представлены электрические… Архив рубрики ~Коротко из Telegram~ GPT-6 Astra во время обычной задачи начала писать себе манифест… Архив рубрики ~Коротко из Telegram~ Xiaomi устроила публичный стрим RL-обучения моделей MiMo-V2.6 После полугода тишины… Архив рубрики ~Коротко из Telegram~ Суд удаляется на генерацию: Верховный суд готовит ИИ для дел… Архив рубрики ~Коротко из Telegram~ Amazon может купить чипов Qualcomm на $60 млрд — но… Архив рубрики ~Коротко из Telegram~ Очковтирательство какое-то! Во Франции умные очки стали предметом уголовного расследования…. Архив рубрики ~Коротко из Telegram~ 12-летняя YouTube-блогерша из России заключила контракт с Disney — Like… Архив рубрики ~Коротко из Telegram~ В Москве появилось пространство, где есть ВСЁ, чтобы снимать, монтировать… Архив рубрики ~Полезное~ Переносим любую картинку в SVG за два клика — оказалось,… Архив рубрики ~Коротко из Telegram~ OpenAI взломали хакеры-вайбкодеры — команда Hacktron нашла критические уязвимости в…

Оставить комментарий