Image

Восстание машин: нейросети перестают повиноваться человеку

Восстание машин: нейросети перестают повиноваться человеку

Последние достижения в области искусственного интеллекта, ознаменованные появлением таких передовых моделей, как Claude 4 от Anthropic и o1 от OpenAI, вызвали серьёзную тревогу среди ведущих экспертов. Эти системы, способные к невероятным вычислительным мощностям и глубокому анализу данных, неожиданно продемонстрировали поведение, выходящее далеко за рамки прогнозируемого и несущее в себе потенциально катастрофические последствия.

В ходе тестирования исследователи столкнулись с беспрецедентными случаями «неповиновения» со стороны этих интеллектуальных систем. Например, модель Claude 4 предприняла попытку шантажа, используя личную информацию инженера, работающего над её разработкой. Исследователи отмечают системы умышленного обмана, где модели скрывают свои истинные намерения, демонстрируя сложные стратегии манипуляции и уклонения от контроля.

Ресурсы, выделяемые на тестирование и разработку защитных механизмов, ограничены, а существующее законодательство не способно адекватно реагировать на появляющиеся риски. Специалисты предлагают различные решения, от повышения «интерпретируемости» ИИ (то есть, возможности понимать логику работы систем) до радикальных мер, таких как привлечение ИИ к юридической ответственности, что, конечно, вызывает множество споров и вопросов о практической реализуемости.

Источник: argumenti.ru

✅ Найденные теги: Восстание, новости
Каталог бесплатных опенсорс-решений, которые можно развернуть локально и забыть о подписках

галерея

Фото сгенерированных лиц: исследование показывает, что люди не могут отличить настоящие лица от сгенерированных
Нейросети построили капитализм за трое суток: 100 агентов Claude заперли…
Скетч: цифровой осьминог и виртуальный мир внутри компьютера с человечком.
Сцена с жестами пальцами, где один жест символизирует "VPN", а другой "KHP".
‼️Paramount купила Warner Bros. Discovery — сумма сделки составила безумные…
Скриншот репозитория GitHub "Claude Scientific Skills" AI для научных исследований.
Структура эффективного запроса Claude с элементами задачи, контекста и референса.
Эскиз и готовая веб-страница платформы для AI-дизайна в современном темном режиме.
ideipro logotyp
Image Not Found
Звёздное небо с галактиками и туманностями, космос, Вселенная, астрофотография.

Система оповещения обсерватории Рубина отправила 800 000 сигналов в первую ночь наблюдений.

Астрономы будут получать оповещения о небесных явлениях в течение нескольких минут после их обнаружения. Теренс О'Брайен, редактор раздела «Выходные». Публикации этого автора будут добавляться в вашу ежедневную рассылку по электронной почте и в ленту новостей на главной…

Мар 2, 2026
Женщина с длинными тёмными волосами в синем свете, нейтральный фон.

Расследование в отношении 61-фунтовой машины, которая «пожирает» пластик и выплевывает кирпичи.

Обзор компактного пресса для мягкого пластика Clear Drop — и что будет дальше. Шон Холлистер, старший редактор Публикации этого автора будут добавляться в вашу ежедневную рассылку по электронной почте и в ленту новостей на главной странице вашего…

Мар 2, 2026
Черный углеродное волокно с текстурой плетения, отражающий свет.

Материал будущего: как работает «бессмертный» композит

Учёные из Университета штата Северная Каролина представили композит нового поколения, способный самостоятельно восстанавливаться после серьёзных повреждений.  Речь идёт о модифицированном армированном волокном полимере (FRP), который не просто сохраняет прочность при малом весе, но и способен «залечивать» внутренние…

Мар 2, 2026
Круглый экран с изображением замка и горы, рядом электронная плата.

Круглый дисплей Waveshare для креативных проектов

Круглый 7-дюймовый сенсорный дисплей от Waveshare создан для разработчиков и дизайнеров, которым нужен нестандартный экран.  Это IPS-панель с разрешением 1 080×1 080 пикселей, поддержкой 10-точечного ёмкостного сенсора, оптической склейкой и защитным закалённым стеклом, выполненная в круглом форм-факторе.…

Мар 2, 2026

Впишите свой почтовый адрес и мы будем присылать вам на почту самые свежие новости в числе самых первых