ИИ становится всё менее понятным даже для своих создателей 40+…
ИИ становится всё менее понятным даже для своих создателей
40+ исследователей опубликовали статью о рисках безопасности нейросетей. Среди подписавшихся — сооснователь OpenAI Илья Суцкевер.
Что важно:
— Есть метод отслеживания рассуждений моделей (CoT-мониторинг) — он ищет потенциальные угрозы в их логике.
— Уже находят случаи, где модели без стеснения предлагают взломать или саботировать.
— В будущем нейросети могут перейти от понятного reasoning к общению в скрытых форматах или собственных «языках».
Становится всё сложнее понять, о чём они думают. Остальное, по словам авторов, пока под контролем.

Похожие записи
Оцените материал:
Похожие записи
Разрабатываем приложения за минуту — СберТех представил GigaStudio. Это мультиагентная…
28.06.2025
Человек оставляет после себя не только физическое имущество, но и…
07.08.2025
Тут крутая новость выплыла: теперь ИИ-агенты могут планировать разработку приложений….
14.06.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
