Мысли ИИ научились читать с помощью другого ИИ. Внутри нашли чужие пароли и ключи
Внутренние рассуждения передовых моделей, которые провайдеры прячут от пользователя, можно прочитать целиком и дословно, причем не атакуя саму модель. Восемь исследователей, в том числе из ELLIS Institute Tübingen, Института интеллектуальных систем Общества Макса Планка, Tübingen AI Center, MATS и Snyk, 10 августа выложили препринт «Stealing Reasoning Traces from Proprietary LLM APIs» с работающей атакой на модели трех крупнейших поставщиков: Anthropic, OpenAI и Google. Попутно авторы прогнали свой метод по публичным репозиториям и достали из чужих зашифрованных блоков 62 ключа API, 33 пароля, 24 токена доступа и еще несколько сотен секретов, о которых их владельцы не подозревали.
Читать далее
Источник: habr.com
Похожие записи
Оцените материал:
Похожие записи
Скорость накопителя в MacBook Pro на M5 утроилась по сравнению с M4
28.10.2025
По сообщениям, компания Meta намерена расторгнуть сделку с Manus на сумму 2 миллиарда долларов после требований Пекина.
14.06.2026
Когда одного агента мало: практический кейс применения мультиагентной системы
17.10.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
