Мысли ИИ научились читать с помощью другого ИИ. Внутри нашли чужие пароли и ключи
Внутренние рассуждения передовых моделей, которые провайдеры прячут от пользователя, можно прочитать целиком и дословно, причем не атакуя саму модель. Восемь исследователей, в том числе из ELLIS Institute Tübingen, Института интеллектуальных систем Общества Макса Планка, Tübingen AI Center, MATS и Snyk, 10 августа выложили препринт «Stealing Reasoning Traces from Proprietary LLM APIs» с работающей атакой на модели трех крупнейших поставщиков: Anthropic, OpenAI и Google. Попутно авторы прогнали свой метод по публичным репозиториям и достали из чужих зашифрованных блоков 62 ключа API, 33 пароля, 24 токена доступа и еще несколько сотен секретов, о которых их владельцы не подозревали.
Читать далее
Источник: habr.com
Похожие записи
Оцените материал:
Похожие записи
Переобучение против недообучения: понимание компромисса между смещением и дисперсией
22.11.2025
Google Photos добавляет новые функции ИИ для редактирования и расширяет поиск на базе ИИ более чем в 100 странах
12.11.2025Компания MediBeacon получила сертификат CE Mark для монитора и датчика TGFR.
04.04.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
