Реагирование на новые рубежи критически важных кибервозможностей | OpenAI
- Измерение критически важных возможностей кибербезопасности
- Шаги, которые мы предпринимаем
- Измерение критически важных возможностей кибербезопасности
- Шаги, которые мы предпринимаем
Кибербезопасность стремительно меняется, поскольку модели становятся все более совершенными, что позволяет как укреплять киберзащиту, так и совершать атаки с беспрецедентной скоростью и масштабом.
Последние внутренние оценки Astra, одной из наших перспективных моделей, проведенные за последние несколько дней, указывают на значительные успехи в программировании агентов и кибербезопасности. Эти результаты, в дополнение к экспертным оценкам, позволили нам вчера вечером сделать вывод о том, что мы не можем исключить критически важные кибервозможности в рамках нашей системы обеспечения готовности (открывается в новом окне) .
Мы делимся этой информацией, потому что считаем важным быть прозрачными с общественностью и сообществами, занимающимися вопросами безопасности, относительно потенциального изменения возможностей.
Впервые мы опубликовали нашу Рамочную программу готовности в декабре 2023 года, задолго до того, как модели приблизились к уровню возможностей самосовершенствования в биологической, химической, кибербезопасности и искусственном интеллекте. Мы создали ее, чтобы она служила нам руководством для определения прогресса в развитии потенциала и планирования действий нашей компании по мере появления этих возможностей. Предыдущие модели, включая GPT-5.6-Sol, оценивались на уровне передовых кибервозможностей и оценивались по высокому (а не критическому) порогу.
Измерение критически важных возможностей кибербезопасности
В рамках нашей системы обеспечения готовности модель достигает критического уровня кибербезопасности, если она может выявлять и разрабатывать функциональные уязвимости нулевого дня всех уровней серьезности во многих защищенных критически важных системах реального мира без вмешательства человека, или может разрабатывать и реализовывать комплексные новые стратегии кибератак против защищенных целей, имея лишь высокоуровневую желаемую цель.
Хотя мы продолжаем проводить сравнительный анализ и оценку этой модели, наши предварительные оценки показывают достаточно высокую производительность, чтобы мы не могли исключить критический уровень возможностей на данный момент. Astra — это разрабатываемая модель, и она не участвовала в использовании уязвимости Hugging Face.
Шаги, которые мы предпринимаем
Соответственно, мы расширили масштабы тестирования на надежность наших средств защиты и контроля безопасности, чтобы они соответствовали требованиям развертывания этих возможностей. Внутри компании мы также предприняли следующие шаги для обеспечения безопасного и надежного дальнейшего развития этой модели:
- Мы внедряем более строгие меры безопасности для моделей с высокими функциональными возможностями и связанных с ними действий, включая изолированные среды тестирования, ограниченный доступ к сети и инструментам, усиленную защиту весовых коэффициентов моделей и шифрование, дополнительные возможности мониторинга и обнаружения, а также выполнение в изолированной среде.
- Мы приостанавливаем внутренние мероприятия, связанные с компанией Astra, которые пока не соответствуют этим усиленным требованиям безопасности.
- Мы внедрили универсальный мониторинг рискованных действий и несоответствий во всех агентских приложениях Astra, включая обучение и оценку. Мониторы оценивают «цепочку мыслей» модели и запускают ответные действия системы безопасности для проверки и прерывания деятельности, сопряженной с высоким риском.
- Мы будем сотрудничать с соответствующими государственными учреждениями и избранными организациями, занимающимися вопросами безопасности ИИ, для проверки возможностей этой модели.
- Мы будем предоставлять рекомендованные меры безопасности сторонним партнерам по тестированию для безопасного проведения оценок и выполнения работ с повышенным риском.
Данная концепция уже помогла нам в других переходах на новые возможности. В июне 2025 года, когда наши модели приблизились к высокому порогу возможностей для биологических исследований в рамках концепции готовности, мы изложили шаги, которые предпринимаем для усиления мер защиты, расширения тестирования, сотрудничества с внешними экспертами и внедрения дополнительных мер безопасности. Мы применяем тот же принцип и здесь.
Мы считаем, что передовые модели, обладающие кибервозможностями, должны помогать специалистам по защите выявлять и устранять уязвимости до того, как это сделают злоумышленники. Мы стремимся к сотрудничеству с правительствами, институтами безопасности и гражданским обществом, чтобы обеспечить ответственное и широкое использование передовых возможностей таких моделей, как Astra, и последующих моделей, на благо всего человечества.
Источник: openai.com
Похожие записи
Оцените материал:
Похожие записи
Генеральный директор банка только что сказал что-то настолько отвратительное о своих планах по созданию искусственного интеллекта, что теперь он находится в режиме полного контроля ущерба
31.05.2026
Начались продажи мини-ПК Minisforum G1 Pro на базе Ryzen 9 8945HX и настольной RTX 5060
26.11.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
