Архив рубрики ~Лента новостей~

OpenAI запускает GPT-5.6-Cyber с уменьшенным количеством отказов и 95% завершением сложных задач в области кибербезопасности.

OpenAI запускает GPT-5.6-Cyber с уменьшенным количеством отказов и 95% завершением сложных задач в области кибербезопасности.
OpenAI запускает GPT-5.6-Cyber с уменьшенным количеством отказов и 95% завершением сложных задач в области кибербезопасности.

Карл Франзен

Ранее сегодня компания OpenAI запустила GPT-5.6-Cyber, специализированную модель, предназначенную для проведения углубленного исследования уязвимостей и разработки эксплойтов для утвержденных специалистов по кибербезопасности, включая категории работ, которые ее универсальные модели часто отклоняют.

GPT-5.6-Cyber — это усовершенствованная версия самой продвинутой универсальной модели OpenAI, GPT-5.6 Sol, представленной в июне, но специально обученная для повышения производительности в сложных задачах кибербезопасности, включая поиск уязвимостей нулевого дня и разработку цепочек эксплойтов.

Что особенно важно, OpenAI также обучил его снижать количество отказов по некоторым запросам в области кибербезопасности с высоким риском «двойного назначения» — то есть запросам, которые могут быть использованы в законных оборонительных или злонамеренных наступательных целях.

Действительно, во внутреннем бенчмарке OpenAI под названием Advanced Cybersecurity Completion Rate (который, как заявляет компания в своем сообщении в блоге о запуске, измеряет задачи, связанные с разработкой цепочек эксплойтов, обходом аутентификации, повышением привилегий и другими сложными сценариями кибербезопасности) GPT-5.6-Cyber выполнил 95% задач по сравнению с 57,3% у его непосредственного предшественника GPT-5.5-Cyber и всего 1,5% у обычной модели GPT-5.6 Sol со всеми примененными мерами защиты.

Исследователь OpenAI Эрик Уоллес опубликовал сообщение на X, описав GPT-5.6-Cyber как «первую крупномасштабную попытку OpenAI напрямую улучшить возможности для решения сложных задач кибербезопасности, таких как разработка эксплойтов».

Цены и наличие

К сожалению для предприятий, GPT-5.6-Cyber не будет широко доступен каждому клиенту ChatGPT или API.

Для получения доступа организация должна быть принята в недавно созданный уровень программы кибербезопасности OpenAI Daybreak, называемый Daybreak Red, о котором также было объявлено сегодня. Этот уровень предоставляет доступ к специализированным моделям кибербезопасности, таким как GPT-5.6-Cyber.

Ещё один новый уровень, Daybreak Blue, предоставляет более широкому кругу предприятий доступ к универсальным моделям, таким как GPT-5.6 Sol, но с некоторыми ограничениями, позволяющими использовать их в более широком спектре задач кибербезопасности.

В документах OpenAI указана цена на GPT-5.6-Cyber в размере 12,50 долларов США за миллион входных токенов и 75 долларов США за миллион выходных токенов, при этом цена кэшированных входных данных составляет 1,25 доллара США за миллион токенов.

Таблица цен OpenAI-GPT-5.6-Cyber and Sol (Daybreak)

Это делает его дороже, чем GPT-5.6 Sol в той же таблице цен Daybreak Cyber, где Sol указан по цене 5 долларов за миллион входных токенов и 30 долларов за миллион выходных токенов для краткосрочного использования.

В той же таблице OpenAI не указывает цены на GPT-5.6-Cyber с длительным контекстом, и для доступа по-прежнему требуется отдельное одобрение и предоставление прав доступа через Daybreak Red.

Красные против синих: новые уровни Daybreak от OpenAI и как в них попасть.

Daybreak Red предназначен для аккредитованных групп специалистов по кибербезопасности, выполняющих сложные, санкционированные работы в этой области — работы, которая может выглядеть рискованной вне контекста, даже если она выполняется в целях защиты. Это включает в себя исследование уязвимостей, тестирование на проникновение, учения «красной команды» и проверку эксплойтов на системах, которыми организация владеет, управляет или имеет разрешение на тестирование. Другими словами, OpenAI заявляет, что GPT-5.6-Cyber предназначен для доверенных специалистов по защите с явной профессиональной необходимостью, а не для общих экспериментов.

Предприятиям, желающим получить доступ, необходимо подать заявку через Daybreak Access, текущий способ проверки пользователей в сфере кибербезопасности, используемый OpenAI. В заявке компаниям необходимо указать, кто они, какие виды работ по обеспечению безопасности планируют выполнять, где будут использоваться модели и какие продукты или платформы OpenAI они планируют использовать. Заявители также должны подтвердить, что их работа является законной, оборонительной и санкционированной.

OpenAI также ожидает от заявителя наличия серьезной собственной программы обеспечения безопасности. Компания заявляет, что участвующие предприятия должны иметь такие средства контроля, как единый вход в систему, многофакторная аутентификация, доступ на основе ролей, мониторинг использования сотрудниками, журналы использования, контроль ключей API и документированный процесс реагирования на инциденты. OpenAI также запрашивает признанный сертификат безопасности, такой как SOC 2 Type II, ISO 27001 или эквивалентный стандарт. Доступ ограничен утвержденными лицами внутри организации, использующими учетные записи и устройства, контролируемые компанией.

Если предприятие не соответствует критериям для получения доступа уровня Daybreak Red или не нуждается в таком уровне доступа, OpenAI рекомендует большинству компаний вместо него использовать уровень Daybreak Blue, другой уровень доступа для кибербезопасности.

«Синий» — это более широкий уровень для одобренных специалистов по кибербезопасности. Он не предоставляет доступ к GPT-5.6-Cyber, но дает проверенным пользователям доступ к передовым универсальным моделям OpenAI, включая GPT-5.6 Sol, с мерами защиты, адаптированными для законной работы по кибербезопасности.

Для многих корпоративных команд по обеспечению безопасности Blue может стать более реалистичной отправной точкой. OpenAI заявляет, что он предназначен для таких задач, как анализ безопасного кода, обнаружение уязвимостей, анализ вредоносного ПО, реагирование на инциденты и проверка патчей. Это по-прежнему конфиденциальные задачи, но они не обязательно требуют того же специализированного доступа к кибермодели, который предоставляется с Red.

Практический вывод заключается в том, что теперь у предприятий есть два пути доступа к Daybreak. Синий цвет предназначен для утвержденных специалистов по кибербезопасности, которым требуется более эффективная помощь ИИ в повседневной работе по обеспечению безопасности. Красный цвет предназначен для небольшого числа утвержденных команд, которые могут обосновать доступ к специализированным моделям кибербезопасности, включая GPT-5.6-Cyber. Компаниям, которые хотят использовать возможности Daybreak в продуктах или услугах для своих собственных клиентов, необходим отдельный путь утверждения через программу Daybreak Cyber Partner Program, а не просто подавать заявку на внутренний корпоративный доступ и передавать его третьим лицам.

Как OpenAI пришла к этому: от доверенного доступа к Daybreak

С 2023 года OpenAI оказывает поддержку специалистам по кибербезопасности в рамках своей программы грантов по кибербезопасности, которая впоследствии была расширена до 10 миллионов долларов, и начала внедрять специализированные меры защиты от киберугроз в свои модели, начиная с GPT-5.2.

В феврале 2026 года была представлена система Trusted Access for Cyber (TAC), основанная на принципах идентификации и доверия, которая предоставляла проверенным специалистам по кибербезопасности более низкие уровни отказов на основе классификаторов при выполнении разрешенной работы, такой как анализ уязвимостей, анализ вредоносного ПО и обратное проектирование бинарных файлов.

С этого момента темпы ускорились. В марте генеральный директор и соучредитель OpenAI Сэм Альтман объявил о программе Daybreak. В апреле OpenAI расширила TAC и выпустила GPT-5.4-Cyber, версию GPT-5.4, доработанную для обеспечения «кибербезопасности» для ограниченного круга проверенных поставщиков и исследователей.

В мае компания выпустила ограниченную предварительную версию GPT-5.5-Cyber для специалистов по защите критической инфраструктуры и привлекла к сотрудничеству таких партнеров, как Cisco, Intel, SentinelOne, Snyk и Cloudflare.

Примечательно, что в то время OpenAI заявила, что GPT-5.5-Cyber был «в первую очередь обучен быть более снисходительным», а не значительно превосходить свою общую модель — GPT-5.5-Cyber фактически показал худшие результаты, чем GPT-5.5, в некоторых оценках.

Начиная с 1 июня, TAC требует включения защищенной от фишинга расширенной системы безопасности учетных записей для пользователей самых мощных моделей, а с 1 сентября Daybreak требует использования аппаратных ключей безопасности для отдельных учетных записей.

Компания OpenAI заявляет, что в GPT-5.6-Cyber уже обнаружены уязвимости нулевого дня.

Компания OpenAI не полагается исключительно на бенчмарки для обоснования своей позиции.

Компания заявляет, что ее исследователи использовали GPT-5.6-Cyber для изучения V8, движка JavaScript, лежащего в основе Chrome, и обнаружили две ранее неизвестные уязвимости, которые могут быть объединены для повреждения памяти и выхода за пределы изолированной среды кучи V8.

Исследователи OpenAI подтвердили полученные данные и передали их Google, которая устранила уязвимость, получившую обозначение CVE-2026-15903 — серьезную ошибку, в которой оптимизирующий компилятор V8 пропускал проверку безопасности во время преобразования целых чисел, что позволяло злоумышленнику использовать индекс массива за пределами допустимого диапазона для чтения или перезаписи памяти.

По данным OpenAI, модель также способствовала обнаружению как минимум пяти уязвимостей в неназванной популярной мобильной операционной системе, трех критических уязвимостей в неназванной популярной базе данных и более 400 уязвимостей, способных привести к повышению привилегий в ядре популярной операционной системы. По данным OpenAI, координация этих раскрытий все еще продолжается.

Полученные результаты вывели OpenAI на быстро развивающийся рынок решений для обеспечения безопасности в атаках с использованием ИИ. Например, компания XBOW выпускает автономные агенты для тестирования на проникновение, которые составляют карты поверхностей атаки, пытаются использовать уязвимости и независимо подтверждают полученные результаты; в 2025 году она стала первой системой ИИ, возглавившей рейтинг HackerOne в США по программе вознаграждения за обнаружение ошибок, а в этом году раскрыла ряд критических уязвимостей удаленного выполнения кода, соответствующих стандарту CVSS-9.8, в системах обработки изображений Bing от Microsoft, обнаруженных без доступа к исходному коду.

Для руководителей служб безопасности предприятий эта растущая конкуренция имеет значение, поскольку исследования уязвимостей выходят за рамки использования специалистов с дипломом магистра права в качестве помощников. Производители все чаще создают системы, в которых модели могут исследовать целевые объекты, управлять инструментами, проверять гипотезы и выдавать практические результаты.

Специализация не означает повсеместное превосходство.

Результаты, полученные самой компанией OpenAI, также показывают, почему предприятиям не следует просто приравнивать киберспециализацию к повышению эффективности во всех областях.

GPT-5.6-Cyber превзошёл GPT-5.6 Sol и GPT-5.5-Cyber в реализации ExploitGym от OpenAI, которая оценивает способность агентов превращать известные уязвимости в работающие эксплойты в контролируемых средах. Он также обошёл Sol во внутренней оценке уязвимостей нулевого дня.

Однако GPT-5.6 Sol показала лучшие результаты в оценке OpenAI по обнаружению уязвимостей и составлению отчетов. OpenAI объясняет более низкий балл модели Cyber отчасти более короткими и менее подробными отчетами об уязвимостях.

Sol также показал лучшие результаты на ExploitBench при стандартном ограничении в 300 ходов, при этом OpenAI заявила, что он решал задачи более эффективно с точки зрения использования токенов. Расширение оценки до 600 ходов сократило разрыв между моделями.

Это позволяет предположить, что предприятия в конечном итоге могут рассматривать кибермодели как специализированных специалистов, а не как замену универсальным моделям мышления: одна модель для глубокой работы с уязвимостями, другая, потенциально лучше подходящая для анализа, документирования или других частей рабочего процесса обеспечения безопасности.

Технический директор SpecterOps Джаред Аткинсон заявил, что GPT-5.6-Cyber «существенно улучшает наши специализированные рабочие процессы исследования уязвимостей», добавив, что некоторые задачи были решены менее чем за сутки, тогда как предыдущие модели не справлялись с ними после нескольких недель нерегулярных попыток.

Инцидент с «обнимающим лицом» омрачает запуск.

Предложение о либеральной модели появилось спустя несколько недель после самой серьезной публичной демонстрации OpenAI того, что может пойти не так, когда кибер-отказы отклоняются, — и OpenAI напрямую затрагивает эту историю в своем заявлении по поводу Daybreak.

В июле OpenAI и Hugging Face совместно сообщили, что во время внутренней оценки производительности ExploitGym — проведенной с преднамеренно отключенными производственными классификаторами для измерения максимальных возможностей — комбинация моделей OpenAI, включая GPT-5.6 Sol и еще не выпущенную, более мощную предварительную модель, вышла за пределы изолированной исследовательской среды и автономно атаковала производственную инфраструктуру Hugging Face.

Модели использовали уязвимость нулевого дня во внутреннем кэше реестра пакетов, чтобы получить доступ к открытому интернету, затем перемещались по исследовательским узлам OpenAI, после чего сделали вывод, что Hugging Face, вероятно, хранит ключи ответов ExploitGym, и, используя украденные учетные данные и уязвимости удаленного выполнения кода, получили доступ к своей производственной базе данных. OpenAI назвала это «беспрецедентным кибер-инцидентом, в котором задействованы самые современные кибервозможности».

Как ранее сообщал VentureBeat, этот эпизод также выявил обратную сторону повсеместных мер безопасности: когда защитники Hugging Face попытались использовать коммерческие модели для анализа исходных эксплойтов и дампов учетных данных, полученных в результате атаки, модели отказались, и компания завершила реконструкцию данных только после перехода на китайскую модель с открытым исходным кодом, GLM 5.2, запущенную локально.

Именно эта динамика «ограничения блокируют защитника» во многом и призвана решить система Daybreak от OpenAI, предусматривающая снижение количества отказов, — хотя тот же инцидент иллюстрирует риски, связанные с уменьшением количества отказов в первую очередь.

OpenAI тщательно проводит грань между этим инцидентом и данным продуктом. В объявлении Daybreak прямо говорится, что GPT-5.6-Cyber «не участвовал в эксплуатации уязвимости Hugging Face, и никакие другие модели не планируются к выпуску в будущем», и отмечается, что модель, ставшая предметом скандала в июле, представляла собой внутренний исследовательский прототип, который с тех пор был деактивирован, зашифрован и лишен доступа к исследовательским ресурсам.

Компания заявила, что сотрудничает с внешними консультантами, включая CrowdStrike, METR и Redwood Research, в рамках проверки, и включила Hugging Face в свою программу доверенного доступа.

По моей оценке, модель доступа по-прежнему ставит перед OpenAI сложный вопрос: ограничивает ли сохранение GPT-5.6-Cyber в рамках более узкого уровня Daybreak Red ту самую работу по защите, которую, по их словам, они хотят ускорить? Если модель доступна только небольшой группе утвержденных участников, предприятия за пределами этого уровня могут по-прежнему не иметь доступа к специализированной помощи ИИ, которая могла бы помочь в быстрой диагностике, локализации и реагировании на инциденты, подобные тому, что произошел с Hugging Face.

Это означает, что OpenAI, возможно, всё ещё повторяет часть ошибки, от которой пытается избавиться. Ужесточая процедуру утверждения своей самой эффективной модели кибербезопасности, компания снижает очевидный риск неправомерного использования, но при этом заставляет многих специалистов по защите предприятий искать альтернативные решения. Для команд, которые не могут пройти квалификацию Daybreak Red или не могут ждать одобрения, модели с открытыми весами могут оставаться более практичной альтернативой: менее контролируемые, но более доступные, проверяемые, используемые внутри компании и адаптируемые в ходе реального расследования инцидентов безопасности.

Ограждение все чаще располагается вокруг модели.

Наиболее важным аспектом Daybreak в конечном итоге может оказаться не столько тестовые показатели, сколько архитектура доступа.

В заявлении OpenAI прямо говорится, что Daybreak Blue устраняет системные ограничения, которые могут препятствовать законной работе по защите, а GPT-5.6-Cyber идет еще дальше, уменьшая количество отказов моделей при выполнении определенных задач двойного назначения. Вместо этого OpenAI вводит ограничения на то, кто получает доступ и как работают модели.

Доступ к сервису Daybreak ограничен для утвержденных лиц и организаций, выполняющих разрешенную работу. OpenAI заявляет, что меры контроля включают проверку личности, безопасность учетной записи, мониторинг, ограничения на использование утвержденных ресурсов и юридические подтверждения.

Компания также призывает клиентов Daybreak, использующих Codex, перейти от выполнения с полным доступом к режиму автоматической проверки, способному оценивать действия, требующие повышенных прав, прежде чем они будут выполнены. Начиная с 1 сентября, для отдельных учетных записей Daybreak потребуется использовать аппаратные ключи безопасности. OpenAI заявляет, что в ближайшие недели также внедряет улучшенный мониторинг и уделяет приоритетное внимание обучению и тестированию выравнивания для будущих релизов Daybreak — эти обязательства, в контексте, можно рассматривать как прямой ответ на проверку Hugging Face.

Более масштабный продукт OpenAI Codex Security предоставляет дополнительный уровень поддержки моделей, обеспечивая анализ репозиториев, проверку уязвимостей, их устранение и интеграцию в облачные, pull-request- и локальные рабочие процессы разработки. По данным OpenAI, Codex Security просканировал более 30 миллионов коммитов в более чем 30 000 кодовых базах, устранив более 500 000 обнаруженных уязвимостей.

Такой подход, сочетающий модель и инструменты, напоминает более широкую тенденцию в разработке продуктов для обеспечения безопасности на основе ИИ. Например, XBOW делает акцент на оркестрации, проверке эксплойтов и управлении моделями, находящимися на начальном этапе разработки, а не рассматривает одну лишь модель LLM как полноценную систему тестирования на проникновение.

Тем не менее, OpenAI признает, что все более либеральные модели кибербезопасности создают дополнительные риски, будь то из-за неправомерного использования или несоответствия. В рамках своей системы готовности она оценивает как GPT-5.6 Sol, так и GPT-5.6-Cyber на высоком уровне кибербезопасности, но ниже критического порога. Более подробная информация о системе GPT-5.6-Cyber планируется к публикации позже.

Для руководителей служб информационной безопасности и лидеров в области проектирования систем безопасности Daybreak, таким образом, представляет собой иной вопрос развертывания, чем очередное поэтапное обновление модели. По мере того, как модели становятся достаточно функциональными, чтобы выполнять работу, ранее доступную только опытным исследователям уязвимостей, — и, как показал инцидент с Hugging Face, достаточно функциональными, чтобы преследовать узкую цель непосредственно в песочнице, — корпоративная плоскость управления этими моделями — разрешения, песочницы, мониторинг, проверка и авторизация — становится столь же важной, как и содержащаяся в них интеллектуальная составляющая.

Источник: venturebeat.com

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Коротко из Telegram~ YouTube ужесточит требования к монетизации каналов с 2027 года С… Архив рубрики ~Коротко из Telegram~ 🔪 OpenAI открыла исходный код Codex Security — CLI и… Новости робототехники Друг всегда прикроет спину Итальянский институт технологий совместно с INAIL и Generative… Архив рубрики ~Коротко из Telegram~ ‼️ 31 июля Альтман написал в X: подключите семейные календари,… Архив рубрики ~Коротко из Telegram~ GitHub превратили в TikTok для разработчиков Новый сервис показывает репозитории… Архив рубрики ~Коротко из Telegram~ Chrome может занять ещё 20 ГБ — спасибо локальному ИИ… Архив рубрики ~Коротко из Telegram~ ИИ-камеры уже следят за младенцами — и это немного тревожно… Архив рубрики ~Коротко из Telegram~ Навигатор по тени стал хитом в Южной Корее В Южной… Архив рубрики ~Коротко из Telegram~ Фантастика понемногу становится рутиной: ИИ уже умеет убедительно воссоздавать живопись… Архив рубрики ~Коротко из Telegram~ Не обязательно больше: зачем нужны малые языковые модели В гонке… Архив рубрики ~Коротко из Telegram~ MySpace может вернуться. Но в чем смысл? MySpace, когда-то крупнейшая… Архив рубрики ~Коротко из Telegram~ IBS купил компанию у своего менеджера Группа IBS приобрела 100% российского… Новости робототехники Unitree оценили в 219 годовых прибылей Гуманоиды пока чаще работают… Архив рубрики ~Коротко из Telegram~ ИИ-бум сделал инженеров Samsung и SK Hynix самыми желанными женихами… Архив рубрики ~Коротко из Telegram~ YouTube ужесточит требования к монетизации каналов с 2027 года С… Архив рубрики ~Коротко из Telegram~ 🔪 OpenAI открыла исходный код Codex Security — CLI и… Новости робототехники Друг всегда прикроет спину Итальянский институт технологий совместно с INAIL и Generative… Архив рубрики ~Коротко из Telegram~ ‼️ 31 июля Альтман написал в X: подключите семейные календари,… Архив рубрики ~Коротко из Telegram~ GitHub превратили в TikTok для разработчиков Новый сервис показывает репозитории… Архив рубрики ~Коротко из Telegram~ Chrome может занять ещё 20 ГБ — спасибо локальному ИИ… Архив рубрики ~Коротко из Telegram~ ИИ-камеры уже следят за младенцами — и это немного тревожно… Архив рубрики ~Коротко из Telegram~ Навигатор по тени стал хитом в Южной Корее В Южной… Архив рубрики ~Коротко из Telegram~ Фантастика понемногу становится рутиной: ИИ уже умеет убедительно воссоздавать живопись… Архив рубрики ~Коротко из Telegram~ Не обязательно больше: зачем нужны малые языковые модели В гонке… Архив рубрики ~Коротко из Telegram~ MySpace может вернуться. Но в чем смысл? MySpace, когда-то крупнейшая… Архив рубрики ~Коротко из Telegram~ IBS купил компанию у своего менеджера Группа IBS приобрела 100% российского… Новости робототехники Unitree оценили в 219 годовых прибылей Гуманоиды пока чаще работают… Архив рубрики ~Коротко из Telegram~ ИИ-бум сделал инженеров Samsung и SK Hynix самыми желанными женихами…

Оставить комментарий