Мой блог
OpenAI обновила программу Daybreak: новые уровни доступа и модель для кибербезопасности

OpenAI масштабирует программу Daybreak: два уровня доступа и специализированная модель для кибербезопасности
10 августа 2026 года компания OpenAI официально объявила о масштабной реорганизации своей программы кибербезопасности Daybreak. Теперь доступ к инструментам компании структурирован по двухуровневой системе, которая сопровождается выпуском новой, специально обученной модели. Уровень Daybreak Blue открывает доступ к передовым моделям общего назначения, включая флагманскую GPT-5.6 Sol, для верифицированных защитников, занимающихся повседневными задачами обеспечения безопасности. В то же время уровень Daybreak Red ограничивает доступ к новейшей специализированной модели GPT-5.6-Cyber. Этот сегмент предназначен для проведения глубоких исследований уязвимостей, валидации эксплойтов и комплексного тестирования безопасности, что требует более строгой проверки пользователей.
Данная архитектура призвана разрешить серьезное операционное противоречие, с которым OpenAI сталкивалась в процессе работы. Встроенные системные механизмы защиты в GPT-5.6 Sol предназначены для фильтрации запросов, связанных с кибербезопасностью, чтобы предотвратить их неправомерное использование. Однако компания признала, что эти же фильтры зачастую препятствуют выполнению легитимной профессиональной деятельности. Daybreak Blue снимает эти барьеры для подтвержденных пользователей. Тем не менее, для наиболее чувствительных сценариев — таких как тестирование на проникновение в производственных системах — даже в Blue-доступе сохраняется определенный уровень отказов. Именно для таких задач и была создана GPT-5.6-Cyber: это версия GPT-5.6 Sol, дообученная специально для минимизации ложных отказов в сложных киберзадачах, таких как поиск уязвимостей нулевого дня или разработка сложных цепочек эксплойтов.
Оценка эффективности: новые бенчмарки и сравнительные метрики
Чтобы количественно оценить «разрешительную способность» новой модели, OpenAI разработала внутренний оценочный инструмент — Advanced Cybersecurity Completion Rate. Эта метрика фиксирует частоту успешных ответов модели на запросы, связанные с обходом аутентификации, повышением привилегий и развитием цепочек эксплойтов. По данным компании, GPT-5.6-Cyber завершает 95% подобных запросов, тогда как GPT-5.6 Sol со стандартными защитными механизмами — только 1,5%, а при использовании режима Daybreak Blue — 2%. Для сравнения, предшествующая специализированная модель GPT-5.5-Cyber справлялась лишь с 57,3% запросов, что на протяжении долгого времени вызывало критику со стороны профессиональных исследователей безопасности.

Результаты оценки возможностей модели демонстрируют более сложную картину. На бенчмарке ExploitGym, где проверяется способность агентов превращать известные уязвимости в рабочие эксплойты для выполнения кода в контролируемых средах, GPT-5.6-Cyber показывает лучшие результаты, чем GPT-5.6 Sol и GPT-5.5-Cyber. Однако в рамках внутреннего теста OpenAI по обнаружению уязвимостей и написанию отчетов (Vulnerability Discovery and Report Writing) новая модель уступает GPT-5.6 Sol; по мнению разработчиков, это связано с тем, что специализированная модель генерирует более лаконичные, но менее детализированные отчеты. В тесте ExploitBench, который считается более сложным из-за активации песочницы V8 и ограниченной информации для агента, общая модель GPT-5.6 Sol лидирует в рамках стандартного лимита в 300 итераций, хотя при увеличении лимита до 600 разрыв между моделями заметно сокращается. Важно отметить, что все эти данные предоставлены вендором, а часть внутренних тестов пока не была независимо воспроизведена сторонними экспертами.

Практические результаты: реальные угрозы и работа экспертов
Наиболее весомым доказательством возможностей модели являются не бенчмарки, а реальные кейсы. С помощью GPT-5.6-Cyber исследователи OpenAI проанализировали JavaScript-движок V8 в браузере Chrome и обнаружили две ранее неизвестные уязвимости, которые можно было объединить в цепочку для повреждения памяти и обхода песочницы V8. Первая ошибка — баг в компиляторе, позволявший атакующему читать или перезаписывать память внутри песочницы Chrome, — была сообщена Google, исправлена и получила идентификатор CVE-2026-15903. Кроме того, OpenAI сообщила об обнаружении не менее пяти уязвимостей в популярной мобильной ОС, трех критических брешей в популярной базе данных и более 400 уязвимостей повышения привилегий в популярном ядре ОС. Все эти данные проходят процесс раскрытия в сотрудничестве с партнерами Daybreak и мейнтейнерами open-source проектов. Джаред Аткинсон, технический директор компании SpecterOps, протестировавший модель на раннем этапе, описал ее влияние как «сжатие работы»: модель выполнила задачи за один день, на которые у предыдущих систем уходили недели.


Управление доступом, стандарты и будущее программы
Доступ к обоим уровням программы регулируется строгой проверкой личности, требованиями к безопасности аккаунтов, мониторингом активности и обязательными юридическими соглашениями. OpenAI активно переводит пользователей своего кодинг-агента Codex на режим автопроверки, требующий подтверждения действий с повышенными привилегиями. Также с 1 сентября 2026 года для всех индивидуальных учетных записей Daybreak использование аппаратных ключей безопасности становится обязательным требованием. В рамках системы Preparedness Framework обе модели (Sol и Cyber) были оценены как имеющие «высокий» уровень возможностей в сфере кибербезопасности, но не достигающие критического порога. Компания также подчеркнула, что GPT-5.6-Cyber не использовалась в инцидентах, связанных с Hugging Face.

Новая структура Daybreak Blue и Red заменяет существовавший ранее трек Trusted Access, упорядочивая программу, которая до этого развивалась разрозненно. Изначально запущенная 22 июня 2026 года версия GPT-5.5-Cyber уже опиралась на партнерскую сеть, в которую вошли Accenture, CrowdStrike, Cisco, IBM и Palo Alto Networks. Нынешнее обновление закрепляет этот опыт, превращая Daybreak в двухступенчатую систему, где сочетаются гибкость для массовых защитников и узкоспециализированная мощь для экспертов по поиску уязвимостей.

Источник: unite.ai

