Что случилось
10 августа OpenAI расширила свою программу Daybreak, добавив отдельные уровни доступа для оборонительных работ и передовых исследований в области безопасности, включая специализированную модель GPT-5.6-Cyber.
Daybreak Blue предоставляет проверенным защитникам GPT-5.6 Sol с удаленными киберфильтрами системного уровня для таких задач, как проверка безопасного кода, анализ вредоносного ПО, реагирование на инциденты, обнаружение уязвимостей и проверка исправлений. Daybreak Red добавляет GPT-5.6-Cyber для авторизованной проверки эксплойтов, тестирования на проникновение и других исследований двойного назначения, от которых общая модель все еще может отказаться.
OpenAI сообщает, что GPT-5.6-Cyber выполнил 95% запросов в своей внутренней оценке уровня выполнения расширенной кибербезопасности по сравнению с 1,5% для стандартного GPT-5.6 Sol, 2% для Sol до Daybreak Blue и 57,3% для GPT-5.5-Cyber. Компания заявляет, что тест охватывает такие сценарии, как разработка цепочки эксплойтов, обход аутентификации и повышение привилегий; он не выпустил оценочный набор.
Компания также сообщает, что с помощью этой модели можно обнаружить две ранее неизвестные уязвимости V8, которые могут быть связаны друг с другом. Google назначил первый CVE-2026-15903 и исправил его в Chrome 150. Рекомендации по выпуску Google независимо подтверждают, что уязвимость высокой серьезности допускала чтение и запись за пределами границ в V8, хотя и не оценивает систему искусственного интеллекта, которая помогла ее найти.
OpenAI описывает GPT-5.6-Cyber как модель, построенную на базе GPT-5.6 Sol и подготовленную для избранных задач двойного назначения с высоким уровнем риска, а не для неограниченного наступательного использования. Daybreak Red доступен только утвержденным лицам и организациям, выполняющим авторизованную работу с проверкой личности, безопасностью учетной записи, мониторингом, ограничениями на разрешенное использование и юридическими аттестациями. В объявлении также говорится, что с 1 сентября 2026 года отдельным учетным записям Daybreak потребуются аппаратные ключи безопасности.
Подробности об источнике: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗
Почему это важно
В этом выпуске более опасные кибервозможности пограничной модели переносятся из небольшого исследовательского учреждения в программу управляемого доступа, проверяя, смогут ли защитники получить их до того, как те же методы распространятся на злоумышленников.
Сокращение отказов является центральным элементом продукта: модель, которая отказывается от реалистичной работы с эксплойтами, может быть более безопасной для общего использования, но менее полезной для команд, которым необходимо воспроизвести уязвимость, прежде чем они смогут расставить приоритеты и исправить ее. Daybreak отделяет более широкие защитные задачи от разработки эксплойтов с повышенным риском вместо того, чтобы предоставлять одну политику каждому пользователю.
Раскрытие V8 является конкретным доказательством того, что исследование уязвимостей с помощью ИИ может достичь развернутого программного обеспечения. Это также уже, чем заявление об автономной защите: OpenAI утверждает, что его исследователи подтвердили выводы и согласовали раскрытие информации с Google, в то время как в общедоступных рекомендациях Chrome фиксируется исправленный недостаток, а не роль модели в полном процессе исследования.
OpenAI также расширяет Daybreak за счет консультантов по безопасности и поставщиков технологий. Утвержденные партнеры сохраняют доступ к базовым моделям и применяют их при взаимодействии с клиентами, используя элементы управления, которые могут включать проверку личности, определенные области действия, ведение журналов, мониторинг и проверку человеком.
Этот партнерский дизайн меняется, кто должен принять последнюю милю решения. OpenAI сообщает, что доступ к базовой модели не передается непосредственно клиенту; партнер определяет взаимодействие, анализирует результаты и применяет свой собственный опыт в области безопасности, прежде чем действовать. Таким образом, на практике полезное развертывание зависит от способности партнера отделить воспроизводимый недостаток от спекулятивного предложения модели, продолжить тестирование в рамках согласованного объема и провести подтвержденное исправление через реальный процесс обслуживания программного обеспечения.
Интерактивный механизм: как он на самом деле работает
Изучите технологию, лежащую в основе этой разработки, в интерактивном режиме.
What is an adversarial example in machine learning security?
Что посмотреть дальше
Следите за обещанной системной картой, независимым воспроизведением тестов, полным раскрытием других обнаруженных уязвимостей и доказательствами того, что средства контроля доступа выдерживают неправильное использование.
Большинство показателей производительности в объявлении взяты из внутренних реализаций OpenAI Advanced Cybersecurity Completion Rate, ExploitGym, ExploitBench и оценок отчетов об уязвимостях. Компания заявляет, что GPT-5.6-Cyber не выиграл все сравнения: GPT-5.6 Sol показал лучшие отчеты по одной оценке и более эффективно решил стандартную 300-оборотную настройку ExploitBench.
OpenAI оценивает GPT-5.6-Cyber на высоком уровне, но ниже критического, за возможности кибербезопасности в рамках своей структуры готовности. В нем говорится, что более полная системная карта появится позже. До тех пор, пока методы и результаты не будут опубликованы достаточно подробно, чтобы их можно было воспроизвести, это объявление поддерживает приписываемые компании заявления, а не независимую оценку реальных наступательных возможностей.
Обоснование безопасности зависит от операций в такой же степени, как и от обучения. Отдельные учетные записи Daybreak должны использовать аппаратные ключи безопасности начиная с 1 сентября, и OpenAI рекомендует изолированные среды, ограниченные разрешения, отслеживаемые действия агентов и человеческий надзор. Полезные последующие отчеты должны отражать случаи отзыва доступа, обнаруженные злоупотребления, сроки раскрытия информации, результаты исправлений и ложные срабатывания по мере расширения программы.
В заголовке сравнения показателей завершения также есть важная оговорка. OpenAI сообщает, что каждая модель запускалась на самом высоком общедоступном уровне рассуждений, и отмечает, что GPT-5.6-Cyber имеет тенденцию использовать больший бюджет рассуждений и больше токенов, чем GPT-5.6 Sol. Таким образом, более высокий показатель завершения может отражать как специализированную подготовку, так и другой объем вычислений. Независимые тесты должны сообщать о согласованных бюджетах, построении задач, критериях отказа и частоте небезопасных или непригодных для использования ответов, а не только о том, был ли получен ответ.
Зрелая учетная запись программы должна будет отслеживать весь жизненный цикл уязвимости. Это означает, что нужно сообщать о том, как часто сгенерированный моделью потенциальный продукт переживает человеческое воспроизводство, сколько результатов являются дубликатами или имеют низкий уровень серьезности, как быстро поставщики получают отчеты, требующие принятия мер, и устанавливаются ли исправления до публичного раскрытия. Также следует объяснить, что происходит, когда клиент партнера просит модель пересечь границу тестирования, когда агент сталкивается с производственными учетными данными или когда предлагаемый эксплойт слишком опасен, чтобы его можно было проверить напрямую. Эти меры контроля определяют, создаст ли более низкий процент отказов измеримую защитную ценность вместо простого расширения предложения кода двойного назначения.
Общественность также должна иметь возможность отличать возможности модели от полномочий клиента. Правила доступа OpenAI предусматривают юридические аттестации, проверки личности, мониторинг и ограниченную работу вокруг модели, но эти элементы управления являются утверждениями, которые подлежат проверке с течением времени. В отчетах об инцидентах должно быть указано, был ли запрос заблокирован, передан на рассмотрение или разрешен в рамках задокументированного взаимодействия, не раскрывая при этом подробностей об эксплойтах, которые облегчили бы атаку на непропатченную систему.