Назад към Новини
СигурностAI Understanding брифинг

OpenAI Отваря GPT-5.6-Cyber за одобрени защитници

Новият кибермодел с контролиран достъп на OpenAI отговаря на по-усъвършенствани заявки за изследване на експлойт и помогна да се намери коригиран недостатък на Chrome, но повечето доказателства идват от вътрешни оценки.

5 min readRead the primary source
Документ с първичен източникИзточникът е записан
Издател
OpenAI's GPT-5.6-Cyber and Daybreak announcement
Изходна връзка
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
Тип източник
Първичен документ — официално съобщение, документ, документ или първа страна, която четем директно.
КонтекстРазберете това за 60 секунди

Започнете тук

Ключови термини

Комплект за оценка
Задържан набор от данни, използван за измерване на качеството на модела след обучение.
Безопасен калъф
Структуриран аргумент, подкрепен от доказателства, че една AI система е безопасна за определен контекст на употреба.
Бенчмарк
Стандартизиран тест или набор от данни, използвани за измерване и сравняване на ефективността на модела.
Тествайте себе сиAI сигурност тест

Какво стана

OpenAI разшири своята програма Daybreak на 10 август с отделни нива на достъп за отбранителна работа и напреднали изследвания на сигурността, включително специализиран модел GPT-5.6-Cyber.

Daybreak Blue дава на одобрени защитници GPT-5.6 Sol с премахнати кибер филтри на системно ниво за работа като преглед на защитен код, анализ на зловреден софтуер, реакция при инциденти, откриване на уязвимости и валидиране на корекции. Daybreak Red добавя GPT-5.6-Cyber ​​за оторизирано валидиране на експлойт, тестове за проникване и други изследвания с двойна употреба, които общият модел все още може да откаже.

OpenAI казва, че GPT-5.6-Cyber ​​е изпълнил 95% от заявките в своята вътрешна оценка на степента на завършване на Advanced Cybersecurity, в сравнение с 1,5% за стандартния GPT-5.6 Sol, 2% за Sol до Daybreak Blue и 57,3% за GPT-5.5-Cyber. Компанията казва, че тестът обхваща сценарии като развитие на верига за експлоатиране, заобикаляне на удостоверяването и ескалация на привилегии; не е пуснал комплекта за оценка.

Компанията също така съобщава, че използва модела, за да помогне за откриването на две неизвестни досега уязвимости на V8, които могат да бъдат свързани заедно. Google присвои на първия CVE-2026-15903 и го закърпи в Chrome 150. Уведомлението за пускане на Google независимо потвърждава, че недостатъкът с висока степен на сериозност е позволил четене и запис извън границите във V8, въпреки че не оценява AI системата, която е помогнала за намирането му.

OpenAI описва GPT-5.6-Cyber ​​като модел, изграден върху GPT-5.6 Sol и обучен за избрани високорискови задачи с двойна употреба, а не за неограничена нападателна употреба. Daybreak Red е достъпен само за одобрени лица и организации, извършващи оторизирана работа, с проверка на самоличността, сигурност на акаунта, наблюдение, одобрени ограничения за употреба и правни удостоверения. Съобщението също така казва, че отделните акаунти в Daybreak ще се нуждаят от хардуерни ключове за сигурност от 1 септември 2026 г.

Детайли за източника: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

Защо има значение

Изданието премества по-опасните кибер възможности на граничен модел от малка изследователска среда в управлявана програма за достъп, като тества дали защитниците могат да ги получат, преди същите техники да се разпространят към нападателите.

Намаляването на отказите е централно за продукта: модел, който отказва реалистична работа с експлойти, може да е по-безопасен за обща употреба, но по-малко полезен за екипи, които трябва да възпроизведат уязвимост, преди да могат да я приоритизират и поправят. Daybreak разделя по-широките защитни задачи от разработването на експлойт с по-висок риск, вместо да излага една политика на всеки потребител.

Разкриването на V8 е конкретно доказателство, че изследването на уязвимостта с помощта на AI може да достигне до внедрения софтуер. Освен това е по-тясно от твърдението за автономна защита: OpenAI казва, че неговите изследователи са потвърдили констатациите и координираното разкриване с Google, докато публичните препоръки на Chrome записват коригирания недостатък, а не ролята на модела в пълния изследователски процес.

OpenAI също така разширява Daybreak чрез консултации по сигурността и доставчици на технологии. Одобрените партньори запазват достъп до основните модели и ги прилагат в рамките на ангажиментите на клиентите, с контроли, които могат да включват проверка на самоличността, дефинирани обхвати, регистриране, наблюдение и преглед от човек.

Този партньорски дизайн променя кой трябва да предостави последната миля на преценката. OpenAI казва, че достъпът до основния модел не се прехвърля директно на клиент; партньорът определя ангажимента, преглежда констатациите и прилага собствения си опит в областта на сигурността преди действие. Следователно на практика полезното внедряване зависи от способността на партньора да отдели възпроизводим недостатък от предложение за спекулативен модел, да продължи тестването в договорения обхват и да премести потвърдена корекция чрез реален процес на софтуерна поддръжка.

Interactive Mechanism

Интерактивен механизъм: как всъщност работи

Разгледайте интерактивно основната технология зад тази разработка.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Интерактивна проверка на концепцията+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

Какво да гледате след това

Следете за обещаната системна карта, независимо възпроизвеждане на бенчмарк, завършено разкриване на другите докладвани уязвимости и доказателства, че контролите за достъп издържат на злоупотреба.

Повечето данни за производителността в съобщението идват от вътрешните внедрявания на OpenAI на Advanced Cybersecurity Completion Rate, ExploitGym, ExploitBench и оценки за докладване на уязвимости. Компанията казва, че GPT-5.6-Cyber ​​не е спечелил всяко сравнение: GPT-5.6 Sol изготви по-добри отчети за една оценка и реши стандартната настройка на ExploitBench с 300 оборота по-ефективно.

OpenAI оценява GPT-5.6-Cyber ​​като високо, но под критично, за способности за киберсигурност съгласно неговата рамка за готовност. Пише, че по-пълна системна карта ще дойде по-късно. Докато методите и резултатите не бъдат публикувани с достатъчно подробности, за да бъдат възпроизведени, съобщението подкрепя приписани твърдения на компанията, а не независима мярка за офанзивни способности в реалния свят.

Случаят на безопасност зависи от операциите толкова, колкото и от обучението. Индивидуалните акаунти в Daybreak трябва да приемат хардуерни ключове за сигурност от 1 септември и OpenAI препоръчва изолирани среди, разрешения с обхват, наблюдавани действия на агенти и човешки надзор. Полезните последващи доклади трябва да показват отнети достъпи, открити злоупотреби, срокове за разкриване, резултати от корекции и фалшиви положителни резултати с разширяването на програмата.

Сравнението на степента на завършване на заглавието също има важно предупреждение за измерване. OpenAI казва, че всеки модел е управляван на най-високото публично достъпно ниво на разсъждения и отбелязва, че GPT-5.6-Cyber ​​има тенденция да използва по-голям бюджет за разсъждения и повече токени от GPT-5.6 Sol. Следователно по-високият процент на завършване може да отразява както специализирано обучение, така и различно количество изчисления. Независимите тестове трябва да отчитат съответстващи бюджети, конструкция на задачата, критерии за отказ и процент на опасни или неизползваеми отговори, а не само дали е даден отговор.

Един зрял акаунт на програмата ще трябва да следва целия жизнен цикъл на уязвимостта. Това означава да се докладва колко често генериран от модел потенциален клиент оцелява след човешка репродукция, колко констатации са дубликати или са с ниска тежест, колко бързо доставчиците получават отчети, които могат да бъдат предприети, и дали корекциите са внедрени преди публичното разкриване. Трябва също така да обясни какво се случва, когато клиентът на партньор поиска от модела да премине граница на тестване, когато агент срещне идентификационни данни за производство или когато предложен експлойт е твърде опасен за директно валидиране. Тези контроли определят дали по-ниските нива на отказ създават измерима отбранителна стойност, вместо просто да разширят предлагането на код с двойна употреба.

Обществеността също трябва да може да разграничи възможностите на модела от разрешението на клиента. Правилата за достъп на OpenAI поставят правни атестации, проверки на самоличността, наблюдение и обхватна работа около модела, но тези контроли са твърдения, които трябва да бъдат тествани във времето. Отчитането на инциденти трябва да посочва дали дадена заявка е била блокирана, ескалирана за преглед или разрешена съгласно документиран ангажимент, без да се разкриват подробности за експлойта, които биха направили система без корекции по-лесна за атака.

Свързани ръководства и викторини

AI сигурностAI в операциите по киберсигурностAI БезопасностТествайте какво знаете — опитайте безплатен тест с изкуствен интелектПотърсете термин за AI в нашия речникСледвайте AI регулиращия тракер
Намирате ли това за полезно?