Zpět na Novinky
ZabezpečeníInstruktáž AI Understanding

OpenAI Zpřístupňuje GPT-5.6-Cyber schváleným obráncům

Nový kybernetický model OpenAI s řízeným přístupem odpovídá na pokročilejší požadavky na průzkum zneužití a pomohl najít opravenou chybu Chrome, ale většina důkazů pochází z interních hodnocení.

5 min readRead the primary source
Primární zdrojový dokumentZdroj zaznamenán
Vydavatel
OpenAI's GPT-5.6-Cyber and Daybreak announcement
Odkaz na zdroj
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
Typ zdroje
Primární dokument — oficiální oznámení, papír, podání nebo stránka první strany, kterou čteme přímo.
KontextPochopte to za 60 sekund

Začněte zde

Klíčové pojmy

Sada hodnocení
Zadržená datová sada používaná k měření kvality modelu po školení.
Bezpečnostní pouzdro
Strukturovaný argument podpořený důkazy, že systém umělé inteligence je bezpečný pro definovaný kontext použití.
Benchmark
Standardizovaný test nebo soubor dat používaný k měření a porovnávání výkonu modelu.
Otestujte seBezpečnostní kvíz AI

Co se stalo

OpenAI rozšířil svůj program Daybreak 10. srpna o samostatné přístupové úrovně pro defenzivní práci a pokročilý bezpečnostní výzkum, včetně specializovaného modelu GPT-5.6-Cyber.

Daybreak Blue poskytuje schváleným obráncům GPT-5.6 Sol s odstraněnými kybernetickými filtry na systémové úrovni pro práci, jako je zabezpečená kontrola kódu, analýza malwaru, reakce na incidenty, zjišťování zranitelnosti a ověřování oprav. Daybreak Red přidává GPT-5.6-Cyber ​​pro ověření autorizovaného zneužití, penetrační testování a další výzkum dvojího použití, který může obecný model stále odmítat.

OpenAI uvádí, že GPT-5.6-Cyber ​​dokončil 95 % požadavků ve svém interním hodnocení míry dokončení pokročilé kybernetické bezpečnosti, ve srovnání s 1,5 % pro standardní GPT-5.6 Sol, 2 % pro Sol až do Daybreak Blue a 57,3 % pro ZXQAIUC1QXZ Společnost říká, že test pokrývá scénáře, jako je vývoj exploit-chain, obcházení autentizace a eskalace oprávnění; nevydala sadu hodnocení.

Společnost také hlásí, že tento model používá k odhalování dvou dříve neznámých zranitelností V8, které by mohly být spojeny dohromady. Google přiřadil první CVE-2026-15903 a opravil jej v Chrome 150. Doporučení k vydání Google nezávisle potvrzuje, že velmi závažná chyba umožňovala čtení a zápisy mimo hranice ve V8, i když neposuzuje systém umělé inteligence, který ji pomohl najít.

OpenAI popisuje GPT-5.6-Cyber ​​jako model postavený na GPT-5.6 Sol a trénovaný pro vybrané vysoce rizikové úkoly s dvojím použitím spíše než pro neomezené útočné použití. Daybreak Red je k dispozici pouze schváleným jednotlivcům a organizacím provádějícím autorizovanou práci s ověřením identity, zabezpečením účtu, monitorováním, omezeními schváleného použití a právními atesty. Oznámení také říká, že jednotlivé účty Daybreak budou od 1. září 2026 potřebovat hardwarové bezpečnostní klíče.

Podrobnosti o zdroji: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

Proč na tom záleží

Vydání posouvá nebezpečnější kybernetické schopnosti hraničního modelu z malého výzkumného prostředí do programu řízeného přístupu a testuje, zda je obránci mohou získat dříve, než se stejné techniky rozšíří na útočníky.

Snížení počtu odmítnutí je pro produkt zásadní: model, který odmítá realistickou práci s využíváním, může být bezpečnější pro obecné použití, ale méně užitečný pro týmy, které musí reprodukovat zranitelnost, než ji mohou stanovit prioritu a opravit. Svítání odděluje širší obranné úkoly od vývoje zneužití s ​​vyšším rizikem místo toho, aby každému uživateli odhaloval jednu politiku.

Zveřejnění V8 je konkrétním důkazem toho, že výzkum zranitelnosti za pomoci umělé inteligence může dosáhnout nasazeného softwaru. Je také užší než tvrzení o autonomní obraně: OpenAI říká, že jeho výzkumníci potvrdili zjištění a koordinovali zveřejnění se Google, zatímco veřejné doporučení Chrome zaznamenává opravenou chybu spíše než roli modelu v celém procesu výzkumu.

OpenAI také rozšiřuje Daybreak prostřednictvím bezpečnostních konzultací a poskytovatelů technologií. Schválení partneři si udržují přístup k základním modelům a používají je v rámci zákaznických zakázek s kontrolami, které mohou zahrnovat ověřování identity, definované rozsahy, protokolování, monitorování a kontrolu člověkem.

Ten partnerský design se mění, kdo musí poskytnout poslední míli úsudku. OpenAI říká, že přístup k základnímu modelu není převeden přímo na zákazníka; partner definuje zakázku, zkontroluje zjištění a uplatní své vlastní odborné znalosti v oblasti bezpečnosti před akcí. V praxi proto užitečné nasazení závisí na schopnosti partnera oddělit reprodukovatelnou chybu od spekulativního návrhu modelu, udržet testování v dohodnutém rozsahu a posunout potvrzenou opravu skutečným procesem údržby softwaru.

Interactive Mechanism

Interaktivní mechanismus: Jak to vlastně funguje

Interaktivně prozkoumejte základní technologii tohoto vývoje.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Interaktivní kontrola konceptu+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

Na co se dále dívat

Sledujte slíbenou systémovou kartu, nezávislou reprodukci ů, dokončené odhalení dalších hlášených zranitelností a důkazy, že kontroly přístupu odolají zneužití.

Většina údajů o výkonu v oznámení pochází z interních implementací hodnocení Advanced Cybersecurity Completion Rate, ExploitGym, ExploitBench a hlášení zranitelnosti společnosti OpenAI. Společnost říká, že GPT-5.6-Cyber ​​nezvítězil ve všech srovnáních: GPT-5.6 Sol vytvořil lepší zprávy o jednom hodnocení a efektivněji vyřešil standardní nastavení ExploitBench s 300 otáčkami.

OpenAI hodnotí GPT-5.6-Cyber ​​jako vysokou, ale pod kritickou, pokud jde o schopnost kybernetické bezpečnosti podle rámce připravenosti. Říká, že plnější systémová karta přijde později. Dokud nebudou metody a výsledky zveřejněny dostatečně podrobně, aby je bylo možné reprodukovat, oznámení podporuje připisovaná tvrzení společnosti spíše než nezávislé měřítko skutečné útočné schopnosti.

Bezpečnostní pouzdro závisí na provozu stejně jako na školení. Jednotlivé účty Daybreak musí od 1. září přijmout hardwarové bezpečnostní klíče a OpenAI doporučuje izolovaná prostředí, omezená oprávnění, monitorované akce agentů a lidský dohled. Užitečné následné hlášení by mělo ukazovat odvolání přístupu, zjištěné zneužití, časové osy zveřejnění, výsledky oprav a falešné poplachy, jak se program rozšiřuje.

Porovnání míry dokončení nadpisu má také důležité upozornění na měření. OpenAI říká, že každý model byl spuštěn na nejvyšší veřejně dostupné úrovni uvažování, a poznamenává, že GPT-5.6-Cyber ​​má tendenci používat větší rozpočet na uvažování a více tokenů než GPT-5.6 Sol. Vyšší míra dokončení proto může odrážet jak specializované školení, tak různé množství výpočtů. Nezávislé testy by měly uvádět odpovídající rozpočty, konstrukci úkolů, kritéria odmítnutí a míru nebezpečných nebo nepoužitelných odpovědí, nikoli pouze to, zda byla vytvořena odpověď.

Zralý účet programu bude muset sledovat celý životní cyklus zranitelnosti. To znamená hlásit, jak často modelem vygenerovaný zájemce přežije lidskou reprodukci, kolik nálezů je duplicitních nebo má nízkou závažnost, jak rychle dodavatelé dostávají použitelné zprávy a zda jsou před zveřejněním nasazeny záplaty. Mělo by také vysvětlovat, co se stane, když zákazník partnera požádá model, aby překročil hranici testování, když agent narazí na produkční pověření nebo když je navrhovaný exploit příliš nebezpečný na to, aby jej bylo možné přímo ověřit. Tyto kontroly určují, zda nižší míra odmítnutí vytváří měřitelnou obrannou hodnotu namísto pouhého rozšíření nabídky kódu dvojího užití.

Veřejnost by také měla být schopna rozlišit schopnost modelu od autorizace zákazníka. Pravidla přístupu OpenAI model obcházejí právní atestace, kontroly identity, monitorování a práce v rozsahu, ale tyto kontroly jsou nároky, které je třeba testovat v průběhu času. Hlášení incidentů by mělo uvádět, zda byl požadavek zablokován, eskalován ke kontrole nebo povolen v rámci zdokumentované zakázky, aniž by byly odhaleny podrobnosti o zneužití, které by usnadnily útok na neopravený systém.

Související průvodci a kvízy

Bezpečnost AIAI v operacích kybernetické bezpečnostiBezpečnost AIOtestujte si, co víte – vyzkoušejte bezplatný kvíz AIVyhledejte si termín AI v našem slovníkuSledujte sledovač regulace AI
Považujete to za užitečné?