Terug naar Nieuws
BeveiligingAI Understanding-briefing

OpenAI Opent GPT-5.6-Cyber voor goedgekeurde verdedigers

Het nieuwe cybermodel met gecontroleerde toegang van OpenAI beantwoordt meer geavanceerde verzoeken om exploitonderzoek en heeft geholpen bij het vinden van een gepatchte Chrome-fout, maar het meeste bewijs komt uit interne evaluaties.

5 min readRead the primary source
Primair brondocumentBron opgenomen
Uitgever
OpenAI's GPT-5.6-Cyber and Daybreak announcement
Bronlink
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
Brontype
Primair document: een officiële aankondiging, document, dossier of first-party pagina die we rechtstreeks lezen.
ContextBegrijp dit in 60 seconden

Begin hier

Sleuteltermen

Evaluatieset
Een vastgehouden dataset die wordt gebruikt om de modelkwaliteit na training te meten.
Veiligheidszaak
Een gestructureerd argument, ondersteund door bewijsmateriaal, dat een AI-systeem veilig is voor een gedefinieerde gebruikscontext.
Benchmark
Een gestandaardiseerde test of dataset die wordt gebruikt om de prestaties van modellen te meten en te vergelijken.
Test jezelfAI-beveiligingsquiz

Wat is er gebeurd

OpenAI breidde zijn Daybreak-programma op 10 augustus uit met afzonderlijke toegangsniveaus voor defensief werk en geavanceerd beveiligingsonderzoek, waaronder een gespecialiseerd GPT-5.6-Cyber-model.

Daybreak Blue geeft goedgekeurde verdedigers GPT-5.6 Sol waarvan de cyberfilters op systeemniveau zijn verwijderd voor werk zoals beoordeling van veilige code, malware-analyse, respons op incidenten, ontdekking van kwetsbaarheden en patchvalidatie. Daybreak Red voegt GPT-5.6-Cyber ​​toe voor geautoriseerde exploitvalidatie, penetratietesten en ander onderzoek voor tweeërlei gebruik dat het algemene model mogelijk nog steeds weigert.

OpenAI zegt dat GPT-5.6-Cyber ​​95% van de verzoeken heeft voltooid in zijn interne Advanced Cybersecurity Completion Rate-evaluatie, vergeleken met 1,5% voor standaard GPT-5.6 Sol, 2% voor Sol tot en met Daybreak Blue en 57,3% voor GPT-5.5-Cyber. Het bedrijf zegt dat de test scenario's omvat zoals de ontwikkeling van exploit-chains, het omzeilen van authenticatie en escalatie van bevoegdheden; het heeft de evaluatieset niet vrijgegeven.

Het bedrijf meldt ook dat het het model gebruikt om twee voorheen onbekende V8-kwetsbaarheden te ontdekken die aan elkaar gekoppeld zouden kunnen zijn. Google heeft de eerste CVE-2026-15903 toegewezen en gepatcht in Chrome 150. Het release-advies van Google bevestigt onafhankelijk dat de zeer ernstige fout lees- en schrijfbewerkingen buiten de grenzen mogelijk maakte in V8, hoewel er geen beoordeling wordt gegeven van het AI-systeem dat hielp bij het vinden ervan.

OpenAI beschrijft GPT-5.6-Cyber ​​als een model gebouwd op GPT-5.6 Sol en getraind voor geselecteerde risicovolle taken voor tweeërlei gebruik in plaats van onbeperkt offensief gebruik. Daybreak Red is alleen beschikbaar voor goedgekeurde personen en organisaties die geautoriseerd werk uitvoeren, met identiteitsverificatie, accountbeveiliging, monitoring, goedgekeurde gebruiksbeperkingen en wettelijke attesten. De aankondiging zegt ook dat individuele Daybreak-accounts vanaf 1 september 2026 hardwarebeveiligingssleutels nodig hebben.

Brongegevens: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

Waarom het ertoe doet

De release verplaatst de gevaarlijkere cybercapaciteiten van een grensmodel van een kleine onderzoeksomgeving naar een gecontroleerd toegangsprogramma, waarbij wordt getest of verdedigers deze kunnen ontvangen voordat dezelfde technieken zich verspreiden naar aanvallers.

Het terugdringen van het aantal weigeringen staat centraal in het product: een model dat realistisch exploitatiewerk afwijst, kan veiliger zijn voor algemeen gebruik, maar minder bruikbaar voor teams die een kwetsbaarheid moeten reproduceren voordat ze prioriteiten kunnen stellen en deze kunnen oplossen. Daybreak scheidt bredere defensieve taken van de ontwikkeling van exploits met een hoger risico, in plaats van één beleid aan elke gebruiker bloot te stellen.

De V8-onthulling is een concreet bewijs dat AI-ondersteund kwetsbaarheidsonderzoek de geïmplementeerde software kan bereiken. Het is ook beperkter dan een claim van autonome verdediging: OpenAI zegt dat zijn onderzoekers de bevindingen hebben gevalideerd en de openbaarmaking hebben gecoördineerd met Google, terwijl het openbare Chrome-advies de herstelde fout registreert in plaats van de rol van het model in het volledige onderzoeksproces.

OpenAI breidt Daybreak ook uit via beveiligingsadviesbureaus en technologieleveranciers. Goedgekeurde partners behouden toegang tot de onderliggende modellen en passen deze toe binnen klantbetrokkenheid, met controles zoals identiteitsverificatie, gedefinieerde scopes, logboekregistratie, monitoring en menselijke beoordeling.

Dat partnerontwerp verandert wie de laatste mijl van het oordeel moet geven. OpenAI zegt dat de toegang tot het onderliggende model niet rechtstreeks aan een klant wordt overgedragen; een partner definieert de opdracht, beoordeelt de bevindingen en past zijn eigen beveiligingsexpertise toe voordat actie wordt ondernomen. In de praktijk hangt een bruikbare implementatie daarom af van het vermogen van de partner om een ​​reproduceerbare fout te scheiden van een speculatieve modelsuggestie, het testen binnen de afgesproken reikwijdte te blijven houden en een bevestigde oplossing door een echt software-onderhoudsproces te loodsen.

Interactive Mechanism

Interactief mechanisme: hoe het eigenlijk werkt

Ontdek interactief de onderliggende technologie achter deze ontwikkeling.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Interactieve conceptcheck+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

Wat je nu moet bekijken

Let op de beloofde systeemkaart, onafhankelijke benchmarkreproductie, voltooide openbaarmaking van de andere gerapporteerde kwetsbaarheden en bewijs dat toegangscontroles bestand zijn tegen misbruik.

De meeste prestatiecijfers in de aankondiging zijn afkomstig van OpenAI's interne implementaties van Advanced Cybersecurity Completion Rate, ExploitGym, ExploitBench en evaluaties van kwetsbaarheidsrapportage. Het bedrijf zegt dat GPT-5.6-Cyber ​​niet elke vergelijking heeft gewonnen: GPT-5.6 Sol produceerde betere rapporten over één evaluatie en loste de standaard 300-turn ExploitBench-instelling efficiënter op.

OpenAI beoordeelt GPT-5.6-Cyber ​​als hoog, maar onder kritiek, voor cyberbeveiligingscapaciteiten volgens het Preparedness Framework. Er staat dat er later een vollere systeemkaart komt. Totdat de methoden en resultaten voldoende gedetailleerd zijn gepubliceerd om te reproduceren, ondersteunt de aankondiging toegeschreven bedrijfsclaims in plaats van een onafhankelijke maatstaf voor het offensieve vermogen van de echte wereld.

De veiligheidssituatie hangt zowel van de operaties als van de training af. Individuele Daybreak-accounts moeten vanaf 1 september hardware-beveiligingssleutels gebruiken, en OpenAI beveelt geïsoleerde omgevingen, beperkte machtigingen, gecontroleerde agentacties en menselijk toezicht aan. Nuttige vervolgrapportage moet intrekkingen van toegang, gedetecteerd misbruik, tijdlijnen voor openbaarmaking, patchresultaten en valse positieven weergeven naarmate het programma zich uitbreidt.

De vergelijking van het voltooiingspercentage kent ook een belangrijk voorbehoud bij het meten. OpenAI zegt dat elk model op het hoogste publiek beschikbare redeneringsniveau werd uitgevoerd, en merkt op dat GPT-5.6-Cyber ​​de neiging heeft een groter redeneringsbudget en meer tokens te gebruiken dan GPT-5.6 Sol. Een hoger voltooiingspercentage kan daarom zowel een gespecialiseerde opleiding als een andere hoeveelheid rekenwerk weerspiegelen. Onafhankelijke tests moeten overeenkomende budgetten, taakconstructie, weigeringscriteria en het aantal onveilige of onbruikbare antwoorden rapporteren, in plaats van alleen of er een antwoord is gegeven.

Een volwassen verslag van het programma zal de hele levenscyclus van de kwetsbaarheid moeten volgen. Dat betekent rapporteren hoe vaak een door een model gegenereerde lead de menselijke voortplanting overleeft, hoeveel bevindingen dubbel of weinig ernstig zijn, hoe snel leveranciers bruikbare rapporten ontvangen en of patches worden geïmplementeerd voordat deze openbaar worden gemaakt. Het moet ook uitleggen wat er gebeurt als de klant van een partner het model vraagt ​​een testgrens te overschrijden, als een agent productiereferenties tegenkomt of als een voorgestelde exploit te gevaarlijk is om direct te valideren. Deze controles bepalen of lagere weigeringspercentages meetbare defensieve waarde creëren in plaats van alleen maar het aanbod van codes voor tweeërlei gebruik uit te breiden.

Het publiek moet ook de mogelijkheden van een model kunnen onderscheiden van de autorisatie van een klant. De toegangsregels van OpenAI omringen het model met juridische attesten, identiteitscontroles, monitoring en scopewerk, maar er wordt beweerd dat deze controles in de loop van de tijd worden getest. In incidentrapportage moet worden aangegeven of een verzoek is geblokkeerd, ter beoordeling is geëscaleerd of is toegestaan ​​op grond van een gedocumenteerde opdracht, zonder exploitdetails bloot te leggen die het gemakkelijker zouden maken om een ​​niet-gepatcht systeem aan te vallen.

Gerelateerde gidsen en quizzen

AI-beveiligingAI in cyberbeveiligingsoperatiesAI-veiligheidTest wat je weet: probeer een gratis AI-quizZoek een AI-term op in onze woordenlijstVolg de AI-regelgevingstracker
Vond je dit nuttig?