Haberlere Geri Dön
GüvenlikAI Understanding brifing

OpenAI GPT-5.6-Cyber'ı Onaylı Savunuculara Açıyor

OpenAI'nin yeni kontrollü erişim siber modeli, daha gelişmiş kötüye kullanım araştırması isteklerine yanıt verdi ve yamalı bir Chrome kusurunun bulunmasına yardımcı oldu, ancak kanıtların çoğu dahili değerlendirmelerden geliyor.

5 min readRead the primary source
Birincil kaynak belgeKaynak kaydedildi
Yayıncı
OpenAI's GPT-5.6-Cyber and Daybreak announcement
Kaynak bağlantısı
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
Kaynak türü
Birincil belge – doğrudan okuduğumuz resmi bir duyuru, belge, dosyalama veya birinci taraf sayfası.
Bağlam60 saniyede bunu anlayın

Buradan başlayın

Anahtar terimler

Değerlendirme Seti
Eğitimden sonra model kalitesini ölçmek için kullanılan uzatılmış bir veri kümesi.
Güvenlik Durumu
Bir yapay zeka sisteminin tanımlanmış bir kullanım bağlamı için güvenli olduğuna dair kanıtlarla desteklenen yapılandırılmış bir argüman.
Karşılaştırma
Model performansını ölçmek ve karşılaştırmak için kullanılan standartlaştırılmış bir test veya veri kümesi.
Kendinizi test edinYapay Zeka Güvenliği Testi

Ne oldu?

OpenAI, 10 Ağustos'ta Daybreak programını, özel bir GPT-5.6-Cyber ​​modeli de dahil olmak üzere savunma çalışmaları ve gelişmiş güvenlik araştırmaları için ayrı erişim katmanlarıyla genişletti.

Daybreak Blue, onaylı savunuculara GPT-5.6 Sol'u, güvenli kod incelemesi, kötü amaçlı yazılım analizi, olay müdahalesi, güvenlik açığı keşfi ve yama doğrulama gibi işler için sistem düzeyinde siber filtrelerin kaldırılmasını sağlar. Daybreak Red, yetkili istismar doğrulaması, sızma testi ve genel modelin hâlâ reddedebileceği diğer çift kullanımlı araştırmalar için GPT-5.6-Cyber'ı ekliyor.

OpenAI, GPT-5.6-Cyber'ın dahili Gelişmiş Siber Güvenlik Tamamlanma Oranı değerlendirmesinde isteklerin %95'ini tamamladığını söylüyor; bu oran standart GPT-5.6 Sol için %1,5, Sol ile Daybreak Blue arasında %2 ve GPT-5.5-Cyber ​​için %57,3. Şirket, testin istismar zinciri geliştirme, kimlik doğrulamayı atlama ve ayrıcalık yükseltme gibi senaryoları kapsadığını söylüyor; değerlendirme setini yayınlamadı.

Şirket ayrıca, daha önce bilinmeyen ve birbirine zincirlenebilecek iki V8 güvenlik açığının keşfedilmesine yardımcı olmak için bu modeli kullandığını da bildiriyor. Google, ilki CVE-2026-15903'ü atadı ve Chrome 150'de yamaladı. Google'nin yayın tavsiye belgesi, yüksek önem derecesine sahip kusurun V8'de sınır dışı okuma ve yazmaya izin verdiğini bağımsız olarak doğruluyor, ancak onu bulmaya yardımcı olan yapay zeka sistemini değerlendirmiyor.

OpenAI, GPT-5.6-Cyber'ı GPT-5.6 Sol üzerine inşa edilmiş ve sınırsız saldırı amaçlı kullanım yerine seçilmiş yüksek riskli, çift kullanımlı görevler için eğitilmiş bir model olarak tanımlıyor. Daybreak Red yalnızca kimlik doğrulama, hesap güvenliği, izleme, onaylı kullanım kısıtlamaları ve yasal tasdiklerle yetkili çalışmalar yürüten onaylı kişi ve kuruluşlara açıktır. Duyuruda ayrıca bireysel Daybreak hesaplarının 1 Eylül 2026'dan itibaren donanım güvenlik anahtarlarına ihtiyaç duyacağı da belirtiliyor.

Kaynak ayrıntıları: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

Neden önemli?

Sürüm, bir sınır modelinin daha tehlikeli siber yeteneklerini küçük bir araştırma ortamından yönetilen bir erişim programına taşıyor ve aynı teknikler saldırganlara yayılmadan önce savunucuların bunları alıp alamayacağını test ediyor.

Reddetmelerin azaltılması ürünün merkezinde yer alır: Gerçekçi istismar çalışmasını reddeden bir model, genel kullanım için daha güvenli olabilir ancak bir güvenlik açığını önceliklendirmeden ve düzeltmeden önce yeniden üretmesi gereken ekipler için daha az yararlı olabilir. Daybreak, her kullanıcıya tek bir politika sunmak yerine, daha geniş savunma görevlerini daha yüksek riskli istismar geliştirmeden ayırır.

V8'in açıklaması, yapay zeka destekli güvenlik açığı araştırmasının konuşlandırılmış yazılıma ulaşabileceğinin somut kanıtıdır. Aynı zamanda özerk savunma iddiasından da daha dar kapsamlıdır: OpenAI, araştırmacılarının bulguları doğruladığını ve Google ile koordineli açıklama yaptığını söylerken, halka açık Chrome danışma belgesi, modelin tüm araştırma sürecindeki rolü yerine yamalı kusuru kaydettiğini söylüyor.

OpenAI ayrıca Daybreak'i güvenlik danışmanlıkları ve teknoloji sağlayıcıları aracılığıyla genişletiyor. Onaylı iş ortakları, temel modellere erişmeye devam eder ve kimlik doğrulamayı, tanımlanmış kapsamları, günlüğe kaydetmeyi, izlemeyi ve insan incelemesini içerebilen kontrollerle bunları müşteri sözleşmeleri kapsamında uygular.

Bu ortak tasarımı, son kararı kimin vermesi gerektiğini değiştirir. OpenAI, temel modele erişimin doğrudan müşteriye aktarılmadığını söylüyor; bir iş ortağı, müdahaleyi tanımlar, bulguları gözden geçirir ve harekete geçmeden önce kendi güvenlik uzmanlığını uygular. Pratikte, yararlı bir dağıtım bu nedenle iş ortağının tekrarlanabilir bir kusuru spekülatif bir model önerisinden ayırma, üzerinde anlaşılan kapsam dahilinde testi sürdürme ve onaylanmış bir düzeltmeyi gerçek bir yazılım bakım süreci yoluyla taşıma becerisine bağlıdır.

Interactive Mechanism

İnteraktif Mekanizma: Aslında Nasıl Çalışıyor?

Bu gelişmenin arkasında yatan teknolojiyi etkileşimli olarak keşfedin.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
İnteraktif Konsept Kontrolü+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

Bundan sonra ne izlenecek?

Vaat edilen sistem kartını, bağımsız karşılaştırma testinin çoğaltılmasını, bildirilen diğer güvenlik açıklarına ilişkin tamamlanmış açıklamayı ve erişim kontrollerinin kötüye kullanıma karşı dayanıklı olduğunu gösteren kanıtları izleyin.

Duyurudaki performans rakamlarının çoğu, OpenAI'nin Gelişmiş Siber Güvenlik Tamamlama Oranı, ExploitGym, ExploitBench ve güvenlik açığı raporlama değerlendirmelerinin dahili uygulamalarından geliyor. Şirket, GPT-5.6-Cyber'ın her karşılaştırmayı kazanmadığını söylüyor: GPT-5.6 Sol, bir değerlendirmede daha iyi raporlar üretti ve standart 300 dönüşlü ExploitBench ayarını daha verimli bir şekilde çözdü.

OpenAI, Hazırlık Çerçevesi kapsamında siber güvenlik yeteneği açısından GPT-5.6-Siber'i Yüksek, ancak Kritik'in altında derecelendiriyor. Daha sonra daha dolgun bir sistem kartının geleceği söyleniyor. Yöntemler ve sonuçlar yeniden üretilebilecek kadar ayrıntılı olarak yayınlanıncaya kadar duyuru, gerçek dünyadaki saldırı kapasitesinin bağımsız bir ölçümü yerine, atfedilen şirket iddialarını desteklemektedir.

Güvenlik durumu eğitim kadar operasyonlara da bağlıdır. Bireysel Daybreak hesaplarının 1 Eylül'den itibaren donanım güvenlik anahtarlarını benimsemesi gerekiyor ve OpenAI, yalıtılmış ortamlar, kapsamlı izinler, izlenen aracı eylemleri ve insan gözetimi öneriyor. Yararlı takip raporları, program genişledikçe erişim iptallerini, tespit edilen kötüye kullanımı, açıklama zaman çizelgelerini, yama sonuçlarını ve yanlış pozitifleri göstermelidir.

Başlık tamamlanma oranı karşılaştırmasında da önemli bir ölçüm uyarısı bulunmaktadır. OpenAI, her modelin halka açık en yüksek akıl yürütme düzeyinde çalıştırıldığını söylüyor ve GPT-5.6-Cyber'ın, GPT-5.6 Sol'dan daha büyük bir akıl yürütme bütçesi ve daha fazla token kullanma eğiliminde olduğunu belirtiyor. Bu nedenle daha yüksek bir tamamlama oranı, hem uzmanlık eğitimini hem de farklı miktarda hesaplamayı yansıtabilir. Bağımsız testler, yalnızca bir yanıtın üretilip üretilmediğini değil, eşleşen bütçeleri, görev yapısını, reddetme kriterlerini ve güvenli olmayan veya kullanılamaz yanıtların oranını rapor etmelidir.

Programın olgun bir hesabının tüm güvenlik açığı yaşam döngüsünü takip etmesi gerekecektir. Bu, model tarafından oluşturulan bir potansiyel müşterinin ne sıklıkta insan kopyasından sağ çıktığını, kaç bulgunun kopya veya düşük önem derecesine sahip olduğunu, satıcıların eyleme geçirilebilir raporları ne kadar hızlı aldığını ve yamaların kamuya açıklanmadan önce dağıtılıp dağıtılmadığını raporlamak anlamına gelir. Ayrıca bir iş ortağının müşterisi modelin test sınırını geçmesini istediğinde, bir aracı üretim kimlik bilgileriyle karşılaştığında veya önerilen bir istismarın doğrudan doğrulanamayacak kadar tehlikeli olduğu durumlarda ne olacağını da açıklamalıdır. Bu kontroller, daha düşük reddetme oranlarının, yalnızca çift kullanımlı kod tedarikini genişletmek yerine ölçülebilir bir savunma değeri yaratıp yaratmayacağını belirler.

Kamunun ayrıca bir modelin kapasitesini müşterinin yetkilendirmesinden ayırt edebilmesi gerekir. OpenAI'nin erişim kuralları, model etrafında yasal tasdikler, kimlik kontrolleri, izleme ve kapsamlı çalışmalar koyar ancak bu kontroller, zaman içinde test edilmesi gereken iddialardır. Olay raporlaması, yamalı bir sisteme saldırı yapılmasını kolaylaştıracak istismar ayrıntılarını açığa çıkarmadan, bir isteğin engellenip engellenmediğini, incelenmek üzere iletildiğini veya belgelenmiş bir müdahale kapsamında izin verilip verilmediğini belirtmelidir.

İlgili kılavuzlar ve testler

Yapay Zeka GüvenliğiSiber Güvenlik Operasyonlarında Yapay ZekaYapay Zeka GüvenliğiBildiklerinizi test edin; ücretsiz bir yapay zeka testini deneyinSözlüğümüzde bir yapay zeka terimine bakınYapay zeka düzenleme izleyicisini takip edin
Bunu yararlı buldunuz mu?