Apa yang berlaku
OpenAI mengembangkan program Daybreaknya pada 10 Ogos dengan peringkat akses berasingan untuk kerja pertahanan dan penyelidikan keselamatan lanjutan, termasuk model GPT-5.6-Cyber khusus.
Daybreak Blue memberikan pembela yang diluluskan GPT-5.6 Sol dengan penapis siber peringkat sistem dialih keluar untuk kerja seperti semakan kod selamat, analisis perisian hasad, tindak balas insiden, penemuan kerentanan dan pengesahan tampung. Daybreak Red menambah GPT-5.6-Cyber untuk pengesahan eksploitasi yang dibenarkan, ujian penembusan dan penyelidikan dwiguna lain yang model umum mungkin masih menolak.
OpenAI berkata GPT-5.6-Cyber menyelesaikan 95% permintaan dalam penilaian Kadar Penyiapan Keselamatan Siber Termaju dalamannya, berbanding dengan 1.5% untuk GPT-5.6 Sol standard, 2% untuk Sol melalui Daybreak Blue dan 57.3% untuk ZXQAIU1Qyber. Syarikat itu berkata ujian itu meliputi senario seperti pembangunan rantaian eksploitasi, pintasan pengesahan dan peningkatan keistimewaan; ia belum mengeluarkan set penilaian.
Syarikat itu juga melaporkan menggunakan model itu untuk membantu menemui dua kelemahan V8 yang tidak diketahui sebelum ini yang boleh dirantai bersama. Google memperuntukkan yang pertama CVE-2026-15903 dan menampalnya dalam Chrome 150. Nasihat keluaran Google secara bebas mengesahkan bahawa kecacatan keterukan tinggi yang dibenarkan membaca dan menulis di luar sempadan dalam V8, walaupun ia tidak menilai sistem AI yang membantu mencarinya.
OpenAI menerangkan GPT-5.6-Cyber sebagai model yang dibina di atas GPT-5.6 Sol dan dilatih untuk tugasan berisiko tinggi, dwi-guna terpilih dan bukannya penggunaan serangan tanpa had. Daybreak Red hanya tersedia untuk individu dan organisasi yang diluluskan yang menjalankan kerja yang dibenarkan, dengan pengesahan identiti, keselamatan akaun, pemantauan, sekatan penggunaan yang diluluskan dan pengesahan undang-undang. Pengumuman itu juga mengatakan bahawa akaun Daybreak individu memerlukan kunci keselamatan perkakasan mulai 1 September 2026.
Butiran sumber: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗
Mengapa ia penting
Keluaran itu mengalihkan keupayaan siber model sempadan yang lebih berbahaya daripada tetapan penyelidikan kecil ke program akses terurus, menguji sama ada pembela boleh menerimanya sebelum teknik yang sama merebak kepada penyerang.
Mengurangkan penolakan adalah penting kepada produk: model yang menolak kerja eksploitasi realistik mungkin lebih selamat untuk kegunaan umum tetapi kurang berguna kepada pasukan yang mesti menghasilkan semula kelemahan sebelum mereka boleh mengutamakan dan membetulkannya. Daybreak memisahkan tugas pertahanan yang lebih luas daripada pembangunan eksploitasi berisiko tinggi dan bukannya mendedahkan satu dasar kepada setiap pengguna.
Pendedahan V8 adalah bukti konkrit bahawa penyelidikan kelemahan dibantu AI boleh mencapai perisian yang digunakan. Ia juga lebih sempit daripada tuntutan pembelaan autonomi: OpenAI berkata penyelidiknya mengesahkan penemuan dan pendedahan yang diselaraskan dengan Google, manakala penasihat Chrome awam merekodkan kecacatan yang ditambal dan bukannya peranan model dalam proses penyelidikan penuh.
OpenAI juga mengembangkan Daybreak melalui perunding keselamatan dan penyedia teknologi. Rakan kongsi yang diluluskan mengekalkan akses kepada model asas dan menggunakannya dalam penglibatan pelanggan, dengan kawalan yang boleh termasuk pengesahan identiti, skop yang ditentukan, pengelogan, pemantauan dan semakan manusia.
Reka bentuk rakan kongsi itu mengubah siapa yang perlu memberikan pertimbangan terakhir. OpenAI mengatakan akses kepada model asas tidak dipindahkan terus kepada pelanggan; rakan kongsi mentakrifkan penglibatan, menyemak penemuan dan menggunakan kepakaran keselamatannya sendiri sebelum bertindak. Dalam amalan, penggunaan yang berguna oleh itu bergantung pada keupayaan rakan kongsi untuk memisahkan kecacatan yang boleh dihasilkan semula daripada cadangan model spekulatif, terus menguji dalam skop yang dipersetujui dan memindahkan pembetulan yang disahkan melalui proses penyelenggaraan perisian sebenar.
Mekanisme Interaktif: Bagaimana Ia Berfungsi Sebenarnya
Terokai teknologi asas di sebalik pembangunan ini secara interaktif.
What is an adversarial example in machine learning security?
Apa yang perlu ditonton seterusnya
Perhatikan kad sistem yang dijanjikan, pengeluaran semula penanda aras bebas, pendedahan lengkap kelemahan lain yang dilaporkan dan bukti bahawa kawalan akses menahan penyalahgunaan.
Kebanyakan angka prestasi dalam pengumuman itu datang daripada pelaksanaan dalaman OpenAI bagi Kadar Penyiapan Keselamatan Siber Lanjutan, ExploitGym, ExploitBench dan penilaian pelaporan kerentanan. Syarikat itu berkata GPT-5.6-Cyber tidak memenangi setiap perbandingan: GPT-5.6 Sol menghasilkan laporan yang lebih baik pada satu penilaian dan menyelesaikan tetapan ExploitBench standard 300 pusingan dengan lebih cekap.
OpenAI menilai GPT-5.6-Siber pada Tinggi, tetapi di bawah Kritikal, untuk keupayaan keselamatan siber di bawah Rangka Kerja Kesediaannya. Ia mengatakan kad sistem yang lebih lengkap akan datang kemudian. Sehingga kaedah dan keputusan diterbitkan dengan cukup terperinci untuk menghasilkan semula, pengumuman itu menyokong tuntutan syarikat yang dikaitkan dan bukannya ukuran bebas keupayaan serangan dunia sebenar.
Kes keselamatan bergantung pada operasi seperti latihan. Akaun Daybreak individu mesti menggunakan kunci keselamatan perkakasan mulai 1 September dan OpenAI mengesyorkan persekitaran terpencil, kebenaran berskop, tindakan ejen yang dipantau dan pengawasan manusia. Pelaporan susulan yang berguna harus menunjukkan pembatalan akses, penyalahgunaan yang dikesan, garis masa pendedahan, hasil tampalan dan positif palsu semasa program berkembang.
Perbandingan kadar penyelesaian tajuk juga mempunyai kaveat ukuran yang penting. OpenAI mengatakan setiap model dijalankan pada tahap penaakulan yang tersedia secara terbuka tertinggi, dan ambil perhatian bahawa GPT-5.6-Cyber cenderung menggunakan belanjawan penaakulan yang lebih besar dan lebih banyak token daripada GPT-5.6 Sol. Oleh itu, kadar penyiapan yang lebih tinggi mungkin mencerminkan kedua-dua latihan khusus dan jumlah pengiraan yang berbeza. Ujian bebas harus melaporkan belanjawan yang dipadankan, pembinaan tugas, kriteria penolakan, dan kadar jawapan yang tidak selamat atau tidak boleh digunakan dan bukannya sama ada respons telah dihasilkan.
Akaun matang program perlu mengikuti keseluruhan kitaran hayat kerentanan. Ini bermakna melaporkan kekerapan petunjuk yang dijana model bertahan daripada pembiakan manusia, bilangan penemuan adalah pendua atau keterukan yang rendah, seberapa cepat vendor menerima laporan yang boleh diambil tindakan dan sama ada tampung digunakan sebelum pendedahan awam. Ia juga harus menerangkan perkara yang berlaku apabila pelanggan rakan kongsi meminta model melintasi sempadan ujian, apabila ejen menemui kelayakan pengeluaran atau apabila eksploitasi yang dicadangkan terlalu berbahaya untuk disahkan secara langsung. Kawalan tersebut menentukan sama ada kadar penolakan yang lebih rendah mencipta nilai pertahanan yang boleh diukur dan bukannya hanya mengembangkan bekalan kod dwi-guna.
Orang ramai juga harus dapat membezakan keupayaan model daripada kebenaran pelanggan. Peraturan akses OpenAI meletakkan pengesahan undang-undang, semakan identiti, pemantauan dan kerja skop di sekeliling model, tetapi kawalan tersebut adalah tuntutan untuk diuji dari semasa ke semasa. Pelaporan insiden harus menyatakan sama ada permintaan telah disekat, ditingkatkan untuk semakan atau dibenarkan di bawah penglibatan yang didokumenkan, tanpa mendedahkan butiran eksploitasi yang akan menjadikan sistem yang tidak ditambal lebih mudah untuk diserang.