กลับไปที่ข่าว
ความปลอดภัยAI Understanding บรรยายสรุป

OpenAI เปิด GPT-5.6-Cyber ให้กับผู้พิทักษ์ที่ได้รับการอนุมัติ

โมเดลไซเบอร์ควบคุมการเข้าถึงแบบใหม่ของ OpenAI ตอบสนองคำขอการวิจัยช่องโหว่ขั้นสูงยิ่งขึ้น และช่วยค้นหาข้อบกพร่องของ Chrome ที่ได้รับแพตช์ แต่หลักฐานส่วนใหญ่มาจากการประเมินภายใน

5 min readRead the primary source
เอกสารต้นทางหลักแหล่งที่มาบันทึกไว้
สำนักพิมพ์
OpenAI's GPT-5.6-Cyber and Daybreak announcement
ลิงค์แหล่งที่มา
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
ประเภทแหล่งที่มา
เอกสารหลัก — ประกาศอย่างเป็นทางการ เอกสาร เอกสาร หรือหน้าแรกที่เราอ่านโดยตรง
บริบทเข้าใจสิ่งนี้ใน 60 วินาที

เริ่มที่นี่

เงื่อนไขสำคัญ

ชุดประเมินผล
ชุดข้อมูลที่เก็บไว้ซึ่งใช้ในการวัดคุณภาพของโมเดลหลังการฝึก
กรณีความปลอดภัย
ข้อโต้แย้งที่มีโครงสร้างซึ่งสนับสนุนโดยหลักฐานว่าระบบ AI ปลอดภัยสำหรับบริบทการใช้งานที่กำหนดไว้
เกณฑ์มาตรฐาน
การทดสอบหรือชุดข้อมูลที่เป็นมาตรฐานที่ใช้ในการวัดและเปรียบเทียบประสิทธิภาพของโมเดล
ทดสอบตัวเองแบบทดสอบความปลอดภัยของ AI

เกิดอะไรขึ้น

OpenAI ขยายโปรแกรม Daybreak เมื่อวันที่ 10 สิงหาคม ด้วยระดับการเข้าถึงแยกต่างหากสำหรับงานป้องกันและการวิจัยด้านความปลอดภัยขั้นสูง รวมถึงรุ่นพิเศษ GPT-5.6-Cyber

Daybreak Blue มอบ GPT-5.6 Sol ให้กับผู้พิทักษ์ที่ได้รับอนุมัติ พร้อมด้วยตัวกรองไซเบอร์ระดับระบบที่ถูกลบออกสำหรับงานต่างๆ เช่น การตรวจสอบโค้ดที่ปลอดภัย การวิเคราะห์มัลแวร์ การตอบสนองต่อเหตุการณ์ การค้นพบช่องโหว่ และการตรวจสอบแพตช์ Daybreak Red เพิ่ม GPT-5.6-Cyber ​​สำหรับการตรวจสอบช่องโหว่ที่ได้รับอนุญาต การทดสอบการเจาะระบบ และการวิจัยการใช้งานสองทางอื่นๆ ที่โมเดลทั่วไปอาจยังคงปฏิเสธ

OpenAI กล่าวว่า GPT-5.6-Cyber ​​เสร็จสิ้นคำขอ 95% ในการประเมิน Advanced Cybersecurity Completion Rate ภายในองค์กร เทียบกับ 1.5% สำหรับ GPT-5.6 Sol มาตรฐาน, 2% สำหรับ Sol จนถึง Daybreak Blue และ 57.3% สำหรับ GPT-5.5-Cyber บริษัทกล่าวว่าการทดสอบครอบคลุมสถานการณ์ต่างๆ เช่น การพัฒนา Exploit-Chain การบายพาสการรับรองความถูกต้อง และการเพิ่มระดับสิทธิ์ ยังไม่ได้เผยแพร่ชุดการประเมิน

บริษัทยังรายงานการใช้แบบจำลองเพื่อช่วยค้นหาช่องโหว่ V8 ที่ไม่รู้จักก่อนหน้านี้สองช่องโหว่ที่สามารถเชื่อมโยงเข้าด้วยกันได้ Google มอบหมาย CVE-2026-15903 ตัวแรกและแพตช์ลงใน Chrome 150 คำแนะนำในการเผยแพร่ของ Google ยืนยันอย่างอิสระว่าข้อบกพร่องที่มีความรุนแรงสูงอนุญาตให้อ่านและเขียนนอกขอบเขตใน V8 ได้ แม้ว่าจะไม่ได้ประเมินระบบ AI ที่ช่วยค้นหาก็ตาม

OpenAI อธิบาย GPT-5.6-Cyber ​​ว่าเป็นโมเดลที่สร้างขึ้นจาก GPT-5.6 Sol และได้รับการฝึกอบรมสำหรับงานที่มีความเสี่ยงสูงและใช้งานได้สองทาง แทนที่จะเป็นการใช้งานเชิงรุกที่ไม่จำกัด Daybreak Red มีให้บริการเฉพาะบุคคลและองค์กรที่ได้รับอนุมัติซึ่งดำเนินงานที่ได้รับอนุญาต โดยมีการยืนยันตัวตน ความปลอดภัยของบัญชี การตรวจสอบ ข้อจำกัดการใช้งานที่ได้รับอนุมัติ และการรับรองทางกฎหมาย การประกาศยังระบุด้วยว่าบัญชี Daybreak แต่ละบัญชีจะต้องมีคีย์ความปลอดภัยของฮาร์ดแวร์ตั้งแต่วันที่ 1 กันยายน 2026 เป็นต้นไป

รายละเอียดที่มา: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

ทำไมมันถึงสำคัญ

การเปิดตัวครั้งนี้ได้ย้ายความสามารถทางไซเบอร์ที่เป็นอันตรายมากขึ้นของโมเดลชายแดนจากการวิจัยเล็กๆ ไปเป็นโปรแกรมการเข้าถึงที่ได้รับการควบคุม โดยทดสอบว่าผู้พิทักษ์สามารถรับความสามารถเหล่านั้นได้หรือไม่ ก่อนที่เทคนิคเดียวกันนี้จะแพร่กระจายไปยังผู้โจมตี

การลดการปฏิเสธถือเป็นหัวใจสำคัญของผลิตภัณฑ์: แบบจำลองที่ปฏิเสธการทำงานเพื่อหาผลประโยชน์ตามความเป็นจริงอาจปลอดภัยกว่าสำหรับการใช้งานทั่วไป แต่มีประโยชน์น้อยกว่าสำหรับทีมที่ต้องสร้างช่องโหว่ขึ้นมาใหม่ก่อนจึงจะสามารถจัดลำดับความสำคัญและแก้ไขได้ Daybreak แยกงานการป้องกันที่กว้างขึ้นออกจากการพัฒนาช่องโหว่ที่มีความเสี่ยงสูงกว่า แทนที่จะเปิดเผยนโยบายเดียวแก่ผู้ใช้ทุกคน

การเปิดเผย V8 ถือเป็นหลักฐานที่ชัดเจนว่าการวิจัยช่องโหว่ที่ได้รับความช่วยเหลือจาก AI สามารถเข้าถึงซอฟต์แวร์ที่ปรับใช้ได้ นอกจากนี้ยังแคบกว่าการกล่าวอ้างการป้องกันตนเอง: OpenAI กล่าวว่านักวิจัยได้ตรวจสอบการค้นพบและการเปิดเผยข้อมูลที่ประสานงานกับ Google ในขณะที่คำแนะนำสาธารณะของ Chrome จะบันทึกข้อบกพร่องที่มีการแก้ไขมากกว่าบทบาทของแบบจำลองในกระบวนการวิจัยทั้งหมด

นอกจากนี้ OpenAI ยังขยาย Daybreak ผ่านที่ปรึกษาด้านความปลอดภัยและผู้ให้บริการเทคโนโลยีอีกด้วย พันธมิตรที่ได้รับอนุมัติจะรักษาการเข้าถึงโมเดลพื้นฐานและนำไปใช้ภายในการมีส่วนร่วมของลูกค้า โดยมีการควบคุมที่อาจรวมถึงการตรวจสอบตัวตน ขอบเขตที่กำหนด การบันทึก การตรวจสอบ และการตรวจสอบโดยมนุษย์

การออกแบบพันธมิตรนั้นเปลี่ยนแปลงผู้ที่ต้องเป็นผู้ตัดสินขั้นสุดท้าย OpenAI กล่าวว่าการเข้าถึงโมเดลพื้นฐานจะไม่ถูกถ่ายโอนไปยังลูกค้าโดยตรง พันธมิตรกำหนดการมีส่วนร่วม ตรวจสอบผลการวิจัย และใช้ความเชี่ยวชาญด้านความปลอดภัยของตนเองก่อนดำเนินการ ในทางปฏิบัติ การใช้งานที่เป็นประโยชน์จึงขึ้นอยู่กับความสามารถของพันธมิตรในการแยกข้อบกพร่องที่ทำซ้ำได้ออกจากข้อเสนอแนะแบบจำลองเชิงคาดเดา ทำการทดสอบภายในขอบเขตที่ตกลงกันไว้ และย้ายการแก้ไขที่ได้รับการยืนยันผ่านกระบวนการบำรุงรักษาซอฟต์แวร์จริง

Interactive Mechanism

กลไกเชิงโต้ตอบ: มันทำงานอย่างไร

สำรวจเทคโนโลยีเบื้องหลังการพัฒนานี้แบบโต้ตอบ

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
การตรวจสอบแนวคิดแบบโต้ตอบ+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

จะดูอะไรต่อไป.

ระวังการ์ดระบบที่สัญญาไว้ การสร้างมาตรฐานที่เป็นอิสระ การเปิดเผยช่องโหว่อื่นๆ ที่รายงานโดยสมบูรณ์ และหลักฐานที่แสดงว่าการควบคุมการเข้าถึงทนต่อการใช้งานในทางที่ผิด

ตัวเลขประสิทธิภาพส่วนใหญ่ในประกาศนี้มาจากการใช้งานภายในของ OpenAI ในเรื่อง Advanced Cybersecurity Completion Rate, ExploitGym, ExploitBench และการประเมินการรายงานช่องโหว่ บริษัทกล่าวว่า GPT-5.6-Cyber ​​ไม่ชนะทุกการเปรียบเทียบ: GPT-5.6 Sol สร้างรายงานที่ดีกว่าในการประเมินครั้งเดียว และแก้ไขการตั้งค่า ExploitBench มาตรฐาน 300 รอบได้อย่างมีประสิทธิภาพมากขึ้น

OpenAI ให้คะแนน GPT-5.6-Cyber ​​อยู่ในระดับสูง แต่ต่ำกว่าระดับวิกฤต สำหรับความสามารถด้านความปลอดภัยทางไซเบอร์ภายใต้กรอบการเตรียมพร้อม มันบอกว่าการ์ดระบบที่สมบูรณ์กว่าจะมาในภายหลัง จนกว่าวิธีการและผลลัพธ์จะได้รับการเผยแพร่ในรายละเอียดเพียงพอที่จะทำซ้ำ การประกาศดังกล่าวสนับสนุนข้อเรียกร้องของบริษัทที่เกี่ยวข้อง แทนที่จะเป็นการวัดความสามารถในการรุกในโลกแห่งความเป็นจริงโดยอิสระ

กรณีด้านความปลอดภัยขึ้นอยู่กับการปฏิบัติงานพอๆ กับการฝึกอบรม บัญชี Daybreak แต่ละบัญชีต้องใช้คีย์ความปลอดภัยของฮาร์ดแวร์เริ่มตั้งแต่วันที่ 1 กันยายน และ OpenAI จะแนะนำสภาพแวดล้อมแบบแยก สิทธิ์ที่กำหนดขอบเขต การดำเนินการของตัวแทนที่ได้รับการตรวจสอบ และการกำกับดูแลโดยมนุษย์ การรายงานการติดตามผลที่เป็นประโยชน์ควรแสดงการเพิกถอนการเข้าถึง การละเมิดที่ตรวจพบ ไทม์ไลน์การเปิดเผย ผลลัพธ์ของแพตช์ และผลบวกลวงเมื่อโปรแกรมขยายตัว

การเปรียบเทียบอัตราความสำเร็จของบรรทัดแรกยังมีข้อแม้ในการวัดที่สำคัญอีกด้วย OpenAI กล่าวว่าทุกรุ่นทำงานในระดับการให้เหตุผลสูงสุดที่เปิดเผยต่อสาธารณะ และตั้งข้อสังเกตว่า GPT-5.6-Cyber ​​มีแนวโน้มที่จะใช้งบประมาณการให้เหตุผลที่ใหญ่กว่าและโทเค็นมากกว่า GPT-5.6 Sol อัตราความสำเร็จที่สูงขึ้นอาจสะท้อนทั้งการฝึกอบรมเฉพาะทางและปริมาณการคำนวณที่แตกต่างกัน การทดสอบอิสระควรรายงานงบประมาณที่ตรงกัน การสร้างงาน เกณฑ์การปฏิเสธ และอัตราของคำตอบที่ไม่ปลอดภัยหรือใช้งานไม่ได้ แทนที่จะรายงานเพียงว่าคำตอบนั้นถูกสร้างขึ้นมาหรือไม่

บัญชีที่ครบกำหนดของโปรแกรมจะต้องเป็นไปตามวงจรชีวิตของช่องโหว่ทั้งหมด นั่นหมายถึงการรายงานความถี่ที่ลีดที่สร้างแบบจำลองสามารถอยู่รอดได้จากการสืบพันธุ์ของมนุษย์ จำนวนการค้นพบที่ซ้ำกันหรือมีความรุนแรงต่ำ ผู้จำหน่ายได้รับรายงานที่ดำเนินการได้เร็วแค่ไหน และแพตช์ถูกปรับใช้ก่อนที่จะเปิดเผยต่อสาธารณะหรือไม่ นอกจากนี้ ควรอธิบายด้วยว่าเกิดอะไรขึ้นเมื่อลูกค้าของคู่ค้าขอให้แบบจำลองข้ามขอบเขตการทดสอบ เมื่อตัวแทนพบข้อมูลรับรองการผลิต หรือเมื่อการใช้ประโยชน์ที่เสนอนั้นอันตรายเกินกว่าจะตรวจสอบได้โดยตรง การควบคุมเหล่านั้นกำหนดว่าอัตราการปฏิเสธที่ต่ำกว่าจะสร้างมูลค่าการป้องกันที่วัดได้ แทนที่จะขยายขอบเขตของรหัสการใช้งานสองทางเท่านั้น

สาธารณะควรสามารถแยกแยะความสามารถของแบบจำลองจากการอนุญาตของลูกค้าได้ กฎการเข้าถึงของ OpenAI มีการรับรองทางกฎหมาย การตรวจสอบตัวตน การตรวจสอบ และขอบเขตการทำงานเกี่ยวกับโมเดล แต่การควบคุมเหล่านั้นอ้างว่าได้รับการทดสอบเมื่อเวลาผ่านไป การรายงานเหตุการณ์ควรระบุว่าคำขอถูกบล็อก ยกระดับเพื่อตรวจสอบ หรืออนุญาตภายใต้การมีส่วนร่วมที่บันทึกไว้ โดยไม่เปิดเผยรายละเอียดการหาประโยชน์ที่จะทำให้ระบบที่ไม่ได้รับแพตช์ถูกโจมตีได้ง่ายขึ้น

คำแนะนำและแบบทดสอบที่เกี่ยวข้อง

ความปลอดภัยของเอไอAI ในการปฏิบัติการรักษาความปลอดภัยทางไซเบอร์ความปลอดภัยของเอไอทดสอบสิ่งที่คุณรู้ — ลองแบบทดสอบ AI ฟรีค้นหาคำศัพท์ AI ในอภิธานศัพท์ของเราปฏิบัติตามตัวติดตามกฎระเบียบของ AI
พบว่าสิ่งนี้มีประโยชน์หรือไม่?