Quay lại Tin tức
Bảo mậtAI Understanding tóm tắt

OpenAI Mở GPT-5.6-Cyber cho những người bảo vệ được phê duyệt

Mô hình mạng truy cập có kiểm soát mới của OpenAI trả lời các yêu cầu nghiên cứu khai thác nâng cao hơn và giúp tìm ra lỗ hổng đã vá của Chrome nhưng hầu hết bằng chứng đều đến từ các đánh giá nội bộ.

5 min readRead the primary source
Tài liệu nguồn chínhNguồn đã ghi
Nhà xuất bản
OpenAI's GPT-5.6-Cyber and Daybreak announcement
Liên kết nguồn
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
Loại nguồn
Tài liệu chính - một thông báo chính thức, giấy tờ, hồ sơ hoặc trang của bên thứ nhất mà chúng tôi đọc trực tiếp.
Bối cảnhHiểu điều này trong 60 giây

Bắt đầu ở đây

Thuật ngữ chính

Bộ đánh giá
Một tập dữ liệu được giữ lại được sử dụng để đo lường chất lượng mô hình sau khi đào tạo.
Trường hợp an toàn
Một lập luận có cấu trúc, được hỗ trợ bởi bằng chứng, rằng hệ thống AI an toàn cho bối cảnh sử dụng xác định.
Điểm chuẩn
Một bài kiểm tra hoặc tập dữ liệu được tiêu chuẩn hóa dùng để đo lường và so sánh hiệu suất của mô hình.
Tự kiểm traCâu đố về bảo mật AI

Chuyện gì đã xảy ra

OpenAI đã mở rộng chương trình Daybreak vào ngày 10 tháng 8 với các cấp truy cập riêng biệt dành cho công việc phòng thủ và nghiên cứu bảo mật nâng cao, bao gồm cả mẫu GPT-5.6-Cyber ​​chuyên dụng.

Daybreak Blue cung cấp cho GPT-5.6 Sol những bộ bảo vệ đã được phê duyệt với các bộ lọc mạng cấp hệ thống được loại bỏ để thực hiện các công việc như xem xét mã bảo mật, phân tích phần mềm độc hại, ứng phó sự cố, phát hiện lỗ hổng và xác thực bản vá. Daybreak Red bổ sung GPT-5.6-Cyber ​​để xác thực khai thác được ủy quyền, thử nghiệm thâm nhập và nghiên cứu sử dụng kép khác mà mô hình chung vẫn có thể từ chối.

OpenAI cho biết GPT-5.6-Cyber ​​đã hoàn thành 95% yêu cầu trong đánh giá Tỷ lệ hoàn thành an ninh mạng nâng cao nội bộ của mình, so với 1,5% đối với GPT-5.6 Sol tiêu chuẩn, 2% đối với Sol thông qua Daybreak Blue và 57,3% đối với GPT-5.5-Cyber. Công ty cho biết thử nghiệm bao gồm các tình huống như phát triển chuỗi khai thác, bỏ qua xác thực và leo thang đặc quyền; nó chưa phát hành bộ đánh giá.

Công ty cũng báo cáo việc sử dụng mô hình này để giúp khám phá hai lỗ hổng V8 chưa được biết đến trước đây có thể liên kết với nhau. Google đã chỉ định CVE-2026-15903 đầu tiên và vá nó trong Chrome 150. Tư vấn phát hành của Google xác nhận một cách độc lập rằng lỗ hổng nghiêm trọng cao cho phép đọc và ghi ngoài giới hạn trong V8, mặc dù nó không đánh giá hệ thống AI đã giúp tìm ra nó.

OpenAI mô tả GPT-5.6-Cyber ​​là mô hình được xây dựng trên GPT-5.6 Sol và được huấn luyện cho các nhiệm vụ sử dụng kép, có rủi ro cao được chọn thay vì sử dụng tấn công không hạn chế. Daybreak Red chỉ dành cho các cá nhân và tổ chức được phê duyệt thực hiện công việc được ủy quyền, với xác minh danh tính, bảo mật tài khoản, giám sát, hạn chế sử dụng được phê duyệt và chứng thực pháp lý. Thông báo cũng cho biết các tài khoản Daybreak cá nhân sẽ cần khóa bảo mật phần cứng bắt đầu từ ngày 1 tháng 9 năm 2026.

Chi tiết nguồn: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

Tại sao nó quan trọng

Bản phát hành chuyển các khả năng mạng nguy hiểm hơn của mô hình biên giới từ bối cảnh nghiên cứu nhỏ sang chương trình truy cập được quản lý, kiểm tra xem liệu những người bảo vệ có thể nhận được chúng hay không trước khi các kỹ thuật tương tự lan sang những kẻ tấn công.

Giảm số lần từ chối là trọng tâm của sản phẩm: một mô hình từ chối công việc khai thác thực tế có thể an toàn hơn cho mục đích sử dụng thông thường nhưng lại kém hữu ích hơn đối với các nhóm phải tái tạo lỗ hổng trước khi họ có thể ưu tiên và khắc phục lỗ hổng đó. Bình minh tách các nhiệm vụ phòng thủ rộng hơn khỏi việc phát triển khai thác có rủi ro cao hơn thay vì đưa ra một chính sách cho mọi người dùng.

Tiết lộ V8 là bằng chứng cụ thể cho thấy nghiên cứu lỗ hổng được hỗ trợ bởi AI có thể tiếp cận phần mềm đã triển khai. Nó cũng hẹp hơn so với tuyên bố bảo vệ tự trị: OpenAI cho biết các nhà nghiên cứu của họ đã xác thực các phát hiện và phối hợp tiết lộ với Google, trong khi tư vấn công khai của Chrome ghi lại lỗ hổng được vá thay vì vai trò của mô hình trong toàn bộ quá trình nghiên cứu.

OpenAI cũng đang mở rộng Daybreak thông qua các nhà tư vấn bảo mật và nhà cung cấp công nghệ. Các đối tác được phê duyệt có quyền truy cập vào các mô hình cơ bản và áp dụng chúng trong quá trình tương tác với khách hàng, với các biện pháp kiểm soát có thể bao gồm xác minh danh tính, phạm vi xác định, ghi nhật ký, giám sát và đánh giá con người.

Thiết kế đối tác đó thay đổi người phải đưa ra phán quyết cuối cùng. OpenAI cho biết quyền truy cập vào mô hình cơ bản không được chuyển trực tiếp cho khách hàng; đối tác xác định sự tham gia, đánh giá các phát hiện và áp dụng kiến ​​thức chuyên môn về bảo mật của riêng mình trước khi hành động. Do đó, trên thực tế, việc triển khai hữu ích phụ thuộc vào khả năng của đối tác trong việc tách lỗ hổng có thể tái tạo khỏi đề xuất mô hình suy đoán, tiếp tục thử nghiệm trong phạm vi đã thống nhất và chuyển bản sửa lỗi đã được xác nhận thông qua quy trình bảo trì phần mềm thực tế.

Interactive Mechanism

Cơ chế tương tác: Nó thực sự hoạt động như thế nào

Khám phá công nghệ cơ bản đằng sau sự phát triển này một cách tương tác.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Kiểm tra khái niệm tương tác+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

Xem gì tiếp theo

Theo dõi thẻ hệ thống đã hứa, tái tạo điểm chuẩn độc lập, tiết lộ đầy đủ các lỗ hổng được báo cáo khác và bằng chứng cho thấy các biện pháp kiểm soát truy cập có thể chống lại việc lạm dụng.

Hầu hết các số liệu hiệu suất trong thông báo đều đến từ việc triển khai nội bộ của OpenAI về Tỷ lệ hoàn thành an ninh mạng nâng cao, ExploitGym, ExploitBench và đánh giá báo cáo lỗ hổng. Công ty cho biết GPT-5.6-Cyber ​​không giành chiến thắng trong mọi cuộc so sánh: GPT-5.6 Sol đã tạo ra các báo cáo tốt hơn trong một lần đánh giá và giải quyết cài đặt ExploitBench 300 lượt tiêu chuẩn hiệu quả hơn.

OpenAI xếp hạng GPT-5.6-Cyber ​​ở mức Cao nhưng dưới mức Quan trọng đối với khả năng an ninh mạng theo Khung chuẩn bị của nó. Nó báo sau này sẽ có card hệ thống đầy đủ hơn. Cho đến khi các phương pháp và kết quả được công bố đủ chi tiết để tái tạo, thông báo này hỗ trợ các tuyên bố được cho là của công ty hơn là thước đo độc lập về khả năng tấn công trong thế giới thực.

Trường hợp an toàn phụ thuộc vào hoạt động cũng như đào tạo. Các tài khoản Daybreak cá nhân phải sử dụng khóa bảo mật phần cứng bắt đầu từ ngày 1 tháng 9 và OpenAI khuyến nghị các môi trường biệt lập, quyền có phạm vi, hành động của tác nhân được giám sát và sự giám sát của con người. Báo cáo theo dõi hữu ích sẽ hiển thị các trường hợp thu hồi quyền truy cập, lạm dụng được phát hiện, các mốc thời gian tiết lộ, kết quả của bản vá và các kết quả dương tính giả khi chương trình mở rộng.

Việc so sánh tỷ lệ hoàn thành dòng tiêu đề cũng có một lưu ý đo lường quan trọng. OpenAI cho biết mọi mô hình đều được chạy ở mức lý luận công khai cao nhất và lưu ý rằng GPT-5.6-Cyber ​​có xu hướng sử dụng ngân sách lý luận lớn hơn và nhiều mã thông báo hơn GPT-5.6 Sol. Do đó, tỷ lệ hoàn thành cao hơn có thể phản ánh cả quá trình đào tạo chuyên môn và lượng tính toán khác nhau. Các bài kiểm tra độc lập phải báo cáo ngân sách phù hợp, cách xây dựng nhiệm vụ, tiêu chí từ chối và tỷ lệ câu trả lời không an toàn hoặc không sử dụng được thay vì chỉ báo cáo liệu câu trả lời có được đưa ra hay không.

Tài khoản trưởng thành của chương trình sẽ cần phải tuân theo toàn bộ vòng đời của lỗ hổng. Điều đó có nghĩa là báo cáo tần suất một khách hàng tiềm năng do mô hình tạo ra tồn tại trong quá trình tái tạo của con người, bao nhiêu phát hiện trùng lặp hoặc mức độ nghiêm trọng thấp, tốc độ các nhà cung cấp nhận được báo cáo có thể hành động và liệu các bản vá có được triển khai trước khi tiết lộ công khai hay không. Nó cũng phải giải thích điều gì sẽ xảy ra khi khách hàng của đối tác yêu cầu mô hình vượt qua ranh giới thử nghiệm, khi một tác nhân gặp phải thông tin xác thực sản xuất hoặc khi một hành vi khai thác được đề xuất quá nguy hiểm để xác thực trực tiếp. Những biện pháp kiểm soát đó xác định liệu tỷ lệ từ chối thấp hơn có tạo ra giá trị phòng thủ có thể đo lường được hay không thay vì chỉ mở rộng việc cung cấp mã sử dụng kép.

Công chúng cũng có thể phân biệt khả năng của một mô hình với sự cho phép của khách hàng. Các quy tắc truy cập của OpenAI bao gồm các chứng thực pháp lý, kiểm tra danh tính, giám sát và phạm vi hoạt động xung quanh mô hình, nhưng các biện pháp kiểm soát đó được yêu cầu phải được kiểm tra theo thời gian. Báo cáo sự cố phải cho biết liệu yêu cầu có bị chặn, được chuyển lên cấp cao để xem xét hay được cho phép theo cam kết được ghi lại hay không mà không tiết lộ các chi tiết khai thác có thể khiến hệ thống chưa được vá lỗi dễ bị tấn công hơn.

Hướng dẫn và câu hỏi liên quan

Bảo mật AIAI trong hoạt động an ninh mạngAn toàn AIKiểm tra những gì bạn biết — thử một bài kiểm tra AI miễn phíTra cứu một thuật ngữ AI trong bảng thuật ngữ của chúng tôiThực hiện theo trình theo dõi quy định AI
Tìm thấy điều này hữu ích?