العودة إلى الأخبار
الأمانAI Understanding إحاطة

OpenAI يفتح GPT-5.6-Cyber للمدافعين المعتمدين

يجيب النموذج السيبراني الجديد للتحكم في الوصول إلى OpenAI على طلبات بحث استغلال أكثر تقدمًا ويساعد في العثور على خلل مصحح في Chrome، ولكن معظم الأدلة تأتي من التقييمات الداخلية.

5 min readRead the primary source
وثيقة المصدر الأساسيتم تسجيل المصدر
الناشر
OpenAI's GPT-5.6-Cyber and Daybreak announcement
رابط المصدر
openai.comhttps://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
نوع المصدر
المستند الأساسي - إعلان رسمي أو ورقة أو ملف أو صفحة الطرف الأول التي نقرأها مباشرة.
السياقافهم هذا في 60 ثانية

ابدأ هنا

المصطلحات الرئيسية

مجموعة التقييم
مجموعة بيانات محفوظة تستخدم لقياس جودة النموذج بعد التدريب.
حالة السلامة
حجة منظمة، مدعومة بالأدلة، بأن نظام الذكاء الاصطناعي آمن لسياق استخدام محدد.
المعيار
اختبار موحد أو مجموعة بيانات تستخدم لقياس ومقارنة أداء النموذج.
اختبر نفسكمسابقة أمن الذكاء الاصطناعي

ماذا حدث

قامت OpenAI بتوسيع برنامج Daybreak الخاص بها في 10 أغسطس بمستويات وصول منفصلة للعمل الدفاعي والأبحاث الأمنية المتقدمة، بما في ذلك نموذج GPT-5.6-Cyber ​​المتخصص.

يمنح Daybreak Blue المدافعين المعتمدين GPT-5.6 Sol مع إزالة عوامل التصفية الإلكترونية على مستوى النظام للعمل مثل مراجعة التعليمات البرمجية الآمنة، وتحليل البرامج الضارة، والاستجابة للحوادث، واكتشاف الثغرات الأمنية، والتحقق من صحة التصحيح. يضيف Daybreak Red GPT-5.6-Cyber ​​للتحقق من صحة الاستغلال واختبار الاختراق وغيرها من الأبحاث ذات الاستخدام المزدوج التي قد لا يزال النموذج العام يرفضها.

تقول OpenAI أن GPT-5.6-Cyber ​​أكملت 95% من الطلبات في تقييمها الداخلي لمعدل إكمال الأمن السيبراني المتقدم، مقارنة بـ 1.5% لـ GPT-5.6 Sol القياسي، و2% لـ Sol حتى Daybreak Blue، و57.3% لـ GPT-5.5-Cyber. وتقول الشركة إن الاختبار يغطي سيناريوهات مثل تطوير سلسلة الاستغلال، وتجاوز المصادقة، وتصعيد الامتيازات؛ لم يتم إصدار مجموعة التقييم.

أبلغت الشركة أيضًا عن استخدام النموذج للمساعدة في اكتشاف اثنتين من نقاط الضعف V8 غير المعروفة سابقًا والتي يمكن ربطها معًا. قام Google بتعيين CVE-2026-15903 لأول مرة وقام بتصحيحه في Chrome 150. ويؤكد تقرير إصدار Google بشكل مستقل أن الخلل الشديد الخطورة يسمح بالقراءة والكتابة خارج الحدود في V8، على الرغم من أنه لا يقوم بتقييم نظام الذكاء الاصطناعي الذي ساعد في العثور عليه.

يصف OpenAI GPT-5.6-Cyber ​​بأنه نموذج مبني على GPT-5.6 Sol وتم تدريبه على مهام مختارة عالية المخاطر ومزدوجة الاستخدام بدلاً من الاستخدام الهجومي غير المقيد. يتوفر Daybreak Red فقط للأفراد والمؤسسات المعتمدة التي تقوم بأعمال مصرح بها، مع التحقق من الهوية، وأمن الحساب، والمراقبة، وقيود الاستخدام المعتمدة، والشهادات القانونية. ويشير الإعلان أيضًا إلى أن حسابات Daybreak الفردية ستحتاج إلى مفاتيح أمان الأجهزة بدءًا من 1 سبتمبر 2026.

تفاصيل المصدر: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗

لماذا يهم

ينقل الإصدار القدرات السيبرانية الأكثر خطورة للنموذج الحدودي من إعداد بحث صغير إلى برنامج وصول محكوم، لاختبار ما إذا كان بإمكان المدافعين الحصول عليها قبل أن تنتشر نفس التقنيات إلى المهاجمين.

يعد تقليل حالات الرفض أمرًا أساسيًا للمنتج: قد يكون النموذج الذي يرفض أعمال الاستغلال الواقعية أكثر أمانًا للاستخدام العام ولكنه أقل فائدة للفرق التي يجب عليها إعادة إنتاج الثغرة الأمنية قبل أن تتمكن من تحديد أولوياتها وإصلاحها. يفصل Daybreak بين المهام الدفاعية الأوسع نطاقًا وبين تطوير برامج استغلال الثغرات عالية الخطورة بدلاً من الكشف عن سياسة واحدة لكل مستخدم.

يعد الكشف عن V8 دليلًا ملموسًا على أن أبحاث الثغرات الأمنية المدعومة بالذكاء الاصطناعي يمكن أن تصل إلى البرامج المنشورة. كما أنه أضيق من ادعاء الدفاع الذاتي: تقول OpenAI إن باحثيها تحققوا من صحة النتائج ونسقوا الكشف مع Google، في حين يسجل تقرير Chrome العام الخلل المصحح بدلاً من دور النموذج في عملية البحث الكاملة.

تعمل OpenAI أيضًا على توسيع Daybreak من خلال الاستشارات الأمنية ومقدمي التكنولوجيا. يحتفظ الشركاء المعتمدون بإمكانية الوصول إلى النماذج الأساسية وتطبيقها ضمن ارتباطات العملاء، مع عناصر تحكم يمكن أن تشمل التحقق من الهوية، والنطاقات المحددة، والتسجيل، والمراقبة، والمراجعة البشرية.

يتغير تصميم الشريك هذا من يجب عليه تقديم الميل الأخير من الحكم. تقول OpenAI أن الوصول إلى النموذج الأساسي لا يتم نقله مباشرة إلى العميل؛ يحدد الشريك المشاركة، ويراجع النتائج، ويطبق خبرته الأمنية الخاصة قبل اتخاذ الإجراء. ومن الناحية العملية، يعتمد النشر المفيد على قدرة الشريك على فصل الخلل القابل للتكرار عن اقتراح نموذج تخميني، ومواصلة الاختبار داخل النطاق المتفق عليه، ونقل الإصلاح المؤكد من خلال عملية صيانة برمجية حقيقية.

Interactive Mechanism

الآلية التفاعلية: كيف تعمل فعليًا

استكشف التكنولوجيا الأساسية وراء هذا التطور بشكل تفاعلي.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
التحقق من المفهوم التفاعلي+10 Points
AI Security Quiz

What is an adversarial example in machine learning security?

ماذا تشاهد بعد ذلك

راقب بطاقة النظام الموعودة، واستنساخ المعايير المستقلة، والكشف الكامل عن نقاط الضعف الأخرى المبلغ عنها، والأدلة على أن ضوابط الوصول تصمد أمام سوء الاستخدام.

تأتي معظم أرقام الأداء الواردة في الإعلان من تطبيقات OpenAI الداخلية لمعدل إكمال الأمن السيبراني المتقدم، وExploitGym، وExploitBench، وتقييمات الإبلاغ عن الثغرات الأمنية. تقول الشركة إن GPT-5.6-Cyber ​​لم يفز بكل المقارنة: أنتجت GPT-5.6 Sol تقارير أفضل حول تقييم واحد وحلت إعداد ExploitBench القياسي ذو 300 دورة بشكل أكثر كفاءة.

OpenAI تُصنف GPT-5.6-Cyber ​​على أنها عالية، ولكنها أقل من الحرجة، بالنسبة لقدرة الأمن السيبراني ضمن إطار الاستعداد الخاص بها. تقول أن بطاقة النظام الكاملة ستأتي لاحقًا. وإلى أن يتم نشر الأساليب والنتائج بتفاصيل كافية لإعادة إنتاجها، فإن الإعلان يدعم ادعاءات الشركة المنسوبة بدلاً من مقياس مستقل للقدرة الهجومية في العالم الحقيقي.

تعتمد حالة السلامة على العمليات بقدر ما تعتمد على التدريب. يجب أن تعتمد حسابات Daybreak الفردية مفاتيح أمان الأجهزة بدءًا من 1 سبتمبر، وتوصي OpenAI ببيئات معزولة، وأذونات محددة النطاق، وإجراءات الوكيل الخاضعة للمراقبة، والإشراف البشري. يجب أن تُظهر تقارير المتابعة المفيدة عمليات إبطال الوصول وإساءة الاستخدام المكتشفة والجداول الزمنية للإفصاح ونتائج التصحيح والإيجابيات الخاطئة مع توسع البرنامج.

تحتوي مقارنة معدل إكمال العنوان الرئيسي أيضًا على تحذير مهم في القياس. تقول OpenAI أن كل نموذج تم تشغيله على أعلى مستوى استدلال متاح للعامة، وتشير إلى أن GPT-5.6-Cyber ​​يميل إلى استخدام ميزانية استدلال أكبر ورموز مميزة أكثر من GPT-5.6 Sol. وبالتالي فإن معدل الإنجاز الأعلى قد يعكس كلاً من التدريب المتخصص وكمية مختلفة من الحسابات. يجب أن تشير الاختبارات المستقلة إلى الميزانيات المتطابقة، وبناء المهام، ومعايير الرفض، ومعدل الإجابات غير الآمنة أو غير القابلة للاستخدام وليس فقط ما إذا كان قد تم إنتاج استجابة.

سيحتاج الحساب الناضج للبرنامج إلى متابعة دورة حياة الثغرة الأمنية بأكملها. وهذا يعني الإبلاغ عن عدد المرات التي ينجو فيها الرصاص الناتج عن النموذج من التكاثر البشري، وعدد النتائج المكررة أو منخفضة الخطورة، ومدى سرعة تلقي البائعين لتقارير قابلة للتنفيذ، وما إذا كان يتم نشر التصحيحات قبل الكشف العام. ويجب أن يشرح أيضًا ما يحدث عندما يطلب عميل الشريك من النموذج تجاوز حدود الاختبار، أو عندما يواجه الوكيل بيانات اعتماد الإنتاج، أو عندما يكون استغلال الاستغلال المقترح خطيرًا للغاية بحيث لا يمكن التحقق من صحته بشكل مباشر. تحدد هذه الضوابط ما إذا كانت معدلات الرفض المنخفضة تخلق قيمة دفاعية قابلة للقياس بدلاً من مجرد توسيع المعروض من التعليمات البرمجية ذات الاستخدام المزدوج.

يجب أن يكون الجمهور أيضًا قادرًا على التمييز بين قدرة النموذج وتفويض العميل. تضع قواعد الوصول الخاصة بـ OpenAI الشهادات القانونية وعمليات التحقق من الهوية والمراقبة والعمل المحدود حول النموذج، ولكن عناصر التحكم هذه مطالبات باختبارها بمرور الوقت. يجب أن يوضح الإبلاغ عن الحوادث ما إذا كان الطلب قد تم حظره أو تصعيده للمراجعة أو السماح به بموجب مشاركة موثقة، دون الكشف عن تفاصيل الاستغلال التي من شأنها أن تجعل مهاجمة النظام غير المصحح أسهل.

الأدلة والاختبارات ذات الصلة

أمن الذكاء الاصطناعيالذكاء الاصطناعي في عمليات الأمن السيبرانيسلامة الذكاء الاصطناعياختبر ما تعرفه – جرّب اختبارًا مجانيًا للذكاء الاصطناعيابحث عن مصطلح الذكاء الاصطناعي في قاموسنااتبع تعقب تنظيم الذكاء الاصطناعي
وجدت هذا مفيدا؟