ماذا حدث
قامت OpenAI بتوسيع برنامج Daybreak الخاص بها في 10 أغسطس بمستويات وصول منفصلة للعمل الدفاعي والأبحاث الأمنية المتقدمة، بما في ذلك نموذج GPT-5.6-Cyber المتخصص.
يمنح Daybreak Blue المدافعين المعتمدين GPT-5.6 Sol مع إزالة عوامل التصفية الإلكترونية على مستوى النظام للعمل مثل مراجعة التعليمات البرمجية الآمنة، وتحليل البرامج الضارة، والاستجابة للحوادث، واكتشاف الثغرات الأمنية، والتحقق من صحة التصحيح. يضيف Daybreak Red GPT-5.6-Cyber للتحقق من صحة الاستغلال واختبار الاختراق وغيرها من الأبحاث ذات الاستخدام المزدوج التي قد لا يزال النموذج العام يرفضها.
تقول OpenAI أن GPT-5.6-Cyber أكملت 95% من الطلبات في تقييمها الداخلي لمعدل إكمال الأمن السيبراني المتقدم، مقارنة بـ 1.5% لـ GPT-5.6 Sol القياسي، و2% لـ Sol حتى Daybreak Blue، و57.3% لـ GPT-5.5-Cyber. وتقول الشركة إن الاختبار يغطي سيناريوهات مثل تطوير سلسلة الاستغلال، وتجاوز المصادقة، وتصعيد الامتيازات؛ لم يتم إصدار مجموعة التقييم.
أبلغت الشركة أيضًا عن استخدام النموذج للمساعدة في اكتشاف اثنتين من نقاط الضعف V8 غير المعروفة سابقًا والتي يمكن ربطها معًا. قام Google بتعيين CVE-2026-15903 لأول مرة وقام بتصحيحه في Chrome 150. ويؤكد تقرير إصدار Google بشكل مستقل أن الخلل الشديد الخطورة يسمح بالقراءة والكتابة خارج الحدود في V8، على الرغم من أنه لا يقوم بتقييم نظام الذكاء الاصطناعي الذي ساعد في العثور عليه.
يصف OpenAI GPT-5.6-Cyber بأنه نموذج مبني على GPT-5.6 Sol وتم تدريبه على مهام مختارة عالية المخاطر ومزدوجة الاستخدام بدلاً من الاستخدام الهجومي غير المقيد. يتوفر Daybreak Red فقط للأفراد والمؤسسات المعتمدة التي تقوم بأعمال مصرح بها، مع التحقق من الهوية، وأمن الحساب، والمراقبة، وقيود الاستخدام المعتمدة، والشهادات القانونية. ويشير الإعلان أيضًا إلى أن حسابات Daybreak الفردية ستحتاج إلى مفاتيح أمان الأجهزة بدءًا من 1 سبتمبر 2026.
تفاصيل المصدر: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗
لماذا يهم
ينقل الإصدار القدرات السيبرانية الأكثر خطورة للنموذج الحدودي من إعداد بحث صغير إلى برنامج وصول محكوم، لاختبار ما إذا كان بإمكان المدافعين الحصول عليها قبل أن تنتشر نفس التقنيات إلى المهاجمين.
يعد تقليل حالات الرفض أمرًا أساسيًا للمنتج: قد يكون النموذج الذي يرفض أعمال الاستغلال الواقعية أكثر أمانًا للاستخدام العام ولكنه أقل فائدة للفرق التي يجب عليها إعادة إنتاج الثغرة الأمنية قبل أن تتمكن من تحديد أولوياتها وإصلاحها. يفصل Daybreak بين المهام الدفاعية الأوسع نطاقًا وبين تطوير برامج استغلال الثغرات عالية الخطورة بدلاً من الكشف عن سياسة واحدة لكل مستخدم.
يعد الكشف عن V8 دليلًا ملموسًا على أن أبحاث الثغرات الأمنية المدعومة بالذكاء الاصطناعي يمكن أن تصل إلى البرامج المنشورة. كما أنه أضيق من ادعاء الدفاع الذاتي: تقول OpenAI إن باحثيها تحققوا من صحة النتائج ونسقوا الكشف مع Google، في حين يسجل تقرير Chrome العام الخلل المصحح بدلاً من دور النموذج في عملية البحث الكاملة.
تعمل OpenAI أيضًا على توسيع Daybreak من خلال الاستشارات الأمنية ومقدمي التكنولوجيا. يحتفظ الشركاء المعتمدون بإمكانية الوصول إلى النماذج الأساسية وتطبيقها ضمن ارتباطات العملاء، مع عناصر تحكم يمكن أن تشمل التحقق من الهوية، والنطاقات المحددة، والتسجيل، والمراقبة، والمراجعة البشرية.
يتغير تصميم الشريك هذا من يجب عليه تقديم الميل الأخير من الحكم. تقول OpenAI أن الوصول إلى النموذج الأساسي لا يتم نقله مباشرة إلى العميل؛ يحدد الشريك المشاركة، ويراجع النتائج، ويطبق خبرته الأمنية الخاصة قبل اتخاذ الإجراء. ومن الناحية العملية، يعتمد النشر المفيد على قدرة الشريك على فصل الخلل القابل للتكرار عن اقتراح نموذج تخميني، ومواصلة الاختبار داخل النطاق المتفق عليه، ونقل الإصلاح المؤكد من خلال عملية صيانة برمجية حقيقية.
الآلية التفاعلية: كيف تعمل فعليًا
استكشف التكنولوجيا الأساسية وراء هذا التطور بشكل تفاعلي.
What is an adversarial example in machine learning security?
ماذا تشاهد بعد ذلك
راقب بطاقة النظام الموعودة، واستنساخ المعايير المستقلة، والكشف الكامل عن نقاط الضعف الأخرى المبلغ عنها، والأدلة على أن ضوابط الوصول تصمد أمام سوء الاستخدام.
تأتي معظم أرقام الأداء الواردة في الإعلان من تطبيقات OpenAI الداخلية لمعدل إكمال الأمن السيبراني المتقدم، وExploitGym، وExploitBench، وتقييمات الإبلاغ عن الثغرات الأمنية. تقول الشركة إن GPT-5.6-Cyber لم يفز بكل المقارنة: أنتجت GPT-5.6 Sol تقارير أفضل حول تقييم واحد وحلت إعداد ExploitBench القياسي ذو 300 دورة بشكل أكثر كفاءة.
OpenAI تُصنف GPT-5.6-Cyber على أنها عالية، ولكنها أقل من الحرجة، بالنسبة لقدرة الأمن السيبراني ضمن إطار الاستعداد الخاص بها. تقول أن بطاقة النظام الكاملة ستأتي لاحقًا. وإلى أن يتم نشر الأساليب والنتائج بتفاصيل كافية لإعادة إنتاجها، فإن الإعلان يدعم ادعاءات الشركة المنسوبة بدلاً من مقياس مستقل للقدرة الهجومية في العالم الحقيقي.
تعتمد حالة السلامة على العمليات بقدر ما تعتمد على التدريب. يجب أن تعتمد حسابات Daybreak الفردية مفاتيح أمان الأجهزة بدءًا من 1 سبتمبر، وتوصي OpenAI ببيئات معزولة، وأذونات محددة النطاق، وإجراءات الوكيل الخاضعة للمراقبة، والإشراف البشري. يجب أن تُظهر تقارير المتابعة المفيدة عمليات إبطال الوصول وإساءة الاستخدام المكتشفة والجداول الزمنية للإفصاح ونتائج التصحيح والإيجابيات الخاطئة مع توسع البرنامج.
تحتوي مقارنة معدل إكمال العنوان الرئيسي أيضًا على تحذير مهم في القياس. تقول OpenAI أن كل نموذج تم تشغيله على أعلى مستوى استدلال متاح للعامة، وتشير إلى أن GPT-5.6-Cyber يميل إلى استخدام ميزانية استدلال أكبر ورموز مميزة أكثر من GPT-5.6 Sol. وبالتالي فإن معدل الإنجاز الأعلى قد يعكس كلاً من التدريب المتخصص وكمية مختلفة من الحسابات. يجب أن تشير الاختبارات المستقلة إلى الميزانيات المتطابقة، وبناء المهام، ومعايير الرفض، ومعدل الإجابات غير الآمنة أو غير القابلة للاستخدام وليس فقط ما إذا كان قد تم إنتاج استجابة.
سيحتاج الحساب الناضج للبرنامج إلى متابعة دورة حياة الثغرة الأمنية بأكملها. وهذا يعني الإبلاغ عن عدد المرات التي ينجو فيها الرصاص الناتج عن النموذج من التكاثر البشري، وعدد النتائج المكررة أو منخفضة الخطورة، ومدى سرعة تلقي البائعين لتقارير قابلة للتنفيذ، وما إذا كان يتم نشر التصحيحات قبل الكشف العام. ويجب أن يشرح أيضًا ما يحدث عندما يطلب عميل الشريك من النموذج تجاوز حدود الاختبار، أو عندما يواجه الوكيل بيانات اعتماد الإنتاج، أو عندما يكون استغلال الاستغلال المقترح خطيرًا للغاية بحيث لا يمكن التحقق من صحته بشكل مباشر. تحدد هذه الضوابط ما إذا كانت معدلات الرفض المنخفضة تخلق قيمة دفاعية قابلة للقياس بدلاً من مجرد توسيع المعروض من التعليمات البرمجية ذات الاستخدام المزدوج.
يجب أن يكون الجمهور أيضًا قادرًا على التمييز بين قدرة النموذج وتفويض العميل. تضع قواعد الوصول الخاصة بـ OpenAI الشهادات القانونية وعمليات التحقق من الهوية والمراقبة والعمل المحدود حول النموذج، ولكن عناصر التحكم هذه مطالبات باختبارها بمرور الوقت. يجب أن يوضح الإبلاغ عن الحوادث ما إذا كان الطلب قد تم حظره أو تصعيده للمراجعة أو السماح به بموجب مشاركة موثقة، دون الكشف عن تفاصيل الاستغلال التي من شأنها أن تجعل مهاجمة النظام غير المصحح أسهل.