ماذا حدث
تفيد تقارير SecurityBrief Asia أن CREST أطلقت اختبارًا أمنيًا لمعايير الذكاء الاصطناعي واعتمادًا لمقدمي خدمات الأمن السيبراني. يقوم الإطار بتقييم ما إذا كان مقدمو الخدمة لديهم الخبرة والأساليب والحوكمة والضوابط والأدلة اللازمة لاختبار الأنظمة التي تدعم الذكاء الاصطناعي.
تفيد تقارير SecurityBrief Asia أن CREST، وهي هيئة اعتماد ومعايير الأمن السيبراني العالمية غير الهادفة للربح، أطلقت اختبارًا أمنيًا لمعايير الذكاء الاصطناعي واعتمادًا لمقدمي خدمات الأمن السيبراني. والغرض المعلن هو إعطاء المؤسسات إشارة ضمان مستقلة عند اختيار الشركات لاختبار الأنظمة التي تستخدم الذكاء الاصطناعي التوليدي أو نماذج اللغات الكبيرة. يعرض المقال عملية الإطلاق كاستجابة لفجوة السوق: تتبنى المؤسسات التطبيقات وسير العمل المدعمة بالذكاء الاصطناعي، ولكن قد يواجه المشترون صعوبة في تحديد ما إذا كان مزود الاختبار لديه الخبرة الفنية ذات الصلة.
وفقًا لـ SecurityBrief Asia، يحدد الاعتماد متطلبات قابلة للتقييم عبر الخبرة الفنية، وكفاءة الممارسين، ومنهجيات الاختبار، والحوكمة، وضوابط الجودة، والأدوات، والعمليات لتحديد المخاطر الأمنية الخاصة بالذكاء الاصطناعي، والأدلة المستخدمة لدعم استنتاجات الاختبار. وبالتالي، يقوم البرنامج بتقييم قدرة الاختبار لدى مقدم الخدمة والضوابط المحيطة بعمله. يقول التقرير أنه يجب على مقدمي الخدمة الحصول بالفعل على اعتماد اختبار الاختراق من CREST، أو التقدم بطلب للحصول عليه جنبًا إلى جنب مع الموافقة الجديدة على اختبار الذكاء الاصطناعي. وهذا يربط المخطط الجديد بخط أساس CREST الحالي لخدمات اختبار الاختراق.
يقول التقرير إن المعيار يتعامل مع نظام الذكاء الاصطناعي باعتباره نظامًا كاملاً وليس مجرد نموذج أساسي. يتضمن نطاقها الموصوف التطبيقات والمطالبات وتعليمات النظام وآليات الاسترجاع ومصادر البيانات والذاكرة والأدوات والمكونات الإضافية وواجهات برمجة التطبيقات وطبقات التنسيق والأنظمة النهائية المتأثرة بمخرجات الذكاء الاصطناعي. وهذا مهم لأن الثغرات الأمنية يمكن أن تنشأ في نقاط التكامل أو في البنية التحتية المحيطة، بما في ذلك الطريقة التي يتلقى بها النموذج المعلومات أو يستدعي الأدوات أو يمرر النتائج إلى أنظمة أخرى. تفيد تقارير SecurityBrief Asia أنه تم تطوير المعيار مع القطاع من خلال مجموعة عمل الذكاء الاصطناعي التابعة لـ CREST.
صرح نيك بنسون، الرئيس التنفيذي لـ CREST، لـ SecurityBrief Asia أن الأعضاء والعملاء يريدون المزيد من المعلومات حول بيانات اعتماد اختبار الذكاء الاصطناعي الخاصة بمقدمي الخدمة حيث يقوم العملاء بنشر التكنولوجيا التي تدعم الذكاء الاصطناعي. وميز بنسون بين استخدام عبارة “الاختبار الأمني لأنظمة الذكاء الاصطناعي” وإظهار الخبرة والمنهجيات اللازمة لأداء هذا العمل. يقتبس المقال أيضًا تيم ريد، المدير الفني لـ Sentrium Security، ورئيس خدمات الأمن السيبراني لمجموعة wizlynx، يان تشالينسون، وكلاهما يدعمان إطار العمل. تعليقاتهم هي موافقات الصناعة، وليست تقييمات مستقلة للمعيار.
تضع SecurityBrief Asia عملية الإطلاق ضمن برنامج CREST الأوسع لضمان الذكاء الاصطناعي. يقول المقال إن CREST قدمت معيارًا لاختبار الاختراق المدعوم بالذكاء الاصطناعي في يوليو، مع التركيز على كيفية استخدام مقدمي الخدمة للذكاء الاصطناعي أثناء تقديم خدمات الاختبار. يتناول الاعتماد المُبلغ عنه حديثًا مسألة مختلفة حول ما إذا كان بإمكان مقدمي الخدمات اختبار أنظمة الذكاء الاصطناعي بأنفسهم. ويشير التقرير أيضًا إلى أن أكثر من 100 منظمة مؤسسة للأمن السيبراني قد وقعت على ميثاق الذكاء الاصطناعي ومبادئ الذكاء الاصطناعي التابع لـ CREST، وهو ما يمثل أكثر من 10% من أعضائها حول العالم. ولم يتم تأكيد هذه الأرقام والأوصاف بشكل مستقل لهذا التقييم.
تفاصيل المصدر: securitybrief.asia ↗
لماذا يهم
تتضمن تقييمات أمان الذكاء الاصطناعي بشكل متزايد أكثر من مجرد اختبار نموذج بمعزل عن الآخر. يمكن أن يمنح الاعتماد الرسمي المنظمات إشارة أوضح بشأن المشتريات والعناية الواجبة للموردين، على الرغم من أن التقرير لا يحدد بشكل مستقل مدى انتشار المخطط أو ما إذا كان سيحسن نتائج الاختبار.
والأهمية العملية هي أن اختبار الذكاء الاصطناعي أصبح مشكلة تتعلق بالمشتريات والحوكمة، وليس مشكلة فنية فقط. قد تحتاج الشركة التي تطلب إجراء تقييم إلى الثقة في أن البائع يفهم التلاعب الفوري، ومخاطر الاسترجاع، والوصول إلى الأدوات، ومعالجة البيانات، والذاكرة، والتنسيق، والتأثيرات النهائية. تفيد تقارير SecurityBrief Asia أن إطار عمل CREST مصمم لجعل هذه القدرات قابلة للتقييم. إذا استخدم المشترون الاعتماد كجزء من العناية الواجبة للموردين، فقد يؤدي ذلك إلى تسهيل مقارنة مطالبات المزودين.
التركيز على النظام برمته هو أيضا نتيجة لذلك. قد يؤدي اختبار استجابات النموذج فقط إلى تفويت نقاط الضعف في التطبيق من حوله: قد يتم الكشف عن التسلسل الهرمي للتعليمات، أو قد يكون مصدر الاسترجاع مسمومًا، أو قد يكون لدى الأداة المتصلة أذونات زائدة، أو قد يؤدي المخرج إلى تشغيل إجراء غير آمن. لا يُبلغ المصدر عن أي ثغرة أمنية محددة أو نتيجة اختبار من النظام الجديد، لذلك فهو لا يوضح أن إطار العمل قد وجد مثل هذه الإخفاقات أو منعها. ويذكر نطاق الاعتماد ووظيفة الضمان المقصودة.
يمكن أن يؤثر الإطار أيضًا على ما يوثقه مقدمو الخدمة. يقول SecurityBrief Asia إن CREST سيقوم بتقييم الحوكمة وضوابط الجودة والعمليات والأدلة بالإضافة إلى المهارات الفنية. وقد يشجع هذا التركيز الشركات على شرح كيفية اختيار حالات الاختبار، وكيفية التحقق من صحة النتائج، وكيفية تسجيل القيود، وكيفية دعم الاستنتاجات. بالنسبة للعملاء، قد يكون هذا أكثر فائدة من الادعاء الصريح بأن مقدم الخدمة لديه خبرة في الذكاء الاصطناعي. ولا يذكر التقرير طريقة التسجيل أو عتبة النجاح أو دورة إعادة التقييم أو التوفر العام لتقارير التقييم.
يعد التمييز بين معيار اختبار الاختراق الممكّن للذكاء الاصطناعي لشهر يوليو وهذا الاعتماد الجديد أمرًا مهمًا. يتعلق أحدهما باستخدام الذكاء الاصطناعي من قبل مزود الاختبار؛ ويتعلق الآخر بقدرة مقدم الخدمة على اختبار أنظمة الذكاء الاصطناعي. يمكن أن تنطوي هذه الأنشطة على مخاطر وكفاءات مختلفة. قد تستخدم إحدى الشركات الذكاء الاصطناعي لتسريع العمل الأمني التقليدي دون أن تكون مؤهلة لتقييم سلوك النموذج أو خطوط الاسترجاع أو تكامل الأدوات الشبيهة بالوكيل. وعلى العكس من ذلك، فإن اعتماد اختبار الذكاء الاصطناعي لن يثبت في حد ذاته أن كل مشاركة ذات نطاق جيد أو أن عملية نشر معينة آمنة.
ويظل التأثير العام غير مؤكد لأن المصدر لا يحتوي على مشتري أو منظم أو تقييم أكاديمي مستقل. يُظهر الدعم المبلغ عنه من أعضاء CREST أن مقدمي الخدمات المشاركين يرون قيمة في المخطط، لكنه لا يثبت قبول السوق. كما لا توضح المقالة أن الاعتماد يقلل من الحوادث، أو يحسن اكتشاف الثغرات الأمنية، أو يؤدي إلى نتائج متسقة عبر مقدمي الخدمة. وينبغي لهذه الأشياء المجهولة أن تخفف من أي ادعاء بأن الإطلاق يرسي معيارًا جديدًا للجودة على مستوى الصناعة.
الآلية التفاعلية: كيف تعمل فعليًا
استكشف التكنولوجيا الأساسية وراء هذا التطور بشكل تفاعلي.
crm_get_transaction(id='4092').Why can ethical evaluation not be reduced to one model score?
ماذا تشاهد بعد ذلك
الأسئلة الرئيسية هي ما إذا كان المشترون يحتاجون إلى الاعتماد، وكيف يقوم CREST بتقييم مقدمي الخدمة في الممارسة العملية، وما إذا كان المعيار ينتج جودة اختبار قابلة للمقارنة عبر البائعين. ولا يقدم التقرير المعيار الكامل أو نتائج التقييم أو الجدول الزمني للتنفيذ أو الاستجابات المستقلة من المشترين والمنظمين.
القضية الأولى التي يجب مراقبتها هي اعتماد المشترين. تحدد SecurityBrief Asia العناية الواجبة بالمشتريات والموردين كأهداف مركزية، لكنها لا تذكر ما إذا كانت المنظمات الكبرى تتطلب الاعتماد في المناقصات أو العقود. إن الأدلة التي تشير إلى أن المشترين يستخدمونها لتمييز مقدمي الخدمات من شأنها أن تظهر أن المخطط أصبح أكثر من مجرد أوراق اعتماد مهنية طوعية. وبدون استيعاب المشتري، قد يكون الاعتماد في المقام الأول بمثابة إشارة داخل سوق خدمات الأمن السيبراني.
والمسألة الثانية هي الشفافية بشأن التقييم. ويذكر التقرير مجالات واسعة للتقييم ولكنه لا يوفر الضوابط التفصيلية للمعيار أو إجراءات الاختبار أو متطلبات الأدلة أو معايير النجاح. يجب أن يبحث المراقبون عن معلومات حول كيفية فحص CREST لكفاءة مقدمي الخدمة، وعدد مرات تجديد الاعتماد، وكيفية إدارة تضارب المصالح وما إذا كان يتم الكشف عن التقييمات الفاشلة أو المقيدة. ستساعد هذه التفاصيل في تحديد مقدار الثقة التي يمكن أن يدعمها الاعتماد بشكل معقول.
المسألة الثالثة هي التغطية الفنية. تختلف عمليات نشر الذكاء الاصطناعي بشكل كبير، بدءًا من ميزات نماذج اللغة البسيطة وحتى الأنظمة ذات الاسترجاع والذاكرة والأدوات الخارجية وواجهات برمجة التطبيقات والإجراءات التلقائية النهائية. يعد نطاق النظام بأكمله الذي تم الإبلاغ عنه من قبل CREST واسعًا، لكن المقالة لا تشرح كيف ستتعامل التقييمات مع الاختلافات في البنية أو الوصول إلى النموذج أو حساسية البيانات أو التأثير التشغيلي. يمكن أن توضح الإرشادات المستقبلية أو دراسات الحالة المنشورة ما إذا كان المعيار عمليًا عبر هذه الإعدادات بدلاً من مجرد وصف شامل.
المسألة الرابعة هي أدلة النتيجة. ويقول أعضاء CREST المقتبسون في التقرير إن الإطار يمكن أن يخلق الاتساق ويعزز الثقة، لكن هذه مجرد توقعات وليست نتائج قابلة للقياس. قد تتضمن أدلة المتابعة المفيدة نتائج تقييم مجهولة المصدر، أو أمثلة على نقاط الضعف الخاصة بالذكاء الاصطناعي التي تم اكتشافها من خلال الاختبارات المعتمدة، أو مقارنات توضح أن مقدمي الخدمات المعتمدين يقدمون نتائج أكثر موثوقية. لا يوجد أي من هذه الأدلة في المصدر، ولا ينبغي التعامل مع الإطلاق كدليل على تحسن الأمن.
وأخيرًا، ستكون العلاقة مع أطر عمل أمن الذكاء الاصطناعي الأخرى مهمة. تصف المقالة برنامج ضمان الذكاء الاصطناعي الخاص بـ CREST ولكنها لا تناقش كيفية توافق اعتمادها مع التوجيهات الحكومية أو القواعد الخاصة بالقطاع أو معايير الاختبار الأخرى. قد يحتاج المشترون إلى دمجها مع تقييمات المخاطر وممارسات التطوير الآمنة وضوابط الوصول والمراقبة والمراجعة البشرية. تقرير SecurityBrief Asia عن عملية الإطلاق والدور المقصود منها؛ ولا تؤكد بشكل مستقل مدى الوصول النهائي للبرنامج أو فعاليته أو الاعتراف التنظيمي به أو الجدول الزمني لتقييمات مقدمي الخدمة.