ماذا حدث
ذكرت صحيفة South China Morning Post أن باحثين من الجامعات وشركات التكنولوجيا الصينية نشروا ورقة بحثية تصف خمس مراحل من التحسين الذاتي المتكرر، بدءًا من تنفيذ الترقيات التي صممها الإنسان إلى التحسين المستمر للطرق المستخدمة لتحسين أنظمة الذكاء الاصطناعي. تعرض الورقة هذا باعتباره اتجاهًا بحثيًا، وليس منتجًا مثبتًا.
ذكرت صحيفة ساوث تشاينا مورنينج بوست أن باحثين من بايت دانس، وجامعة تسينغهوا، ومختبر الذكاء الاصطناعي في شنغهاي ومؤسسات أخرى نشروا "آخر ذكاء اصطناعي بناه البشر: نحو تحسين ذاتي عودي حقيقي". تحدد الورقة خمس مراحل تقدمية للتحسين الذاتي العودي، أو RSI. في البداية، سينفذ الذكاء الاصطناعي إجراءات التحسين التي صممها المهندسون البشريون. بعد ذلك، يقوم باختيار استراتيجيات الترقية، وتحديد المعلومات أو الخبرة التي يحتاجها، والتكيف بعد النشر، وفي نهاية المطاف تحسين الأساليب المستخدمة لتحسين الذكاء الاصطناعي نفسه.
يميز التقرير مؤشر القوة النسبية (RSI) عن برنامج الدردشة الآلي الذي يقوم بتصحيح استجابة واحدة. لكي يتم تأهيل التحسين كمؤشر القوة النسبية (RSI)، يجب أن يستمر التغيير إلى ما بعد مهمة واحدة وأن ترثه الأنظمة اللاحقة. يرى الباحثون أن أتمتة أجزاء من التدريب والتقييم والضبط الدقيق يمكن أن تقصر دورات التطوير وتقلل من تكاليف العمالة والحوسبة، لكن هذه هي ادعاءات المؤلفين وليست نتائج مثبتة بشكل مستقل في التقرير المرفق.
ويصف المقال أيضًا الجهود ذات الصلة التي تبذلها الشركات الصينية. يقال إن Z.ai تخطط لتوجيه حوالي 60 بالمائة من عائدات جولة جمع الأموال البالغة 5 مليارات دولار أمريكي نحو نماذج GLM من الجيل التالي ونظام التدريب الذاتي. وبحسب ما ورد وصف الباحثون المرتبطون بـ MiniMax 2.7 تحديثات الذاكرة وتجارب التعلم المعزز، في حين ورد أن DeepSeek طور أداة مساعدة للمهام متعددة الخطوات وتنفيذ التعليمات البرمجية والتفاعل الخارجي للبرامج. لا تثبت هذه الأمثلة أن أي شركة قد حققت مرحلة مؤشر القوة النسبية النهائية للورقة.
لماذا يهم
يمكن أن تؤثر أتمتة أجزاء من أبحاث الذكاء الاصطناعي على مدى سرعة قيام المطورين بتدريب النماذج المستقبلية بتكلفة زهيدة، مع نقل المزيد من التحكم في تحسين النماذج من الأشخاص إلى أنظمة الذكاء الاصطناعي. يسلط الاقتراح الضوء أيضًا على أحد التحديات المركزية المتعلقة بالسلامة: فالأنظمة التي تغير عمليات التحسين الخاصة بها قد تتطلب اختبارات ومراقبة موثوقة قبل النشر. ولا يقدم التقرير أي دليل على أن المراحل النهائية قد تم إنجازها.
إذا كانت الأنظمة التي تعمل على أتمتة أجزاء من أبحاث الذكاء الاصطناعي موثوقة، فمن الممكن أن تصبح ميزة تنافسية من خلال السماح للمطورين بإجراء المزيد من التجارب وتحسين النماذج بالاستعانة بقدر أقل من العمالة البشرية المباشرة. ويمكن أن يؤثر ذلك على وتيرة وتكلفة تطوير نموذج الأساس، على الرغم من أن التقرير لا يقدم قياسات مستقلة لتلك التأثيرات.
الاقتراح له أيضًا أهمية بالنسبة لسلامة الذكاء الاصطناعي. يقول الباحثون إن مؤشر RSI الحقيقي سيتطلب ضمانات صارمة وبيئات اختبار تم التحقق منها حتى تظهر أن التحديثات آمنة ومفيدة قبل النشر. لا يتحقق التقرير المقدم بشكل مستقل من خارطة الطريق أو ادعاءات الشركة ذات الصلة أو فعالية أي ضمانات مقترحة.
الآلية التفاعلية: كيف تعمل فعليًا
استكشف التكنولوجيا الأساسية وراء هذا التطور بشكل تفاعلي.
crm_get_transaction(id='4092').Which component of an AI application is the machine-learning model itself?
ماذا تشاهد بعد ذلك
لا تقدم الورقة أي جدول زمني للوصول إلى التحسين الذاتي العودي الحقيقي. لا يوجد وصول موثق للمنتج أو التسعير أو التوفر العام. تشمل الأمور الرئيسية المجهولة ما إذا كانت المراحل المقترحة يمكن أن تعمل بشكل موثوق خارج هندسة البرمجيات، ومقدار الحوسبة التي تتطلبها، وما إذا كانت الضمانات يمكنها اكتشاف التحديثات الضارة أو غير الفعالة.
ولم يقدم الباحثون أي جدول زمني لتحقيق مؤشر القوة النسبية الحقيقي، ولم تذكر صحيفة ساوث تشاينا مورنينج بوست أن نظام العمل قد وصل إلى المرحلة النهائية. لم يتم تحديد إمكانية الوصول إلى البحث الموصوف، ولم يتم توثيق أي أسعار للمنتج أو توفره بشكل عام.
قد يختلف التقدم بشكل كبير حسب المجال. ويقال إن المؤلفين ينظرون إلى هندسة البرمجيات باعتبارها مسارًا أكثر وضوحًا، في حين تمثل الروبوتات والاكتشافات العلمية تحديات تقنية أصعب. يعد توفر الحوسبة أحد القيود الأخرى: يقتبس التقرير من أحد الخبراء قوله إن الشركات الأمريكية لا تزال متقدمة بعدة أشهر ولديها حوسبة نشر أكبر، بينما يواصل الباحثون الصينيون التحسين في ظل قيود الأجهزة.
يجب أن تحدد التقارير المستقبلية ما إذا كانت أنظمة التدريب الذاتي المطالب بها تنتج تحسينات مستمرة وقابلة للتكرار، وكيفية تقييم التحديثات، وما إذا كانت الموافقة البشرية لا تزال مطلوبة. لا يتم توفير نتائج اختبار مستقلة في المصدر المرفق.