کیا ہوا؟
OpenAI نے 10 اگست کو اپنے ڈے بریک پروگرام کو دفاعی کام اور جدید سیکیورٹی ریسرچ کے لیے علیحدہ رسائی کے درجات کے ساتھ بڑھایا، بشمول ایک خصوصی GPT-5.6-سائبر ماڈل۔
ڈے بریک بلیو منظور شدہ محافظوں کو GPT-5.6 سول فراہم کرتا ہے جس میں سسٹم لیول سائبر فلٹرز کو کام کے لیے ہٹا دیا جاتا ہے جیسے کہ محفوظ کوڈ کا جائزہ، مالویئر کا تجزیہ، واقعہ کا ردعمل، خطرے کی دریافت، اور پیچ کی توثیق۔ ڈے بریک ریڈ نے مجاز استحصال کی توثیق، دخول کی جانچ، اور دیگر دوہری استعمال کی تحقیق کے لیے GPT-5.6-سائبر کا اضافہ کیا ہے جسے عام ماڈل اب بھی انکار کر سکتا ہے۔
OpenAI کا کہنا ہے کہ GPT-5.6-Cyber نے اپنی داخلی اعلی درجے کی سائبرسیکیوریٹی تکمیل کی شرح کی تشخیص میں 95% درخواستیں مکمل کیں، اس کے مقابلے معیاری GPT-5.6 Sol کے لیے 1.5%، ڈے بریک بلیو کے ذریعے Sol کے لیے 2%، اور ZXQY1-57.3% کمپنی کا کہنا ہے کہ یہ ٹیسٹ ایکسپلائٹ چین ڈیولپمنٹ، توثیق بائی پاس، اور استحقاق میں اضافے جیسے منظرناموں کا احاطہ کرتا ہے۔ اس نے تشخیص کا سیٹ جاری نہیں کیا ہے۔
کمپنی نے پہلے سے نامعلوم V8 کمزوریوں کو دریافت کرنے میں مدد کے لیے ماڈل کے استعمال کی بھی اطلاع دی ہے جنہیں ایک ساتھ جکڑا جا سکتا ہے۔ Google نے پہلا CVE-2026-15903 تفویض کیا اور اسے کروم 150 میں پیچ کیا۔ Google کی ریلیز ایڈوائزری آزادانہ طور پر اس بات کی تصدیق کرتی ہے کہ V8 میں پڑھنے اور لکھنے کی اجازت دینے والے اعلی درجے کی خرابی کی اجازت دی گئی ہے، حالانکہ یہ AI کو اس طرح کی مدد نہیں کرتا ہے کہ یہ سسٹم کو تلاش کرتا ہے۔
OpenAI GPT-5.6-سائبر کو GPT-5.6 Sol پر بنایا گیا ایک ماڈل کے طور پر بیان کرتا ہے اور غیر محدود جارحانہ استعمال کے بجائے منتخب اعلی خطرے والے، دوہری استعمال کے کاموں کے لیے تربیت یافتہ ہے۔ ڈے بریک ریڈ صرف ان منظور شدہ افراد اور تنظیموں کے لیے دستیاب ہے جو مجاز کام کر رہے ہیں، شناخت کی تصدیق، اکاؤنٹ کی حفاظت، نگرانی، منظور شدہ استعمال کی پابندیاں، اور قانونی تصدیق کے ساتھ۔ اعلان میں یہ بھی کہا گیا ہے کہ انفرادی ڈے بریک اکاؤنٹس کو 1 ستمبر 2026 سے ہارڈویئر سیکیورٹی کیز کی ضرورت ہوگی۔
ماخذ کی تفصیلات: OpenAI's GPT-5.6-Cyber and Daybreak announcement ↗
یہ کیوں اہمیت رکھتا ہے۔
ریلیز ایک فرنٹیئر ماڈل کی زیادہ خطرناک سائبر صلاحیتوں کو ایک چھوٹی ریسرچ سیٹنگ سے ایک گورنڈ ایکسس پروگرام میں لے جاتی ہے، یہ جانچتی ہے کہ حملہ آوروں میں وہی تکنیک پھیلنے سے پہلے محافظ انہیں وصول کر سکتے ہیں۔
انکار کو کم کرنا پروڈکٹ میں مرکزی حیثیت رکھتا ہے: ایک ایسا ماڈل جو حقیقت پسندانہ استحصالی کام کو مسترد کرتا ہے عام استعمال کے لیے زیادہ محفوظ ہو سکتا ہے لیکن ان ٹیموں کے لیے کم کارآمد ہو سکتا ہے جنھیں ترجیح دینے اور اسے ٹھیک کرنے سے پہلے کسی خطرے کو دوبارہ پیدا کرنا چاہیے۔ ڈے بریک وسیع تر دفاعی کاموں کو ہر صارف کے سامنے ایک پالیسی کو ظاہر کرنے کے بجائے زیادہ خطرے والے استحصالی ترقی سے الگ کرتا ہے۔
V8 کا انکشاف اس بات کا ٹھوس ثبوت ہے کہ AI کی مدد سے کمزوری کی تحقیق تعینات سافٹ ویئر تک پہنچ سکتی ہے۔ یہ خود مختار دفاع کے دعوے سے بھی تنگ ہے: OpenAI کا کہنا ہے کہ اس کے محققین نے Google کے ساتھ نتائج اور مربوط انکشاف کی توثیق کی، جب کہ عوامی Chrome ایڈوائزری مکمل تحقیقی عمل میں ماڈل کے کردار کی بجائے پیچیدہ خامیوں کو ریکارڈ کرتی ہے۔
OpenAI سیکورٹی کنسلٹنسیز اور ٹیکنالوجی فراہم کنندگان کے ذریعے ڈے بریک کو بھی بڑھا رہا ہے۔ منظور شدہ پارٹنرز بنیادی ماڈلز تک رسائی رکھتے ہیں اور انہیں کسٹمر کی مصروفیات میں لاگو کرتے ہیں، ایسے کنٹرول کے ساتھ جن میں شناخت کی تصدیق، متعین دائرہ کار، لاگنگ، نگرانی اور انسانی جائزہ شامل ہو سکتے ہیں۔
وہ پارٹنر ڈیزائن تبدیل کرتا ہے جسے فیصلے کا آخری میل فراہم کرنا ہوتا ہے۔ OpenAI کا کہنا ہے کہ بنیادی ماڈل تک رسائی براہ راست کسی صارف کو منتقل نہیں کی جاتی ہے۔ ایک پارٹنر مصروفیت کی وضاحت کرتا ہے، نتائج کا جائزہ لیتا ہے، اور کارروائی سے پہلے اپنی حفاظتی مہارت کا اطلاق کرتا ہے۔ عملی طور پر، ایک کارآمد تعیناتی اس لیے پارٹنر کی قابلیت پر منحصر ہے کہ وہ قابل تولید خامی کو قیاس آرائی پر مبنی ماڈل کی تجویز سے الگ کر سکتا ہے، متفقہ دائرہ کار کے اندر جانچ جاری رکھتا ہے، اور حقیقی سافٹ ویئر کی دیکھ بھال کے عمل کے ذریعے تصدیق شدہ حل کو منتقل کرتا ہے۔
انٹرایکٹو میکانزم: یہ اصل میں کیسے کام کرتا ہے۔
اس ترقی کے پیچھے بنیادی ٹیکنالوجی کو انٹرایکٹو طریقے سے دریافت کریں۔
What is an adversarial example in machine learning security?
آگے کیا دیکھنا ہے۔
وعدہ کردہ سسٹم کارڈ، آزاد بینچ مارک پنروتپادن، دیگر رپورٹ شدہ خطرات کے مکمل انکشاف، اور اس بات کا ثبوت دیکھیں کہ رسائی کنٹرول غلط استعمال کا مقابلہ کرتے ہیں۔
اعلان میں کارکردگی کے زیادہ تر اعداد و شمار OpenAI کے ایڈوانسڈ سائبر سیکیورٹی مکمل ہونے کی شرح، ایکسپلوٹ جیم، ایکسپلوئٹ بینچ، اور خطرے کی رپورٹنگ کے جائزوں کے اندرونی نفاذ سے آتے ہیں۔ کمپنی کا کہنا ہے کہ GPT-5.6-Cyber ہر موازنہ جیت نہیں پایا: GPT-5.6 Sol نے ایک تشخیص پر بہتر رپورٹس تیار کیں اور معیاری 300-ٹرن ایکسپلوٹ بینچ کی ترتیب کو زیادہ موثر طریقے سے حل کیا۔
OpenAI اپنی تیاری کے فریم ورک کے تحت سائبر سیکیورٹی کی صلاحیت کے لیے GPT-5.6-سائبر کو ہائی پر، لیکن کریٹیکل سے نیچے دیتا ہے۔ اس کا کہنا ہے کہ ایک فلر سسٹم کارڈ بعد میں آئے گا۔ جب تک کہ طریقوں اور نتائج کو دوبارہ پیش کرنے کے لیے کافی تفصیل سے شائع نہیں کیا جاتا، اعلان حقیقی دنیا کی جارحانہ صلاحیت کے ایک آزاد اقدام کے بجائے منسوب کمپنی کے دعووں کی حمایت کرتا ہے۔
سیفٹی کیس کا انحصار آپریشنز پر ہوتا ہے جتنا کہ تربیت۔ انفرادی ڈے بریک اکاؤنٹس کو 1 ستمبر سے ہارڈویئر سیکیورٹی کیز کو اپنانا چاہیے، اور OpenAI الگ تھلگ ماحول، دائرہ کار کی اجازت، نگرانی شدہ ایجنٹ کی کارروائیوں اور انسانی نگرانی کی سفارش کرتا ہے۔ مفید فالو اپ رپورٹنگ میں پروگرام کے پھیلنے کے ساتھ ہی رسائی کی منسوخی، غلط استعمال کا پتہ لگانے، انکشاف کی ٹائم لائنز، پیچ کے نتائج، اور غلط مثبتات کو دکھانا چاہیے۔
سرخی کی تکمیل کی شرح کے موازنہ میں پیمائش کی ایک اہم انتباہ بھی ہے۔ OpenAI کا کہنا ہے کہ ہر ماڈل کو عوامی طور پر دستیاب استدلال کی بلند ترین سطح پر چلایا گیا تھا، اور نوٹ کرتا ہے کہ GPT-5.6-سائبر GPT-5.6 Sol کے مقابلے میں ایک بڑا استدلال بجٹ اور زیادہ ٹوکن استعمال کرتا ہے۔ اس لیے تکمیل کی ایک اعلی شرح خصوصی تربیت اور حساب کی مختلف مقدار دونوں کی عکاسی کر سکتی ہے۔ آزاد ٹیسٹوں کو مماثل بجٹ، کام کی تعمیر، انکار کے معیار، اور غیر محفوظ یا ناقابل استعمال جوابات کی شرح کی اطلاع دینی چاہیے بجائے اس کے کہ کوئی جواب پیش کیا گیا ہو۔
پروگرام کے ایک بالغ اکاؤنٹ کو پورے خطرے کے لائف سائیکل پر عمل کرنے کی ضرورت ہوگی۔ اس کا مطلب یہ ہے کہ یہ رپورٹ کرنا کہ ماڈل سے تیار کردہ لیڈ انسانی تولید میں کتنی بار بچتا ہے، کتنے نتائج ڈپلیکیٹ ہیں یا کم شدت، دکانداروں کو کتنی جلدی قابل عمل رپورٹس موصول ہوتی ہیں، اور آیا عوامی انکشاف سے پہلے پیچ کو تعینات کیا جاتا ہے۔ اس میں یہ بھی بتانا چاہیے کہ جب کسی پارٹنر کا گاہک ماڈل سے جانچ کی حد عبور کرنے کے لیے کہتا ہے، جب کسی ایجنٹ کا پروڈکشن اسناد کا سامنا ہوتا ہے، یا جب مجوزہ استحصال کی براہ راست توثیق کرنے کے لیے بہت خطرناک ہوتا ہے تو کیا ہوتا ہے۔ یہ کنٹرول اس بات کا تعین کرتے ہیں کہ آیا انکار کی کم شرحیں محض دوہری استعمال کوڈ کی فراہمی کو بڑھانے کے بجائے قابل پیمائش دفاعی قدر پیدا کرتی ہیں۔
عوام کو بھی ایک ماڈل کی صلاحیت کو کسٹمر کی اجازت سے الگ کرنے کے قابل ہونا چاہئے۔ OpenAI کے رسائی کے قوانین ماڈل کے ارد گرد قانونی تصدیق، شناخت کی جانچ، نگرانی، اور دائرہ کار کا کام کرتے ہیں، لیکن ان کنٹرولز کو وقت کے ساتھ ساتھ جانچے جانے کا دعویٰ ہے۔ وقوعہ کی رپورٹنگ میں یہ کہنا چاہیے کہ آیا کسی درخواست کو بلاک کیا گیا تھا، نظرثانی کے لیے بڑھایا گیا تھا، یا کسی دستاویزی مصروفیت کے تحت اجازت دی گئی تھی، استحصال کی تفصیلات کو ظاہر کیے بغیر، جس سے بغیر پیچ والے نظام پر حملہ کرنا آسان ہو جائے گا۔