آئینی AI
آئینی AI Anthropic کا اصولوں کے تحریری سیٹ کا استعمال کرتے ہوئے ماڈلز کو ترتیب دینے کا طریقہ ہے - ایک 'آئین' - لہذا AI نقصان دہ مواد کو لیبل کرنے کے لیے صرف انسانوں پر انحصار کرنے کے بجائے اپنے جوابات پر تنقید اور نظر ثانی کرتا ہے۔
جائزہ
It aims to make models helpful and harmless with far less human labor.
گہرا غوطہ
روایتی صف بندی انسانی تاثرات (RLHF) سے کمک سیکھنے پر انحصار کرتی ہے، جہاں لوگ ماڈل کو یہ سکھانے کے لیے کہ کس چیز سے بچنا ہے، بہت سارے ماڈل آؤٹ پٹس کی درجہ بندی کرتے ہیں، بشمول پریشان کن۔ آئینی AI ماڈل کو اقوام متحدہ کے انسانی حقوق کے اعلامیہ اور اعتماد اور حفاظت کے بہترین طریقوں جیسے ذرائع سے اخذ کردہ تحریری اصولوں کی ایک واضح فہرست دے کر اس بوجھ کو کم کرتا ہے۔ تربیت کے دو مراحل ہوتے ہیں۔ سب سے پہلے، ایک زیر نگرانی مرحلہ: ماڈل ایک ردعمل پیدا کرتا ہے، پھر اس پر آئینی اصول کے خلاف تنقید کرتا ہے اور اسے بہتر بنانے کے لیے دوبارہ لکھتا ہے۔ یہ خود بہتر جوابات اسے ٹھیک کرنے کے لیے استعمال کیے جاتے ہیں۔ دوسرا، ایک کمک سیکھنے کا مرحلہ، RLAIF، جہاں ماڈل خود آئین کے مطابق جوابات کے جوڑے کی درجہ بندی کرتا ہے، اور یہ کہ AI سے تیار کردہ ترجیحی ڈیٹا ایک انعامی ماڈل کو تربیت دیتا ہے۔ اصول شفاف اور قابل تدوین ہیں، مبہم انسانی لیبلز کے اندر چھپنے کی بجائے ماڈل کو دیکھنے کے قابل بنتے ہیں۔
تکنیکی بصیرت
دو مراحل کو اکثر SL-CAI اور RL-CAI کہا جاتا ہے۔ زیر نگرانی سیکھنے میں، ایک 'تنقید اور نظر ثانی' لوپ ماڈل کو یہ معلوم کرنے کا اشارہ کرتا ہے کہ اس کا اپنا جواب نمونے کے اصول کی کہاں خلاف ورزی کرتا ہے اور اسے دوبارہ لکھتا ہے، جس سے انسانی نقصان کے لیبلنگ کے بغیر تربیتی ڈیٹا تیار ہوتا ہے۔ RL مرحلے میں، دوسرا ماڈل فیصلہ کرتا ہے کہ دو جوابات میں سے کون بہتر آئین کی پیروی کرتا ہے، AI ترجیحی لیبلز (RLAIF) تیار کرتا ہے جو معیاری RL میں استعمال ہونے والے انعامی ماڈل کو تربیت دیتا ہے۔ آئین سادہ متن کی رہنمائی ہے جو اشارے میں داخل کی گئی ہے، لہذا ماڈل کے طرز عمل کو تبدیل کرنا اصولوں میں ترمیم کرنے جیسا ہی براہ راست ہو سکتا ہے۔
اسٹریٹجک اثر
رفتار اور پیمانہ
زبان کے کام کے بہاؤ مستقل مزاجی کی قربانی کے بغیر تیزی سے آگے بڑھ سکتے ہیں۔
رسائی اور رسائی
یہ زبانوں اور مواصلاتی طرزوں تک رسائی کو بڑھاتا ہے۔
واضح فیصلے
ٹیمیں فیصلے پر زیادہ وقت گزار سکتی ہیں جبکہ آٹومیشن تکرار کو سنبھالتی ہے۔
آئینی AI کا مستقبل
آئینی AI 'اسکیل ایبل نگرانی' کی طرف اشارہ کرتا ہے، جہاں AI AI کی نگرانی میں مدد کرتا ہے کیونکہ ماڈلز انسانوں کے لیے ہر آؤٹ پٹ کو چیک کرنے کے قابل ہو جاتے ہیں۔ مزید امیر، زیادہ اہم آئین، عوامی اور شراکتی ان پٹ کی توقع کریں جن میں اصولوں کا انتخاب کیا گیا ہے (Anthropic نے 'اجتماعی آئینی AI' تجربات چلائے ہیں)، اور ہائبرڈ نقطہ نظر AI خود تنقید کے ساتھ انسانی تاثرات کو ملاتا ہے۔ تحریری اصولوں کی شفافیت اس کو ریگولیٹرز اور آڈیٹرز کے لیے پرکشش بناتی ہے جو نظام ان کوڈ کردہ اقدار کو دیکھنا چاہتے ہیں۔ جیسے جیسے فرنٹیئر ماڈلز آگے بڑھیں گے، ایسے طریقے جو ماڈلز کو قابل اعتماد طریقے سے تنقید کرنے اور واضح قوانین کے خلاف خود کو بہتر بنانے کی اجازت دیتے ہیں ممکنہ طور پر حفاظت کا مرکز بن جائیں گے۔
حقیقی دنیا کا نفاذ
ایک چیٹ بوٹ کو تربیت دینا کہ وہ ہتھیار بنانے میں مدد کرنے سے انکار کرے اور اسے نقصان سے بچنے کے اصول کے خلاف اس کے اپنے مسودے کے جواب پر تنقید کرے اور اسے دوبارہ لکھے۔
زہریلے آؤٹ پٹس کی مہنگی انسانی ریڈ ٹیم لیبلنگ کو AI سے تیار کردہ ترجیحی ڈیٹا (RLAIF) سے تبدیل کرنا جس کی رہنمائی آئین کے ذریعے کی گئی ہے۔
ایک تحریری اصول میں ترمیم کرنا اس بات کو ایڈجسٹ کرنا کہ ماڈل کتنا محتاط ہے، پھر ہزاروں مثالوں کو ری لیبل کیے بغیر رویے کی تبدیلی کا مشاہدہ کرنا
اجتماعی ان پٹ مشقیں چلانا جہاں عوام ایسے اصول تجویز کرتے ہیں جو ماڈل کے آئین کو تشکیل دیتے ہیں۔
خطرات اور گارڈریلز
گمراہ شدہ حقائق خاموشی سے رپورٹس، سپورٹ فلو، یا تحقیقی نتائج درج کر سکتے ہیں۔
فوری حساسیت اسی طرح کی درخواستوں میں متضاد نتائج پیدا کر سکتی ہے۔
اگر رسائی کے کنٹرول کمزور ہیں تو حساس ٹیکسٹ ڈیٹا کو بے نقاب کیا جا سکتا ہے۔
نفاذ کا روڈ میپ
رول آؤٹ سے پہلے آؤٹ پٹ فارمیٹ، ٹون اور معیار کے معیارات کی وضاحت کریں۔
جب بھی درستگی اہمیت رکھتی ہے تو بھروسہ مند ذرائع کے ساتھ زمینی جوابات۔
ہائی اسٹیک آؤٹ پٹس کے لیے ایک انسانی جائزہ چیک پوائنٹ رکھیں۔
ناکامی کے نمونوں کو ٹریک کریں اور پرامپٹس یا ورک فلو کو باقاعدگی سے دوبارہ تربیت دیں۔
دریافت کرتے رہیں
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Constitutional AI quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
اگلا گائیڈ
انسٹرکشن ٹیوننگ
اکثر پوچھے گئے سوالات
What is Constitutional AI?
آئینی AI Anthropic کا اصولوں کے تحریری سیٹ کا استعمال کرتے ہوئے ماڈلز کو ترتیب دینے کا طریقہ ہے - ایک 'آئین' - لہذا AI نقصان دہ مواد کو لیبل کرنے کے لیے صرف انسانوں پر انحصار کرنے کے بجائے اپنے جوابات پر تنقید اور نظر ثانی کرتا ہے۔ اس کا مقصد بہت کم انسانی محنت کے ساتھ ماڈلز کو مددگار اور بے ضرر بنانا ہے۔
آئینی AI میں 'آئین' کیا ہے؟
آئین تحریری اصولوں کا ایک شفاف مجموعہ ہے، جو انسانی حقوق کی دستاویزات جیسے ذرائع سے اخذ کیا گیا ہے، جسے ماڈل اپنے جوابات کا جائزہ لینے اور بہتر بنانے کے لیے استعمال کرتا ہے۔
آئینی AI کا مقصد معیاری RLHF کے ساتھ کس اہم مسئلہ کو کم کرنا ہے؟
اصولوں کے خلاف ماڈل پر تنقید کرنے سے، آئینی AI پریشان کن یا نقصان دہ نتائج کا جائزہ لینے اور لیبل لگانے کی انسانی محنت کو کم کرتا ہے۔
آئینی AI کے زیر نگرانی مرحلے میں، ماڈل اپنی پیداوار کا کیا کرتا ہے؟
ماڈل تنقید اور نظر ثانی کا لوپ چلاتا ہے: یہ اس بات کی نشاندہی کرتا ہے کہ اس کا مسودہ نمونے کے اصول کی کہاں خلاف ورزی کرتا ہے، پھر جواب کو دوبارہ لکھتا ہے، خود بہتر تربیتی ڈیٹا بناتا ہے۔
کمک سیکھنے کے مرحلے میں RLAIF کا کیا مطلب ہے؟
RLAIF کا مطلب ہے Reinforcement Learning from AI Feedback: ایک ماڈل آئین کے مطابق جوابات کی درجہ بندی کرتا ہے، انسانی لیبلز کی بجائے AI سے تیار کردہ ترجیحی ڈیٹا تیار کرتا ہے۔
تحریری اصولوں کے استعمال کو شفافیت کے لیے فائدہ کیوں سمجھا جاتا ہے؟
چونکہ رہنما اقدار لکھی گئی ہیں، ان کا معائنہ، آڈٹ، اور براہ راست ترمیم کی جا سکتی ہے، ان ترجیحات کے برعکس جو بکھری ہوئی انسانی درجہ بندیوں میں واضح طور پر انکوڈ کی گئی ہیں۔