ٹرانسفر لرننگ
ٹرانسفر لرننگ ایک بڑے ڈیٹاسیٹ پر پہلے سے تربیت یافتہ ماڈل کو دوبارہ استعمال کرتی ہے اور اسے ایک نئے، متعلقہ کام میں ڈھال لیتی ہے۔
جائزہ
Instead of starting from scratch, you stand on the shoulders of a model that already learned useful general features, saving enormous time, data, and compute.
گہرا غوطہ
صفر سے مضبوط ماڈل کی تربیت کے لیے اکثر لاکھوں لیبل شدہ مثالوں اور سنجیدہ ہارڈ ویئر کی ضرورت ہوتی ہے۔ سیکھنے کے پہلوؤں کو منتقل کریں۔ ایک بڑے ڈیٹاسیٹ پر پہلے سے تربیت یافتہ ایک ماڈل، جیسے امیج نیٹ پر تربیت یافتہ تصویری نیٹ ورک یا ویب ٹیکسٹ پر تربیت یافتہ زبان کا ماڈل، پہلے ہی وسیع پیمانے پر مفید نمونے سیکھ چکا ہے: وژن کے لیے کنارے اور شکلیں، گرامر اور متن کے معنی۔ آپ پہلے سے تربیت یافتہ ماڈل لیتے ہیں اور اس کے علم کو اپنے چھوٹے، مخصوص مسئلے کے مطابق ڈھال لیتے ہیں۔ دو اہم طرزیں ہیں۔ فیچر نکالنے میں آپ زیادہ تر نیٹ ورک کو منجمد کرتے ہیں اور اوپر صرف ایک نئی آؤٹ پٹ پرت کو تربیت دیتے ہیں۔ فائن ٹیوننگ میں آپ کچھ گہری تہوں کو بھی غیر منجمد کرتے ہیں اور کم سیکھنے کی شرح پر ان کی تربیت جاری رکھتے ہیں تاکہ ماڈل آپ کے ڈیٹا کو یہ بھولے بغیر آہستہ سے ایڈجسٹ ہو جائے کہ اسے کیا معلوم تھا۔
تکنیکی بصیرت
پہلے سے تربیت یافتہ نیٹ ورک ایک درجہ بندی سیکھتے ہیں: ابتدائی پرتیں عمومی خصوصیات (کناروں، ساخت، بنیادی لفظی رشتوں) کو حاصل کرتی ہیں جبکہ بعد کی پرتیں کام سے متعلق مخصوص تصورات کو حاصل کرتی ہیں۔ ٹرانسفر لرننگ اس کا فائدہ اٹھاتی ہے۔ اگر آپ کا کام اصل سے ملتا جلتا ہے، تو ابتدائی تہوں کو ایک فکسڈ فیچر ایکسٹریکٹر کے طور پر منجمد کریں اور صرف سر کو دوبارہ تربیت دیں۔ اگر آپ کا ڈیٹا زیادہ مختلف ہے تو بہت کم سیکھنے کی شرح کا استعمال کرتے ہوئے گہری تہوں کو ٹھیک کریں تاکہ اپ ڈیٹس نرم ہوں۔ بڑا خطرہ ڈومین شفٹ ہے: اگر نیا ڈیٹا پہلے سے تربیتی ڈیٹا سے بہت مختلف نظر آتا ہے، تو ادھار لی گئی خصوصیات خراب فٹ بیٹھتی ہیں۔
اسٹریٹجک اثر
واضح فیصلے
یہ آپ کو مارکیٹنگ کی زبان سے واضح تکنیکی دعووں کو الگ کرنے میں مدد کرتا ہے۔
لاگت اور بجٹ
آپ پیسہ یا وقت خرچ کرنے سے پہلے بہتر نفاذ کے سوالات پوچھ سکتے ہیں۔
Team and workflow
مشترکہ تفہیم کے ساتھ ٹیمیں بہتر پروڈکٹ، پالیسی اور سیکھنے کے فیصلے کرتی ہیں۔
ٹرانسفر لرننگ کا مستقبل
ٹرانسفر لرننگ AI کی تعمیر کا طے شدہ طریقہ بن گیا ہے۔ آج تقریباً کوئی بھی بڑے وژن یا زبان کے ماڈل کو شروع سے تربیت نہیں دیتا ہے۔ ٹیمیں اس کے بجائے پہلے سے تربیت یافتہ فاؤنڈیشن ماڈل کو اپناتی ہیں۔ فرنٹیئر پیرامیٹر کے لحاظ سے موثر طریقے ہیں جیسے LoRA اور اڈاپٹر، جو بڑے ماڈلز کو سستے طریقے سے اپنی مرضی کے مطابق بنانے کے لیے وزن کے صرف ایک چھوٹے سے حصے کو موافقت دیتے ہیں۔ اس رجحان کے مزید گہرے ہونے کی توقع کریں: چھوٹے، خصوصی ماڈلز بڑے ماڈلز سے ڈسٹلڈ اور فائن ٹیونڈ، نیز ڈومین شفٹ کو کم کرنے اور 'تباہ کن بھولنے' سے بچنے پر توجہ مرکوز کرتے ہوئے جب کسی ماڈل کو بار بار ڈھال لیا جاتا ہے۔
حقیقی دنیا کا نفاذ
صرف چند ہزار تصاویر کے ساتھ فیکٹری پروڈکشن لائن پر مخصوص نقائص کا پتہ لگانے کے لیے امیج نیٹ سے پہلے سے تربیت یافتہ نیٹ ورک کو ٹھیک کرنا
ایک چھوٹے خصوصی کارپس پر ٹھیک ٹیوننگ کرکے قانونی یا طبی خلاصے کے مسودے کے لیے پہلے سے تربیت یافتہ زبان کے بڑے ماڈل کو اپنانا
کسی مخصوص لہجے یا بولی کے لیے شناخت کنندہ بنانے کے لیے عام تقریر پر تربیت یافتہ ماڈل کا استعمال
کاشتکاری ایپ کے لیے پتوں کی تصاویر سے پودوں کی بیماریوں کی درجہ بندی کرنے کے لیے وژن ماڈل کی آخری پرت کو دوبارہ تربیت دینا
خطرات اور گارڈریلز
مختلف ٹیمیں ایک ہی اصطلاح کو مختلف طریقے سے استعمال کر سکتی ہیں، اس لیے دائرہ کار کی جلد وضاحت کریں۔
بینچ مارکس مضبوط نظر آسکتے ہیں جبکہ حقیقی دنیا کی کارکردگی ناہموار ہے۔
ڈیٹا کے معیار اور تشخیص کے منصوبوں کو نظر انداز کرنا اکثر نازک نتائج پیدا کرتا ہے۔
نفاذ کا روڈ میپ
آپ کو مطلوبہ نتائج کی سادہ زبان کی تعریف کے ساتھ شروع کریں۔
جانچ کرنے سے پہلے ایک کامیابی میٹرک اور ایک ناکامی کی شرط منتخب کریں۔
نمائندہ ڈیٹا کے ساتھ ایک چھوٹا پائلٹ چلائیں، نہ کہ پالش شدہ ڈیمو سیٹ۔
دستاویز جہاں منتقلی سیکھنے میں مدد ملتی ہے اور جہاں آسان طریقے بہتر ہیں۔
دریافت کرتے رہیں
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Transfer Learning quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
اگلا گائیڈ
نیم زیر نگرانی لرننگ
اکثر پوچھے گئے سوالات
What is Transfer Learning?
ٹرانسفر لرننگ ایک بڑے ڈیٹاسیٹ پر پہلے سے تربیت یافتہ ماڈل کو دوبارہ استعمال کرتی ہے اور اسے ایک نئے، متعلقہ کام میں ڈھال لیتی ہے۔ شروع سے شروع کرنے کے بجائے، آپ ایک ایسے ماڈل کے کندھوں پر کھڑے ہیں جس نے پہلے سے ہی مفید عمومی خصوصیات سیکھ لی ہیں، بہت زیادہ وقت، ڈیٹا اور حساب کی بچت ہے۔
ٹرانسفر لرننگ کا بنیادی خیال کیا ہے؟
ٹرانسفر لرننگ ایک ایسا ماڈل لیتا ہے جو پہلے سے ہی عام خصوصیات کو سیکھتا ہے اور اسے اپناتا ہے، ڈیٹا، وقت اور حساب کی بچت کرتا ہے۔
گہری تہوں کو ٹھیک کرتے وقت آپ سیکھنے کی بہت کم شرح کیوں استعمال کرتے ہیں؟
چھوٹے ڈیٹاسیٹ پر بڑی اپ ڈیٹس قیمتی پہلے سے تربیت یافتہ خصوصیات کو اوور رائٹ کر سکتی ہیں اور تیزی سے اوور فٹ ہو سکتی ہیں، اس لیے اپ ڈیٹس کو چھوٹا رکھا جاتا ہے۔
سادہ فیچر نکالنے (بیس کو منجمد کرنے) کے لیے کون سی صورتحال بہترین ہے؟
جب ہدف کا کام اصل کے قریب ہوتا ہے اور ڈیٹا محدود ہوتا ہے، تو منجمد خصوصیات پہلے سے ہی متعلقہ ہوتی ہیں، اس لیے آپ کو صرف ایک نئے سر کی ضرورت ہوتی ہے۔
ٹرانسفر لرننگ میں 'ڈومین شفٹ' کس مسئلے کو بیان کرتا ہے؟
اگر ٹارگٹ ڈومین اس سے بہت مختلف نظر آتا ہے جس پر ماڈل کو پہلے سے تربیت دی گئی تھی، تو ہو سکتا ہے دوبارہ استعمال شدہ خصوصیات اچھی طرح سے منتقل نہ ہوں اور درستگی میں کمی آ جائے۔
پہلے سے تربیت یافتہ نیٹ ورک کی ابتدائی پرتیں اکثر بعد والے کے مقابلے میں زیادہ آسانی سے دوبارہ کیوں استعمال ہوتی ہیں؟
ابتدائی پرتیں وسیع پیمانے پر مفید نچلے درجے کے نمونوں کو حاصل کرتی ہیں، جبکہ بعد کی پرتیں اصل کام کے لیے زیادہ مہارت رکھتی ہیں۔