এআই শব্দকোষের মেয়াদ

কি প্যারামিটার-দক্ষ ফাইন-টিউনিং (PEFT)?

সংজ্ঞা

যে পদ্ধতিগুলি যোগ করা পরামিতিগুলির একটি ছোট উপসেট প্রশিক্ষণের মাধ্যমে মডেলগুলিকে অভিযোজিত করে৷

সম্পর্কিত পদ

ফাইন-টিউনিং
একটি নির্দিষ্ট কাজের জন্য একটি প্রাক-প্রশিক্ষিত মডেলকে মানিয়ে নিতে ডোমেন-নির্দিষ্ট ডেটার উপর অবিরত প্রশিক্ষণ।
LoRA (নিম্ন-র্যাঙ্ক অভিযোজন)
একটি পরামিতি-দক্ষ ফাইন-টিউনিং পদ্ধতি যা নিম্ন-র্যাঙ্ক অ্যাডাপ্টার ম্যাট্রিক্স যোগ করে।
পোস্ট-ট্রেনিং
প্রশিক্ষণের ধাপগুলি প্রি-ট্রেনিংয়ের পরে প্রয়োগ করা হয়, যেমন নির্দেশ টিউনিং, পছন্দ অপ্টিমাইজেশান এবং নিরাপত্তা টিউনিং।
নির্দেশ টিউনিং
নির্দেশনা-প্রতিক্রিয়া জোড়ায় একটি মডেলকে ফাইন-টিউনিং করে অনুসরণ করা টাস্ককে উন্নত করা।
শেখার হার
একটি প্রশিক্ষণ হাইপারপ্যারামিটার প্রতিটি আপডেট ধাপে কতটা পরামিতি পরিবর্তন করে তা নিয়ন্ত্রণ করে।
ডিপিও (ডাইরেক্ট প্রেফারেন্স অপ্টিমাইজেশান)
একটি প্রশিক্ষণ পদ্ধতি যা একটি পৃথক পুরস্কার মডেলের প্রয়োজন ছাড়াই সরাসরি পছন্দের জোড়ায় মডেলগুলিকে সূক্ষ্ম-টিউন করে৷

আমাদের বিনামূল্যের গাইডে আরও জানুন

আরও দেখুন