एआई शब्दावली शब्द

क्या है? पैरामीटर-कुशल फ़ाइन-ट्यूनिंग (PEFT)?

परिभाषा

वे विधियाँ जो अतिरिक्त मापदंडों के एक छोटे उपसमूह को प्रशिक्षित करके मॉडल को अनुकूलित करती हैं।

संबंधित शर्तें

फ़ाइन ट्यूनिंग
किसी पूर्व-प्रशिक्षित मॉडल को किसी विशिष्ट कार्य के लिए अनुकूलित करने के लिए डोमेन-विशिष्ट डेटा पर निरंतर प्रशिक्षण।
लोरा (निम्न-रैंक अनुकूलन)
एक पैरामीटर-कुशल फ़ाइन-ट्यूनिंग विधि जो निम्न-रैंक एडाप्टर मैट्रिसेस जोड़ती है।
प्रशिक्षण के बाद
प्रशिक्षण चरण पूर्व-प्रशिक्षण के बाद लागू किए जाते हैं, जैसे अनुदेश ट्यूनिंग, वरीयता अनुकूलन और सुरक्षा ट्यूनिंग।
अनुदेश ट्यूनिंग
निम्नलिखित कार्य को बेहतर बनाने के लिए निर्देश-प्रतिक्रिया युग्मों पर एक मॉडल को ठीक करना।
सीखने की दर
एक प्रशिक्षण हाइपरपैरामीटर यह नियंत्रित करता है कि प्रत्येक अद्यतन चरण में कितने पैरामीटर बदलते हैं।
डीपीओ (प्रत्यक्ष वरीयता अनुकूलन)
एक प्रशिक्षण पद्धति जो अलग-अलग पुरस्कार मॉडल की आवश्यकता के बिना सीधे वरीयता जोड़े पर मॉडल को ठीक करती है।

हमारी निःशुल्क मार्गदर्शिकाओं में और जानें

यह भी देखें