एआई शब्दावली शब्द

क्या है? अनुदेश ट्यूनिंग?

परिभाषा

निम्नलिखित कार्य को बेहतर बनाने के लिए निर्देश-प्रतिक्रिया युग्मों पर एक मॉडल को ठीक करना।

संबंधित शर्तें

फ़ाइन ट्यूनिंग
किसी पूर्व-प्रशिक्षित मॉडल को किसी विशिष्ट कार्य के लिए अनुकूलित करने के लिए डोमेन-विशिष्ट डेटा पर निरंतर प्रशिक्षण।
लोरा (निम्न-रैंक अनुकूलन)
एक पैरामीटर-कुशल फ़ाइन-ट्यूनिंग विधि जो निम्न-रैंक एडाप्टर मैट्रिसेस जोड़ती है।
पैरामीटर-कुशल फ़ाइन-ट्यूनिंग (PEFT)
वे विधियाँ जो अतिरिक्त मापदंडों के एक छोटे उपसमूह को प्रशिक्षित करके मॉडल को अनुकूलित करती हैं।
सिस्टम प्रॉम्प्ट
एक उच्च प्राथमिकता वाला निर्देश जो किसी मॉडल के लिए व्यवहार, नीति और प्रतिक्रिया शैली निर्धारित करता है।
स्थानांतरण सीखना
एक कार्य या डोमेन में सीखे गए ज्ञान को दूसरे कार्य को बेहतर बनाने के लिए लागू करना।
परीक्षण-समय गणना
गुणवत्ता या तर्क में सुधार के लिए प्रतिक्रिया निर्माण के दौरान अतिरिक्त अनुमान गणना का उपयोग किया जाता है।

हमारी निःशुल्क मार्गदर्शिकाओं में और जानें

यह भी देखें