የትምህርት ደረጃ መርሐግብር
የመማሪያ ተመን መርሃ ግብር በስልጠና ወቅት የደረጃውን መጠን ተስተካክሎ ከመያዝ ይልቅ ይለውጠዋል።
አጠቃላይ እይታ
Getting it right is often the single biggest lever for whether a model converges quickly and reaches high accuracy.
ጥልቅ ዳይቭ
የመማሪያው ፍጥነት አመቻቹ እያንዳንዱን ዝማኔ ምን ያህል ትልቅ እርምጃ እንደሚወስድ ይቆጣጠራል። በጣም ከፍተኛ እና የስልጠና ልዩነት; በጣም ዝቅተኛ እና ይሳባል ወይም ይጣበቃል. መርሐግብር ማስያዝ ይህንን ዋጋ በጊዜ ሂደት ያስተካክላል። አንድ የተለመደ ዘመናዊ የምግብ አዘገጃጀት ሞቅ ያለ መበስበስ ይከተላል፡ ከዜሮ አጠገብ ይጀምሩ እና በመጀመሪያዎቹ ጥቂት መቶ ወይም ሺ ደረጃዎች ከፍ ይበሉ (ስለዚህ ቀደም ብሎ, ጫጫታ ቀስ በቀስ ያልተረጋጋ ክብደት አይነፋም), ከዚያም ቀስ በቀስ ይቀንሳል. ታዋቂ የመበስበስ ቅርፆች የእርምጃ መበስበስን (በተወሰነ ጊዜ መውደቅ)፣ ገላጭ መበስበስ እና ኮሳይን ማደንዘዣን ያጠቃልላሉ፣ ይህም የግማሽ ኮሳይን ኩርባ ወደ ዜሮ የሚወርድ። የኮሳይን መርሐ ግብሮች ከመስመር ማሞቂያ ጋር አሁን ትልልቅ የቋንቋ ሞዴሎችን ለማሰልጠን መደበኛ ናቸው፣ ዑደታዊ እና አንድ-ዑደት ፖሊሲዎች አነስተኛ ሞዴል ሥልጠናን ሊያፋጥኑ ይችላሉ።
ቴክኒካዊ ግንዛቤ
እንደ አዳም ያሉ አስማሚ አመቻቾች በመጀመሪያዎቹ ደረጃዎች የማይታመኑ የሁለተኛ ጊዜ ግምቶች ስላሏቸው ሞቃት ጉዳዮች; ትንሽ የመማር ፍጥነት እነዚያ ስታቲስቲክስ ከመረጋጋታቸው በፊት ክብደቶችን አለመረጋጋትን ያስወግዳል። Cosine annealing lr = lr_min + 0.5 * (lr_max - lr_min) * (1+ cos(pi * t /T))፣ ፈጣን እድገትን ቀደም ብሎ እና ጥቃቅን፣ ጥሩ ማስተካከያ ደረጃዎችን ወደ መጨረሻው ያቀርባል። አንዳንድ መርሃ ግብሮች ሞቅ ያለ ድጋሚ ማስጀመሮችን ይጨምራሉ፣ ጥርት ያለ ዝቅተኛ ለማምለጥ ፍጥነቱን ወደ ላይ በመዝለል።
ስልታዊ ተጽእኖ
ወጪ እና በጀት
የስነ-ህንፃ ውሳኔዎች ለዓመታት አፈጻጸምን እና የሥራ ማስኬጃ ወጪዎችን ያንቀሳቅሳሉ.
ግልጽ ውሳኔዎች
የቴክኒክ ትምህርት ቡድኖች አዲሱን ብቻ ሳይሆን ትክክለኛውን ቁልል እንዲመርጡ ይረዳል።
የጥራት ቁጥጥር
የተሻሉ የምህንድስና ምርጫዎች በምርት ውስጥ አስተማማኝነት ክስተቶችን ይቀንሳሉ.
የወደፊት የትምህርት ደረጃ መርሐግብር
የሥልጠና ሩጫዎች በጣም ውድ ሲሆኑ፣ መርሃ ግብሮች ከአመቻቾች እና ባች መጠኖች ጋር በጋራ እየተነደፉ ነው፣ እና ተመራማሪዎች ከስልጠና በፊት ምርጡን ከፍተኛ መጠን ለመተንበይ የመለኪያ ህጎችን ያጠናሉ። የመበስበስ ኩርባን አስቀድሞ የመምረጥ ፍላጎትን የሚያስወግዱ ከመርሐግብር ነፃ የሆኑ አመቻቾች ቀልብ እያገኙ ነው፣ እና መላመድ፣ ግብረ መልስ-ተኮር መርሃ ግብሮች ለቀጥታ ኪሳራ ኩርባዎች ምላሽ የሚሰጡ የሙከራ-እና-ስህተት አሁንም መጠነ ሰፊ ስልጠናን ሊቀንስ ይችላል።
የእውነተኛ-ዓለም አተገባበር
የትራንስፎርመር ቋንቋ ሞዴሎችን ሲሰለጥኑ የመስመር ማሞቂያ እና የኮሳይን መበስበስ ጥቅም ላይ ይውላሉ።
በEpochs 30፣ 60 እና 90 ላይ የምስል ክላሲፋየሮችን ሲያሰለጥኑ የመማር መጠኑን 10x የሚቀንስ የእርምጃ መበስበስ።
የአንድ-ዑደት ፖሊሲ በ fast.ai ውስጥ ሞዴልን በጥሩ ትክክለኛነት በጥቂት ዘመናት ውስጥ ለማሰልጠን።
ከጊዜ ወደ ጊዜ ከከባድ ኪሳራ ዝቅተኛነት ለማምለጥ እና አጠቃላይነትን ለማሻሻል በሞቀ ዳግም በመጀመር የኮሳይን ማደንዘዣ።
አደጋዎች እና የጥበቃ መንገዶች
አንድ ቤንችማርክን ማሳደግ ሰፋ ያሉ የስርዓት ድክመቶችን ሊደብቅ ይችላል።
የመሠረተ ልማት እና የጥገና ወጪዎች ብዙ ጊዜ ዝቅተኛ ናቸው.
ስርዓቶች ይበልጥ ውስብስብ ሲሆኑ የደህንነት እና የታዛቢነት ክፍተቶች ሊያድጉ ይችላሉ።
የትግበራ ፍኖተ ካርታ
ከመተግበሩ በፊት የቆይታ፣ የጥራት እና የወጪ ግቦችን ይግለጹ።
ቤንችማርክ በእውነተኛ ጭነት እና የውሂብ ሁኔታዎች።
ለስህተቶች፣ ተንሸራታች እና የተጠቃሚ ተጽእኖ የመሳሪያ ክትትል።
ከመጠኑ በፊት የመመለሻ እና የአደጋ ምላሽ መንገዶችን ያዘጋጁ።
ማሰስዎን ይቀጥሉ
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Learning Rate Scheduling quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
ቀጣይ መመሪያ
ሳይክሊካል የመማሪያ ተመኖች
በተደጋጋሚ የሚጠየቁ ጥያቄዎች
What is Learning Rate Scheduling?
የመማሪያ ተመን መርሃ ግብር በስልጠና ወቅት የደረጃውን መጠን ተስተካክሎ ከመያዝ ይልቅ ይለውጠዋል። በትክክል ማግኘቱ ብዙውን ጊዜ አንድ ሞዴል በፍጥነት እንዲሰበሰብ እና ከፍተኛ ትክክለኛነት ላይ ለመድረስ ብቸኛው ትልቁ ማንሻ ነው።
በትምህርት ፍጥነት መርሐግብር ውስጥ የ'ሞቃታማ' ምዕራፍ ዓላማ ምንድን ነው?
ዋርሙፕ ከዜሮ አጠገብ ይጀምራል እና ያልተረጋጋ ቀደምት ዝመናዎች የአመቻች ስታቲስቲክስ ከመቀመጡ በፊት ሞዴሉን እንዳይረጋጋ ለማድረግ ፍጥነቱን ይጨምራል።
የግማሽ-ኮሳይን ጥምዝ ወደ ዝቅተኛው ፍጥነት የሚሄደው የትኛው መርሐግብር ነው?
የኮሳይን ማደንዘዣ በግማሽ ኮሳይን ቅርፅ የመማሪያውን ፍጥነት ያበላሻል፣ ትላልቅ ደረጃዎችን ቀደም ብሎ እና ትንሽ ደረጃዎችን ወደ መጨረሻው ያቀርባል።
የመማሪያው ፍጥነት በጣም ከፍተኛ ከሆነ ምን ይከሰታል?
ከመጠን በላይ ከፍ ያለ ፍጥነት ከመጠን በላይ መተኮስን ያስከትላል, ስለዚህ ጥፋቱ ከመስተካከል ይልቅ ሊነሳ ወይም ሊፈነዳ ይችላል.
የእርከን መበስበስ ለትምህርት ፍጥነት ምን ያደርጋል?
የእርምጃ መበስበስ መጠኑን በፋክታር (ለምሳሌ፡ 0.1) በተመረጡት ደረጃዎች ያባዛል፣ ይህም የደረጃ ንድፍ ይፈጥራል።
ለምንድነው 'ሞቅ ያለ ዳግም ማስጀመር' አንዳንድ ጊዜ ወደ መርሐግብር የሚታከሉት?
ሞቃታማ ድጋሚ ጅማሬዎች በየተወሰነ ጊዜ የመማር ፍጥነቱን ወደ ላይ ይዝለሉ፣ ይህም አመቻቹ ከጠባብ አነስተኛነት እንዲወጣ እና የተሻሉ መፍትሄዎችን እንዲያስሱ ያግዘዋል።