ለሮቦት ቁጥጥር ስርጭት ፖሊሲ
የስርጭት ፖሊሲ እንደ Stable Diffusion ለሮቦት ቁጥጥር ካሉ የምስል ጀነሬተሮች ጀርባ ያለውን ተመሳሳይ የውድቀት ሃሳብ ይተገበራል፡ አንድን ቀጣይ እርምጃ ከመተንበይ ይልቅ ጫጫታውን ደጋግሞ በማጣራት አጠቃላይ አጭር ተከታታይ የወደፊት ድርጊቶችን ይፈጥራል።
አጠቃላይ እይታ
አስፈላጊ ነው ምክንያቱም የተዘበራረቀ እና ባለብዙ ሞዳል ተፈጥሮን ከአሮጌ ዘዴዎች በተሻለ ሁኔታ ስለሚይዝ ነው።
ጥልቅ ዳይቭ
እ.ኤ.አ. በ2023 በኮሎምቢያ፣ MIT እና ቶዮታ ምርምር ኢንስቲትዩት ተመራማሪዎች አስተዋውቋል፣ የስርጭት ፖሊሲ የvisomotor ትምህርትን እንደ ሁኔታዊ ውድቅ ያደርገዋል። የቅርብ ጊዜ የካሜራ ምስሎች እና የሮቦት ሁኔታን ከግምት ውስጥ በማስገባት፣ በዘፈቀደ ድምጽ ይጀምራል እና 'የድርጊት ቸንክ' ለማምረት በርካታ የውድቅ እርምጃዎችን ያካሂዳል - በሚቀጥሉት 8 እና 16 የፍጻሜ አድራጊ አቀማመጦች ይናገሩ። ትልቁ ድል መልቲሞዳሊቲ ነው፡ አንድ ተግባር ብዙ ትክክለኛ መፍትሄዎች ሲኖረው (ከግራ ወይም ከቀኝ አንድ ኩባያ መያዝ ይችላሉ)፣ ባሕላዊ ሪግሬሽን በአማካይ ወደ መጥፎ መካከለኛ እርምጃ ያደርጋቸዋል፣ የስርጭት ሞዴል ደግሞ ለአንድ ሁነታ በንጽህና ሊፈጽም ይችላል። እንዲሁም ከሰዎች ማሳያዎች (የባህርይ ክሎኒንግ) በተረጋጋ ሁኔታ ይማራል እና ከፍተኛ መጠን ያላቸውን የድርጊት ቦታዎችን በደንብ ይቋቋማል ይህም በብዙ ዘመናዊ የማታለል ስርዓቶች ውስጥ ነባሪ ምርጫ ያደርገዋል።
ቴክኒካዊ ግንዛቤ
ስልጠና የ Gaussian ጫጫታ ወደ ያሳዩ የድርጊት ቅደም ተከተሎች ይጨምራል እና ኔትዎርክን (ብዙውን ጊዜ ዩ-ኔት ወይም ትራንስፎርመር) ያንን ድምጽ ለመተንበይ ያስተምራል፣ በእይታ እና በፕሮፕሪዮሴፕቲቭ ምልከታዎች። በሂደት ላይ እያለ የድርጊት አቅጣጫን ለማምጣት በዘፈቀደ ናሙናዎች በጥቂት እርምጃዎች (DDPM/DDIM) ላይ ውድቅ ያደርጋል። ቁርጥራጮችን መተንበይ እና 'ወደ ኋላ-አድማስ' እንደገና ማቀድ ለአዳዲስ ምልከታዎች ንቁ ሆነው ሲቆዩ ጊዜያዊ ወጥነት ይሰጣል።
ስልታዊ ተጽእኖ
ፍጥነት እና ልኬት
ቪዥዋል AI የመመርመሪያ፣ የማወቅ እና የመለያ ስራዎችን በሚዛን መጠን በራስ ሰር ሊያደርግ ይችላል።
ምርጫዎችን ይገንቡ
የፈጠራ ቡድኖች በጥቂት የእጅ ክለሳዎች ጽንሰ-ሀሳቦችን በፍጥነት መተየብ ይችላሉ።
ቡድን እና የስራ ፍሰት
ክዋኔዎች ከዚህ ቀደም ለማስኬድ አስቸጋሪ የነበሩትን የምስል እና የቪዲዮ ምልክቶችን መጠቀም ይችላሉ።
ለሮቦት መቆጣጠሪያ የወደፊት ስርጭት ፖሊሲ
ስራ የውድቀት እርምጃዎችን ቁጥር እየቆረጠ ነው (በወጥነት ሞዴሎች እና ፍሰት ማዛመድ) ስለዚህ ፖሊሲዎች በእውነተኛ ሃርድዌር ላይ በከፍተኛ የቁጥጥር ፍጥነት ይሰራሉ። የማሰራጨት ተግባር ራሶች VLAዎችን ለመመስረት በትልልቅ የእይታ-ቋንቋ የጀርባ አጥንቶች ላይ እየተጣበቁ ሲሆን 3D-የሚያውቁ እና ተመጣጣኝ ልዩነቶች የናሙና ውጤታማነትን ያሻሽላሉ። በስርጭት ላይ የተመሰረተ ቁጥጥር በአጠቃላይ ሮቦት 'አንጎል' ሃይል ቀልጣፋ እና ሁለት እጅ ስራዎች ውስጥ ዋና ንጥረ ነገር ሆኖ እንዲቆይ ይጠብቁ።
የእውነተኛ-ዓለም አተገባበር
የሮቦት ክንድ ቲ-ቅርጽ ያለው ብሎክን ወደ ዒላማ አቀማመጥ ሲገፋ፣ የስርጭት ፖሊሲ በተለይ የቀደምት ባህሪ-የክሎኒንግ ዘዴዎችን የላቀ የፈፀመበት መለኪያ
ባለሁለት ሮቦቶች እንደ ምግብ መገልበጥ ወይም ከሰው የቴሌኦፐሬሽን ማሳያዎች እንደ መገጣጠም ያሉ ለስላሳ የኩሽና ስራዎችን ይማራሉ
የተዝረከረከ-ቢን መምረጥ ብዙ ትክክለኛ መያዣዎች ባሉበት እና ፖሊሲው ከአማካኝ ይልቅ አንድ ያደርጋል
የተግባር-ራስ ሞጁል በራዕይ-ቋንቋ-እርምጃ ሲስተሞች ውስጥ ለስላሳ የከፍተኛ ድግግሞሽ እንቅስቃሴ የሚያመነጭ እጆች
አደጋዎች እና የጥበቃ መንገዶች
የምስል መብቶች እና ፈቃድ ግልጽ ካልሆነ ህጋዊ አደጋዎች ሊሆኑ ይችላሉ።
የሞዴል አፈጻጸም በብርሃን፣ በስነ-ሕዝብ እና በአካባቢው ሊለያይ ይችላል።
የመተማመን ገደቦች ካልተቆጣጠሩ የውሸት አወንታዊ ነገሮች ላይታዩ ይችላሉ።
የትግበራ ፍኖተ ካርታ
ለትክክለኛነት፣ ለማስታወስ እና ለስህተት ወጪዎች የመቀበያ መስፈርቶችን ይግለጹ።
ከእውነተኛ የምርት ሁኔታዎች ጋር በሚዛመድ ውሂብ ይሞክሩ።
ለዝቅተኛ እምነት ወይም ከፍተኛ ተጽዕኖ ትንበያ የሰው ግምገማን ያክሉ።
ከካሜራ ወይም የውሂብ ስብስብ ለውጦች በኋላ የሞዴሉን ተንሸራታች ይከታተሉ እና እንደገና ያረጋግጡ።
ማሰስዎን ይቀጥሉ
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Diffusion Policy for Robot Control quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
ቀጣይ መመሪያ
Stable Diffusion
በተደጋጋሚ የሚጠየቁ ጥያቄዎች
ለሮቦት ቁጥጥር የማሰራጨት ፖሊሲ ምንድነው?
የስርጭት ፖሊሲ እንደ Stable Diffusion ለሮቦት ቁጥጥር ካሉ የምስል ጀነሬተሮች ጀርባ ያለውን ተመሳሳይ የውድቀት ሃሳብ ይተገበራል፡ አንድን ቀጣይ እርምጃ ከመተንበይ ይልቅ ጫጫታውን ደጋግሞ በማጣራት አጠቃላይ አጭር ተከታታይ የወደፊት ድርጊቶችን ይፈጥራል። ጉዳዩ ከቀድሞዎቹ ዘዴዎች በተሻለ ሁኔታ የተመሰቃቀለ፣ የብዙ ሞዳል የእውነተኛ ማጭበርበር ባህሪን ስለሚይዝ ነው።
በእያንዳንዱ የውሳኔ ነጥብ ላይ የስርጭት ፖሊሲ ምን ይፈጥራል?
የስርጭት ፖሊሲ ከአንድ የተለየ ትእዛዝ ይልቅ በመካድ የድርጊት ቅንጥብ - በርካታ የወደፊት የድርጊት ጊዜዎችን ይፈጥራል።
የስርጭት ፖሊሲ ከአይአይ ምስል የሚበደረው የትኛውን የማመንጨት ዘዴ ነው?
እንደ የምስል ስርጭት ሞዴሎች፣ ከጩኸት ይጀምራል እና በድግግሞሽ ውድቅ ያደርጋል፣ ነገር ግን እዚህ ውፅዓት በአስተያየቶች ላይ የተስተካከለ የድርጊት አቅጣጫ ነው።
የመልቲ-ሞዳል ተግባራትን ችግር ከቀላል ማገገም ፖሊሲን በተሻለ ሁኔታ ይፈታል?
ብዙ ድርጊቶች ትክክለኛ ሲሆኑ (ለምሳሌ፣ ግራ ወይም ቀኝን ይያዙ)፣ መመለሻቸው በአማካይ ወደ ደካማ መካከለኛ አማራጭ ያደርጋቸዋል። ስርጭት ወደ ነጠላ ሁነታ በንጽህና ሊሰራ ይችላል.
በስልጠና ወቅት፣ በስርጭት ፖሊሲ ውስጥ ያለው ኔትወርክ ለመተንበይ ያስተማረው ምንድን ነው?
የ Gaussian ጫጫታ ለተገለጹት ድርጊቶች ተጨምሯል እና አውታረ መረቡ ያንን ድምጽ ለመተንበይ ይማራል (በምልከታዎች ላይ ያለ) ፣ መደበኛውን የውሸት ዓላማ።
በስርጭት ፖሊሲ ውስጥ 'ማፈግፈግ-አድማስ' እንደገና ማቀድ ምንድነው?
ፖሊሲው የተወሰኑ ድርጊቶችን ይተነብያል ነገርግን በየጊዜው አዳዲስ ምልከታዎችን በመጠቀም እንደገና ያቅዳል፣ ጊዜያዊ ወጥነት እና ምላሽ ሰጪነት።