የቋንቋ AI መመሪያ

ሕገ-መንግሥታዊ AI

ሕገ-መንግሥታዊ AI የAnthropic ሞዴሎችን በጽሑፍ የተጻፉ መርሆዎችን በመጠቀም የማጣጣም ዘዴ ነው - 'ሕገ መንግሥት' - ስለዚህ AI በሰዎች ላይ ብቻ ከመተማመን ይልቅ ጎጂ ይዘትን ለመሰየም የራሱን መልሶች ይወቅሳል እና ያስተካክላል።

2 ሚን አንብብለመጨረሻ ጊዜ የዘመነው

አጠቃላይ እይታ

It aims to make models helpful and harmless with far less human labor.

ጥልቅ ዳይቭ

ተለምዷዊ አሰላለፍ ከሰዎች ግብረመልስ (RLHF) በማጠናከሪያ ትምህርት ላይ ያደገ ሲሆን ሰዎች ሞዴሉን ምን መራቅ እንዳለበት ለማስተማር የሚረብሹን ጨምሮ ብዙ የሞዴል ውጤቶችን ደረጃ በሚሰጡበት ነው። ሕገ መንግሥታዊ AI እንደ የተባበሩት መንግስታት የሰብአዊ መብቶች መግለጫ እና የመተማመን እና የደህንነት ምርጥ ልምዶች ካሉ ምንጮች የተውጣጡ ግልጽ የጽሁፍ መርሆዎችን ለአምሳያው በመስጠት ሸክሙን ይቀንሳል። ስልጠና ሁለት ደረጃዎች አሉት. በመጀመሪያ ደረጃ, ቁጥጥር የሚደረግበት ደረጃ: ሞዴሉ ምላሽ ያመነጫል, ከዚያም በህገ-መንግስታዊ መርህ ላይ ይወቅሰዋል እና የተሻለ እንዲሆን እንደገና ይጽፋል; እነዚህ በራሳቸው የተሻሻሉ መልሶች እሱን ለማስተካከል ይጠቅማሉ። ሁለተኛ፣ የማጠናከሪያ-ትምህርት ደረጃ፣ RLAIF፣ ሞዴሉ እራሱ በህገ-መንግስቱ መሰረት ጥንድ ምላሾችን ያስቀመጠበት፣ እና በ AI የመነጨ ምርጫ መረጃ የሽልማት ሞዴልን ያሠለጥናል። መርሆቹ ግልጽ እና አርትዖት ሊደረጉ የሚችሉ ናቸው፣ ይህም ሞዴሉን የሚመራው እሴት ግልጽ ባልሆኑ የሰው መለያዎች ውስጥ ከመደበቅ ይልቅ መፈተሽ እንዲችል ያደርገዋል።

ቴክኒካዊ ግንዛቤ

ሁለቱ ደረጃዎች ብዙውን ጊዜ SL-CAI እና RL-CAI ይባላሉ። ክትትል በሚደረግበት ትምህርት፣ 'ሂስ-እና-ክለሳ' ሉፕ ሞዴሉን የራሱ መልስ ናሙና የሆነን መርህ የሚጥስበትን ቦታ ፈልጎ እንዲያገኝ እና እንደገና እንዲጽፈው ያነሳሳዋል፣ ይህም የሰው ጉዳት-መለያ ሳይደረግበት የሥልጠና መረጃ ያመነጫል። በአርኤል ደረጃ፣ ሁለተኛው ሞዴል ከሁለቱ ምላሾች የትኛው በተሻለ ሁኔታ ሕገ መንግሥቱን እንደሚከተል ይገመግማል፣ ይህም በመደበኛ RL ውስጥ ጥቅም ላይ የዋለውን የሽልማት ሞዴል የሚያሠለጥኑ የ AI ምርጫ መለያዎችን (RLAIF) ያዘጋጃል። ሕገ መንግሥቱ ግልጽ የሆነ የጽሑፍ መመሪያ ነው፣ ስለዚህ የአምሳያው ባህሪ መቀየር መርሆችን እንደማረም ቀጥተኛ ሊሆን ይችላል።

ስልታዊ ተጽእኖ

ፍጥነት እና ልኬት

የቋንቋ የስራ ፍሰቶች ወጥነትን ሳያጠፉ በፍጥነት ሊንቀሳቀሱ ይችላሉ።

መድረስ እና መድረስ

በቋንቋዎች እና በመግባቢያ ዘይቤዎች ተደራሽነትን ያሰፋዋል።

ግልጽ ውሳኔዎች

አውቶሜሽን ድግግሞሹን ሲቆጣጠር ቡድኖች በፍርድ ላይ ብዙ ጊዜ ሊያጠፉ ይችላሉ።

የሕገ-መንግስታዊ AI የወደፊት

ሕገ መንግሥታዊ AI ወደ 'ተመጣጣኝ ቁጥጥር' ይጠቁማል፣ ኤአይኤአይአይን ለመቆጣጠር የሚረዳበት ሞዴሎች ሰዎች እያንዳንዱን ምርት ለመፈተሽ በጣም አቅም እያደጉ ሲሄዱ ነው። የበለጠ የበለጸጉ፣ ይበልጥ ግልጽ ያልሆኑ ሕገ መንግሥቶች፣ መርሆች የሚመረጡባቸው ህዝባዊ እና አሳታፊ ግብዓቶችን ይጠብቁ (Anthropic 'የጋራ ሕገ መንግሥታዊ AI' ሙከራዎችን አድርጓል)፣ እና ድብልቅ አቀራረቦች የሰውን አስተያየት ከ AI ራስን ትችት ጋር ያዋህዳሉ። የጽሑፍ መርሆች ግልጽነት ይህንን ሥርዓት የሚመሰጥርባቸውን እሴቶች ለማየት ለሚፈልጉ ተቆጣጣሪዎች እና ኦዲተሮች ማራኪ ያደርገዋል። የድንበር ሞዴሎች እየገፉ ሲሄዱ፣ ሞዴሎች በአስተማማኝ ሁኔታ እንዲተቹ እና እራሳቸውን በግልፅ ህጎች ላይ እንዲያሻሽሉ የሚያደርጉ ዘዴዎች ለደህንነት ማዕከላዊ ይሆናሉ።

የእውነተኛ-ዓለም አተገባበር

አንድ ቻትቦት የራሱን ረቂቅ መልስ ከጉዳት-መራቅ መርህ ላይ በመተቸት መሳሪያ ለመስራት እንዳይረዳ ማሰልጠን እና እንደገና እንዲፃፍ ማድረግ

በህገ መንግስቱ በሚመራው ውድ የሰው ቀይ ቡድን የመርዛማ ውጤቶች መለያ በ AI የመነጨ ምርጫ መረጃ (RLAIF) መተካት

አንድ ሞዴል ምን ያህል ጠንቃቃ እንደሆነ ለማስተካከል የጽሑፍ መርሆ ማረም፣ ከዚያም በሺዎች የሚቆጠሩ ምሳሌዎችን ሳያስቀምጡ የባህሪ ለውጥን መመልከት

የአምሳያው ሕገ መንግሥትን የሚቀርጹ መርሆችን ሕዝቡ የሚያቀርብበት የጋራ ግብዓት ልምምዶችን ማካሄድ

አደጋዎች እና የጥበቃ መንገዶች

የተሳሳቱ እውነታዎች በጸጥታ ወደ ሪፖርቶች፣ የድጋፍ ፍሰቶች ወይም የምርምር ውጤቶችን ማስገባት ይችላሉ።

ፈጣን ትብነት በተመሳሳይ ጥያቄዎች ላይ የማይጣጣሙ ውጤቶችን ሊፈጥር ይችላል።

የመዳረሻ መቆጣጠሪያዎች ደካማ ከሆኑ ሚስጥራዊነት ያለው የጽሑፍ ውሂብ ሊጋለጥ ይችላል።

የትግበራ ፍኖተ ካርታ

1

ከመልቀቅዎ በፊት የውጤት ቅርጸትን፣ ድምጽን እና የጥራት ደረጃዎችን ይግለጹ።

2

ትክክለኛነት አስፈላጊ በሚሆንበት ጊዜ ሁሉ ከታመኑ ምንጮች ጋር ምላሾች።

3

ከፍተኛ ውጤት ለማግኘት የሰው የግምገማ ነጥብ አቆይ።

4

የውድቀት ንድፎችን ይከታተሉ እና ጥያቄዎችን ወይም የስራ ፍሰቶችን በመደበኛነት ያሠለጥኑ።

ማሰስዎን ይቀጥሉ

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Constitutional AI quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

ጥያቄ ጀምር

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

በተደጋጋሚ የሚጠየቁ ጥያቄዎች

What is Constitutional AI?

ሕገ-መንግሥታዊ AI የAnthropic ሞዴሎችን በጽሑፍ የተጻፉ መርሆዎችን በመጠቀም የማጣጣም ዘዴ ነው - 'ሕገ መንግሥት' - ስለዚህ AI በሰዎች ላይ ብቻ ከመተማመን ይልቅ ጎጂ ይዘትን ለመሰየም የራሱን መልሶች ይወቅሳል እና ያስተካክላል። በጣም ያነሰ የሰው ጉልበት በመጠቀም ሞዴሎችን አጋዥ እና ምንም ጉዳት የሌላቸው እንዲሆኑ ለማድረግ ያለመ ነው።

በሕገ መንግሥታዊ AI ውስጥ 'ሕገ መንግሥቱ' ምንድን ነው?

ሕገ መንግሥቱ ሞዴሉ መልሱን ለመገምገምና ለማሻሻል የሚጠቀምባቸው እንደ ሰብዓዊ መብት ሰነዶች ካሉ ምንጮች የተውጣጡ ግልጽ የጽሑፍ መርሆዎች ስብስብ ነው።

ከመደበኛ RLHF ጋር ምን ቁልፍ ችግር ሕገ መንግሥታዊ AI ለመቀነስ ይፈልጋል?

ሞዴሉ እራሱን ከመሠረታዊ መርሆች ጋር በመቃወም፣ ሕገ መንግሥታዊ AI የሚረብሹን ወይም ጎጂ ውጤቶችን የመገምገም እና የመለየት የሰው ጉልበት ይቀንሳል።

በህገ-መንግስታዊ AI ቁጥጥር ስር ባለው ደረጃ, ሞዴሉ በራሱ ምርት ላይ ምን ያደርጋል?

ሞዴሉ የትችት እና የመከለስ ዑደትን ያካሂዳል፡ ረቂቁ የናሙና መርሆ የሚጥስበትን ቦታ ይለያል፣ ከዚያም መልሱን እንደገና ይጽፋል፣ በራሱ የተሻሻለ የስልጠና መረጃ ይፈጥራል።

RLAIF በማጠናከሪያ-የመማሪያ ደረጃ ውስጥ ምን ማለት ነው?

RLAIF ማለት ማጠናከሪያ ትምህርት ከ AI ግብረመልስ ማለት ነው፡ አንድ ሞዴል በህገ መንግስቱ መሰረት ምላሾችን በደረጃ ያስቀምጣል።

ለምንድነው የጽሑፍ መርሆችን መጠቀም ለግልጽነት እንደ ጥቅም የሚወሰደው?

የመመሪያ እሴቶቹ ስለተፃፉ፣ በተበተኑ የሰው ልጅ ደረጃዎች ውስጥ በተዘዋዋሪ ከተቀመጠው ምርጫዎች በተለየ ሊመረመሩ፣ ሊመረመሩ እና ሊታተሙ ይችላሉ።