የማህበረሰብ መመሪያ

AI ደህንነት

የ AI ደህንነት የ AI ስርዓቶች ከባድ ጉዳት እንዳያደርሱ በመከላከል ላይ ያተኮረ መስክ ነው - ከዕለት ተዕለት ውድቀቶች እና ከአደጋ እና ነባራዊ አደጋዎች ከላቁ እና ከፍተኛ አቅም ካላቸው ስርዓቶች።

Part of the Society & Ethics learning path

አጠቃላይ እይታ

የ AI ደህንነት የ AI ስርዓቶች ከባድ ጉዳት እንዳያደርሱ በመከላከል ላይ ያተኮረ መስክ ነው - ከዕለት ተዕለት ውድቀቶች እና ከአደጋ እና ነባራዊ አደጋዎች ከላቁ እና ከፍተኛ አቅም ካላቸው ስርዓቶች።

AI ደህንነት በችሎታ፣ በስልጣን እና በህዝብ ምርጫ መገናኛ ላይ ተቀምጧል - ደህንነት፣ አስተዳደር እና ህጋዊነት የላቀ AI ይረዳል ወይም ይጎዳል።

ጥልቅ ዳይቭ

የ AI ደህንነት አንድ ስፔክትረም ይሸፍናል. በአንደኛው ጫፍ የታወቁ የምርት ስጋቶች አሉ፡ ቅዠት፣ አድልዎ፣ የግላዊነት ፍንጣቂዎች፣ ማጭበርበሮች እና አስተማማኝ ያልሆኑ ምክሮች። በሌላ በኩል ደግሞ በችሎታ የሚበቅሉ አደጋዎች፡- ያልታሰቡ ግቦችን የሚያራምዱ ራሳቸውን የቻሉ ሥርዓቶች፣ ለአደጋ የሚያጋልጡ አላግባብ መጠቀምን የሚረዱ ሞዴሎች (በሽታ አምጪ ተህዋሲያን፣ የሳይበር ጥቃቶች) እና የደህንነት ሥራ ከመዘጋጀቱ በፊት ላብራቶሪዎች እንዲሰማሩ ግፊት የሚያደርጉ ተወዳዳሪ ሩጫዎች ናቸው። ነባራዊ የአደጋ ውይይቶች የሚያተኩሩት ወደፊት የኤአይአይ ሲስተሞች በበቂ ሁኔታ ሀይለኛ ሊሆኑ በሚችሉበት ሁኔታ ላይ ሲሆን ይህም አንድ ውድቀት - አለመግባባት፣ ቁጥጥር ማጣት ወይም የማይቀለበስ መስፋፋት - የሰው ልጅን የወደፊት ህይወት በዘላቂነት ሊቀንስ ይችላል። ጥናቱን በቁም ነገር ለመውሰድ ለዚያ ውጤት ከፍተኛ እድል መመደብ አያስፈልግዎትም; በባዮሴኪዩሪቲ እና በኑክሌር ደህንነት ላይ እንደሚደረገው ሁሉ ዝቅተኛ የመሆን እድል፣ ከፍተኛ ተጽዕኖ የሚያሳድሩ አደጋዎች አሁንም መዘጋጀታቸውን ያረጋግጣሉ። ተግባራዊ የደህንነት ስራ ዛሬ ግምገማን፣ ቀይ ቡድንን፣ አተረጓጎምን፣ የቁጥጥር ቴክኒኮችን፣ አስተዳደርን (ማን ምን ሊያሰለጥን ይችላል) እና ማህበረሰቦች ጥሩ ፖሊሲን እንዲደግፉ የህዝብ ግንዛቤን ያጠቃልላል።

ቴክኒካዊ ግንዛቤ

ጠቃሚ የአዕምሮ ሞዴል፡ አቅም (ስርአቱ ምን ሊያደርግ ይችላል) የአሰላለፍ ጣጣዎችን ያበዛል (ያሰብነውን ቢያደርግም) እና የደህንነት (ጠላቶች አላግባብ ሊጠቀሙበት ይችላሉ)። ውጽዓቶችን ብቻ የሚያጣሩ መከላከያዎች ከእስር መፈታታት፣ እምቢታዎችን ማስተካከል ወይም ባለብዙ እርምጃ እርምጃዎችን ከቻት ሳጥን ውጭ በሚወስዱ ወኪሎች ላይ ሊሳኩ ይችላሉ። ጠንካራ የደህንነት ፕሮግራሞች አደገኛ ችሎታዎችን ይለካሉ, የማታለል ባህሪን ይፈትኑ እና በተወዳዳሪ ጫና ውስጥ ለማሰማራት እቅድ ያውጡ - ከእውነታው በኋላ የሞዴል ካርድን ብቻ ​​ሳይሆን.

የ AI ደህንነትን መቆጣጠር

ጥልቅ ግንዛቤን ለመገንባት AI ሴፍቲን እንደ ኦፕሬሽን ሞዴል ይያዙት እንጂ አንድ ባህሪ አይደለም። የተፈለገውን ውጤት ይግለጹ፣ ግምቶችን ያብራሩ እና ስርዓቱ በአስተማማኝ ሁኔታ ምን ማድረግ እንደሚችል አሁንም የባለሙያዎችን ውሳኔ ከሚያስፈልገው ይለዩ።

በተግባር፣ AI ሴፍቲ የሚጠቀሙ ጠንካራ ቡድኖች የችሎታ እድገትን ከአስተዳደር፣ ከደህንነት እና ከተጠያቂነት አወቃቀሮች ጋር ያጣምራሉ። ግልጽ የስኬት መስፈርቶችን ይመዘግባሉ፣ በተጨባጭ መረጃ እና የስራ ፍሰቶች ላይ ይፈትሻሉ፣ እና የአንድ ጊዜ ቤንችማርክ ከማሸነፍ ይልቅ በተስተዋሉ የውድቀት ቅጦች ላይ ተመስርተው ይደግማሉ። ይህ የንድፈ ሃሳባዊ ግንዛቤ በምርት፣ ፖሊሲ እና ኦፕሬሽኖች ላይ ወደ ዘላቂ አቅም የሚቀየርበት ነው።

አስከፊ እና የዕለት ተዕለት የ AI ጉዳቶች ሁለቱም አደጋዎችን የሚረዳው እና ማን እርምጃ ሊወስድ በሚችል ላይ የተመካ ነው። በተመሳሳይ ጊዜ፣ የችሎታ ውህዶች እያለ የሕልውና አደጋን እንደ sci-fi ማከም። በጣም ጠንካራው አካሄድ የሙከራ ፍጥነትን ከአስተዳደር ዲሲፕሊን ጋር ማጣመር ነው፡ አብራሪዎችን ማስኬድ፣ ማስረጃን መያዝ፣ የውሳኔ ምዝግብ ማስታወሻዎችን ማተም እና የሞዴል ባህሪ፣ የተጠቃሚ የሚጠበቁ እና የቁጥጥር መስፈርቶች ሲዳብሩ ጥበቃዎችን ያለማቋረጥ ማዘመን ነው።

ስልታዊ ተጽእኖ

አስከፊ እና የዕለት ተዕለት የ AI ጉዳቶች ሁለቱም አደጋዎችን የሚረዳው እና ማን እርምጃ ሊወስድ በሚችል ላይ የተመካ ነው።

አስከፊ እና የዕለት ተዕለት የ AI ጉዳቶች ሁለቱም አደጋዎችን የሚረዳው እና ማን እርምጃ ሊወስድ በሚችል ላይ የተመካ ነው። ከፍተኛ ጥራት ባለው ማሰማራት ውስጥ፣ ይህ ወደሚለካ የአሠራር ደንቦች፣ የባለቤትነት ወሰኖች እና ተደጋጋሚ የግምገማ ሥነ ሥርዓቶች ይተረጎማል ስለዚህ ቡድኖች አሻሚነትን ከማስፋት ይልቅ በራስ መተማመንን ሊጨምሩ ይችላሉ።

ህዝባዊ እና ሙያዊ ማንበብና መጻፍ ጠንካራ የደህንነት ፖሊሲ በፖለቲካዊ መልኩ ይቻል እንደሆነ ይቀርፃል።

ህዝባዊ እና ሙያዊ ማንበብና መጻፍ ጠንካራ የደህንነት ፖሊሲ በፖለቲካዊ መልኩ ይቻል እንደሆነ ይቀርፃል። ከፍተኛ ጥራት ባለው ማሰማራት ውስጥ፣ ይህ ወደሚለካ የአሠራር ደንቦች፣ የባለቤትነት ወሰኖች እና ተደጋጋሚ የግምገማ ሥነ ሥርዓቶች ይተረጎማል ስለዚህ ቡድኖች አሻሚነትን ከማስፋት ይልቅ በራስ መተማመንን ሊጨምሩ ይችላሉ።

ግልጽ ማብራሪያዎች በማስታወቂያ፣ በቤተ ሙከራ እና ግልጽ ያልሆነ የስነምግባር ቲያትር መያዝን ይቀንሳሉ።

ግልጽ ማብራሪያዎች በማስታወቂያ፣ በቤተ ሙከራ እና ግልጽ ያልሆነ የስነምግባር ቲያትር መያዝን ይቀንሳሉ። ከፍተኛ ጥራት ባለው ማሰማራት ውስጥ፣ ይህ ወደሚለካ የአሠራር ደንቦች፣ የባለቤትነት ወሰኖች እና ተደጋጋሚ የግምገማ ሥነ ሥርዓቶች ይተረጎማል ስለዚህ ቡድኖች አሻሚነትን ከማስፋት ይልቅ በራስ መተማመንን ሊጨምሩ ይችላሉ።

የ AI ደህንነት የወደፊት

ሞዴሎች የመሳሪያ አጠቃቀም እና ራስን በራስ የማስተዳደር መብት ሲያገኙ፣ ደህንነት 'መጥፎ ነገርን አትናገር' ወደ 'ያለ አስተማማኝ ቁጥጥር የማይመለሱ እርምጃዎችን አትውሰድ' ወደሚለው ይሸጋገራል። የበለጠ ደረጃቸውን የጠበቁ ምዘናዎችን፣ የሶስተኛ ወገን ኦዲት ማድረግን፣ ፖሊሲዎችን ማስላት እና መልቀቅ፣ እና የህዝብ ግልጽነት ጥያቄን ይጠብቁ። ማንበብና መጻፍ የደህንነት አካል ነው፡ ስፔሻሊስቶች ብቻ ስጋቱን ከተረዱ ዲሞክራሲያዊ አስተዳደር ሊቀጥል አይችልም።

የእውነተኛ-ዓለም አተገባበር

ቀይ-ቡድን ሞዴሎች ከመለቀቁ በፊት ለባዮሴኪዩሪቲ፣ ሳይበር እና የማታለል አደጋዎች።

ሞዴል በአደገኛ ተግባራት ላይ ማገዝ ይችል እንደሆነ የሚፈትሹ የችሎታ ግምገማዎችን ማካሄድ።

የተደራረቡ መቆጣጠሪያዎችን መዘርጋት፡ የአጠቃቀም ፖሊሲዎች፣ ክትትል፣ የዋጋ ገደቦች እና ለከፍተኛ አደጋ እርምጃዎች የሰው ልጅ መጨመር።

ሞዴል በምርት ላይ ሲወድቅ ወይም የእስር ቤት መቆራረጥ ሲሰራጭ የአደጋ ምላሽን መንደፍ።

የትግበራ ቅጦች

AI ደህንነት በተግባር

ቀይ-ቡድን ሞዴሎች ከመለቀቁ በፊት ለባዮሴኪዩሪቲ፣ ሳይበር እና የማታለል አደጋዎች።

ቡድኖች ብዙውን ጊዜ የጥራት ደረጃዎችን ፊት ለፊት ሲገልጹ፣ የሰው ልጅ መሻሻል መንገድን ለዳር ጉዳዮች ሲይዙ እና ሁለቱንም የምርታማነት ግኝቶችን እና የስህተት ወጪዎችን በጊዜ ሂደት ሲከታተሉ የተሻለ ውጤት ያገኛሉ።

AI ደህንነት በተግባር

ሞዴል በአደገኛ ተግባራት ላይ ማገዝ ይችል እንደሆነ የሚፈትሹ የችሎታ ግምገማዎችን ማካሄድ።

ቡድኖች ብዙውን ጊዜ የጥራት ደረጃዎችን ፊት ለፊት ሲገልጹ፣ የሰው ልጅ መሻሻል መንገድን ለዳር ጉዳዮች ሲይዙ እና ሁለቱንም የምርታማነት ግኝቶችን እና የስህተት ወጪዎችን በጊዜ ሂደት ሲከታተሉ የተሻለ ውጤት ያገኛሉ።

AI ደህንነት በተግባር

የተደራረቡ መቆጣጠሪያዎችን መዘርጋት፡ የአጠቃቀም ፖሊሲዎች፣ ክትትል፣ የዋጋ ገደቦች እና ለከፍተኛ አደጋ እርምጃዎች የሰው ልጅ መጨመር።

ቡድኖች ብዙውን ጊዜ የጥራት ደረጃዎችን ፊት ለፊት ሲገልጹ፣ የሰው ልጅ መሻሻል መንገድን ለዳር ጉዳዮች ሲይዙ እና ሁለቱንም የምርታማነት ግኝቶችን እና የስህተት ወጪዎችን በጊዜ ሂደት ሲከታተሉ የተሻለ ውጤት ያገኛሉ።

AI ደህንነት በተግባር

ሞዴል በምርት ላይ ሲወድቅ ወይም የእስር ቤት መቆራረጥ ሲሰራጭ የአደጋ ምላሽን መንደፍ።

ቡድኖች ብዙውን ጊዜ የጥራት ደረጃዎችን ፊት ለፊት ሲገልጹ፣ የሰው ልጅ መሻሻል መንገድን ለዳር ጉዳዮች ሲይዙ እና ሁለቱንም የምርታማነት ግኝቶችን እና የስህተት ወጪዎችን በጊዜ ሂደት ሲከታተሉ የተሻለ ውጤት ያገኛሉ።

አደጋዎች እና የጥበቃ መንገዶች

!

የችሎታ ውህዶች እያለ ነባራዊ ስጋትን እንደ sci-fi ማከም።

!

ግራ የሚያጋባ የገጽታ ምርት ደህንነት በከፍተኛ ራስን በራስ የማስተዳደር አሰላለፍ።

!

ዝቅተኛ ጥራት ባላቸው ምንጮች ብቻ እንግሊዝኛ ያልሆኑ እና ባለሙያ ያልሆኑ ታዳሚዎችን መተው።

የትግበራ ፍኖተ ካርታ

1

የተለየ የምርት ጉዳት፣ አላግባብ መጠቀም እና መቆጣጠርን ማጣት/የማዛመድ አደጋዎች።

ይህንን እንደ የማስረጃ በር ይያዙት፡ መስፈርቶቹ ካልተሟሉ፣ መልቀቅን ለአፍታ ያቁሙ፣ ክፍተቱን ይዝጉ እና ከዚያ ብቻ አጠቃቀምን ያስፋፉ።

2

በጊዜ እና በክብደት ላይ ያለዎትን አመለካከት ምን አይነት ማስረጃ እንደሚለውጥ ይጠይቁ።

ይህንን እንደ የማስረጃ በር ይያዙት፡ መስፈርቶቹ ካልተሟሉ፣ መልቀቅን ለአፍታ ያቁሙ፣ ክፍተቱን ይዝጉ እና ከዚያ ብቻ አጠቃቀምን ያስፋፉ።

3

ከገበያ የይገባኛል ጥያቄዎች ይልቅ ዋና ምንጮችን እና ተጨባጭ ግምገማዎችን ይምረጡ።

ይህንን እንደ የማስረጃ በር ይያዙት፡ መስፈርቶቹ ካልተሟሉ፣ መልቀቅን ለአፍታ ያቁሙ፣ ክፍተቱን ይዝጉ እና ከዚያ ብቻ አጠቃቀምን ያስፋፉ።

4

አንድ የድርጊት መንገድን ይለዩ፡ ሙያ፣ ፖሊሲ፣ የገንዘብ ድጋፍ ወይም ችሎታ - ግንዛቤን ብቻ አይደለም።

ይህንን እንደ የማስረጃ በር ይያዙት፡ መስፈርቶቹ ካልተሟሉ፣ መልቀቅን ለአፍታ ያቁሙ፣ ክፍተቱን ይዝጉ እና ከዚያ ብቻ አጠቃቀምን ያስፋፉ።

ማሰስዎን ይቀጥሉ

Check your understanding

Test yourself: take the AI Safety quiz

Start quiz