Mwongozo wa AI unaoonekana

Sehemu ya Panoptic

Mgawanyiko wa panoptic huipa kila pikseli moja katika picha lebo, ikiunganisha 'eneo hili ni nini' na 'kipengee gani mahususi hiki.' Ni aina kamili zaidi ya uelewa wa eneo katika maono ya kompyuta.

dk 2 kusomaIlisasishwa mwisho

Dive ya kina

Maono ya kompyuta kwa muda mrefu yalikuwa na kazi mbili tofauti. Sehemu za kisemantiki huweka lebo kila pikseli kulingana na kategoria (barabara, anga, mtu) lakini haiwezi kuwatofautisha watu wawili. Mgawanyo wa matukio hupata na kubainisha vitu vinavyoweza kuhesabika binafsi lakini hupuuza 'vitu' vya usuli kama vile anga au nyasi. Sehemu za panoptic, zilizorasimishwa na watafiti wa Facebook AI mwaka wa 2018, huunganisha zote mbili: huweka kila pikseli kategoria, na kwa 'vitu' vinavyoweza kuhesabika pia hutoa kitambulisho cha mfano wa kipekee. Matokeo yake ni ramani moja iliyoshikamana isiyo na mapungufu au mwingiliano. Ubora hupimwa kwa Ubora wa Panoptic (PQ), ambayo huchanganya jinsi maeneo yanatambuliwa kwa usahihi na jinsi mipaka yao inavyolingana. Ni muhimu popote ambapo mashine lazima ielewe tukio zima kabisa, kama vile gari linalojiendesha linalotafsiri mtaani.

Ufahamu wa Kiufundi

Miundo ya panoptic inagawanya lebo katika 'vitu' (vitu vinavyohesabika kama vile magari na watu, wanaopata vitambulisho vya mfano) na 'vitu' (maeneo ya amofasi kama vile barabara au anga, ambayo hayapati). Mifumo ya awali iliendesha matawi tofauti ya kisemantiki na mfano, kisha ikaunganisha na sheria za kutatua mizozo ya pikseli. Mbinu mpya zaidi za kibadilishaji kibadilishaji kama Mask2Former hutabiri seti ya vinyago vilivyo na lebo za darasa zinazohusiana moja kwa moja, kushughulikia vitu na vitu katika usanifu mmoja uliounganishwa.

Athari za kimkakati

Kasi na kiwango

Visual AI inaweza kufanya ukaguzi, ugunduzi na kazi za kuweka lebo kiotomatiki kwa kiwango.

Tengeneza chaguzi

Timu bunifu zinaweza kuiga dhana kwa haraka zaidi na masahihisho machache ya mikono.

Timu na mtiririko wa kazi

Uendeshaji unaweza kutumia ishara za picha na video ambazo hapo awali zilikuwa ngumu kuchakata.

Mustakabali wa Mgawanyiko wa Panoptic

Uga huu unajumuisha usanifu wa kibadilishaji chenye umoja, unaotegemea hoja unaoshughulikia kazi za kisemantiki, mfano na panoptic kwa muundo mmoja. Utafiti unalenga katika ugawaji wa mandhari ya video ambao huweka utambulisho wa mifano sawia katika fremu zote, miundo ya msamiati wazi ambayo inagawanya kategoria zilizofafanuliwa katika maandishi, na miundo nyepesi yenye ufanisi wa kutosha kwa roboti na magari. Data bora ya mafunzo ya usanii na kujisimamia inapunguza gharama kubwa ya ufafanuzi wa mwongozo wa pixel-kamilifu.

Utekelezaji wa Ulimwengu Halisi

Magari yanayojiendesha yanaunda ramani kamili ya kiwango cha pikseli inayotofautisha kila gari, mtembea kwa miguu, barabara na kinjia.

Taswira ya kimatibabu inayoweka lebo sehemu za kiungo wakati wa kuhesabu vidonda vya mtu binafsi au seli

Programu za uhalisia ulioboreshwa ambazo hutenganisha kila kitu na uso ili kuweka maudhui pepe kihalisi

Mifumo ya roboti ambayo huchanganua kikamilifu eneo lenye vitu vingi ili kupanga kukamata na kusogeza

Hatari & Walinzi

Haki za picha na idhini zinaweza kuwa hatari za kisheria ikiwa asili haiko wazi.

Utendaji wa muundo unaweza kutofautiana katika mwangaza, idadi ya watu na mazingira.

Chanya za uwongo zinaweza kutotambuliwa isipokuwa viwango vya uaminifu vifuatiliwe.

Ramani ya Utekelezaji

1

Bainisha vigezo vya kukubalika vya usahihi, kumbukumbu na gharama za makosa.

2

Jaribu kwa kutumia data inayolingana na hali halisi ya uzalishaji.

3

Ongeza ukaguzi wa kibinadamu kwa utabiri wa chini au utabiri wa athari kubwa.

4

Fuatilia mtindo wa kuteleza na uthibitishe upya baada ya mabadiliko ya kamera au mkusanyiko wa data.

Endelea Kuchunguza

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Panoptic Segmentation quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Anza chemsha bongo

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Mwongozo unaofuata

Sehemu ya Picha

Maswali yanayoulizwa mara kwa mara

What is Panoptic Segmentation?

Mgawanyiko wa panoptic huipa kila pikseli moja katika picha lebo, ikiunganisha 'eneo hili ni nini' na 'kipengee gani mahususi hiki.' Ni aina kamili zaidi ya uelewa wa eneo katika maono ya kompyuta.

Je! Sehemu ya panoptic inapeana nini kila pikseli kwenye picha?

Sehemu za panoptic huweka lebo kila pikseli iliyo na kategoria na pia hupeana 'vitu' vingi kitambulisho cha mfano cha kipekee, bila kuacha mapengo au mwingiliano.

Katika istilahi ya panoptic, madarasa ya 'vitu' ni nini?

'Vitu' hurejelea maeneo ya mandharinyuma yasiyohesabika, yenye amofasi kama vile anga au barabara, ambayo hupokea aina lakini hakuna kitambulisho cha mfano.

Ni kizuizi gani kikuu cha sehemu za kisemantiki ambacho sehemu za panoptic hushinda?

Semantiki huweka lebo za pikseli kulingana na kategoria lakini haziwezi kutenganisha watu wawili kutoka kwa kila mmoja; panoptic inaongeza utambulisho wa mfano.

Ni kipimo gani kinatumika kutathmini ubora wa sehemu za panoptic?

Ubora wa Panoptic (PQ) unachanganya usahihi wa utambuzi na mwingiliano wa sehemu ili kuonyesha jinsi mambo na mambo yanavyotabiriwa.

Madarasa ya 'vitu' hupokea nini ambayo madarasa ya 'vitu' hayapati?

'Vitu' vinavyoweza kuhesabika hupata kitambulisho cha mfano wa kipekee ili vitu mahususi viweze kutofautishwa, huku 'vitu' vikipata kategoria pekee.