Nini kilitokea
Timu ya watafiti ya Carnegie Mellon, MIT, na Cornell walichapisha tafiti mbili za kesi zisizo na mpangilio mnamo Agosti 6 kupima ikiwa mazungumzo mafupi ya AI yanaweza kupinga imani za njama wakati ukweli juu ya matukio makubwa bado yanaibuka.
Watafiti hao walichambua watu wazima 472 wa Marekani ambao walionyesha maoni ya kula njama baada ya jaribio la Julai 2024 la kumuua Donald Trump na 1,035 baada ya mauaji ya Septemba 2025 ya Charlie Kirk. Washiriki walipewa kwa nasibu mazungumzo ya utatuzi yaliyolengwa maalum, mazungumzo ya AI yasiyohusiana, au orodha tuli ya ukweli wa wakati huo huo.
Vikundi vya mazungumzo vilikamilisha angalau mabadilishano matano na Gemini 1.5 Pro katika jaribio la kwanza na Gemini 2.5 Pro katika jaribio la pili. Miundo yote miwili ilipokea msingi ulioratibiwa ambao ulitenganisha maelezo yaliyothibitishwa, madai yaliyokanushwa na maswali ambayo hayajatatuliwa; mtindo wa pili pia unaweza kutafuta wavuti ili tu kuthibitisha habari za kweli.
Kwa kipimo cha 0 hadi 100 cha imani katika nadharia iliyobainishwa ya kila mshiriki, mazungumzo yaliyolengwa yalitoa punguzo la pointi 6.95 ikilinganishwa na udhibiti wa gumzo usiohusiana katika jaribio la kwanza na pointi 7.56 katika la pili. Tofauti kutoka kwa karatasi ya ukweli tuli ilikuwa 5.60 na 6.56. Karatasi inaripoti athari sanifu za takriban 0.32 hadi 0.38 kwa ulinganisho huo.
Uchunguzi wa kesi mbili uliundwa wakati ambapo rekodi ya ukweli ilikuwa bado inaendelezwa. Ya kwanza ilifuatia jaribio la Julai 2024 la kumuua Donald Trump; ya pili ilifuatia mauaji ya Septemba 2025 ya Charlie Kirk. Washiriki walikaguliwa ili kubaini tafsiri za njama au zisizo na uhakika, kisha wakapewa mazungumzo ambayo yalishughulikia nadharia yao wenyewe iliyobainishwa, gumzo la AI lisilohusiana, au karatasi ya ukweli tuli ya wakati mmoja. Utafiti wa pili ulisajiliwa mapema, wakati wa kwanza haukusajiliwa, kwa hivyo urudiaji ni wa taarifa lakini si sawa na majaribio mawili huru ya uthibitishaji.
Maelezo ya chanzo: Costello and colleagues' research paper on arXiv β
Kwa nini ni muhimu
Tokeo linapendekeza kwamba mfumo wa mazungumzo unaweza kufanya zaidi ya kurudia kusahihisha: unaweza kurekebisha ukweli, maswali, na kutokuwa na uhakika kwa sababu maalum ambayo mtu hutoa kwa imani.
Tofauti hiyo ni muhimu wakati wa matukio ya mwendo kasi, wakati ushahidi uliothibitishwa haujakamilika na karatasi ya ukweli inaweza isishughulikie dai ambalo mtu hupata kuwa la kushawishi. Uchanganuzi wa mkakati wa karatasi uligundua kuwa mtindo uliegemea zaidi kwenye vyanzo vya kuaminika, maswali wazi, na tahadhari wakati machache yanajulikana, kisha ikatumia ushahidi wa moja kwa moja wakati tukio la pili lilikuwa na rekodi kubwa ya ukweli.
Waandishi pia wanaripoti ushahidi mdogo wa utiririshaji wa baadaye. Miezi miwili baada ya jaribio la kwanza, washiriki waliopewa mazungumzo walikuwa na uwezekano mdogo kuliko udhibiti wa pamoja ili kuidhinisha tafsiri mbili za njama za tukio lililofuata. Katika ufuatiliaji wa pili, mgawo wa matibabu ya moja kwa moja haukupunguza sana imani kuhusu upigaji risasi baadaye, ingawa uchanganuzi tofauti wa kudumu uliosajiliwa mapema na hatua pana ya njama ilipendekeza athari ndogo za kubeba.
Muundo unaonyesha kwa nini mwingiliano unaweza kufaulu kuliko urekebishaji tuli bila kuthibitisha kwamba ushawishi unahitajika kila wakati. Gemini 1.5 Pro katika utafiti wa kwanza na Gemini 2.5 Pro katika utafiti wa pili zilipokea misingi ya ukweli iliyoratibiwa na mtafiti inayotenganisha maelezo yaliyothibitishwa, madai yaliyotupiliwa mbali na maswali ambayo hayajatatuliwa. Muundo unaweza kuuliza kuhusu hoja mahususi za mshiriki na kuchagua kujibu moja kwa moja, kutaja ushahidi wa kuaminika, au kuhifadhi kutokuwa na uhakika. Kutobadilika huko ni muhimu kwa elimu, lakini pia kunaupa mfumo uamuzi juu ya madai yapi ya kupinga na ni vyanzo vipi vya kutanguliza.
Utafiti hauhalalishi kupeleka roboti zinazoshawishi kiotomatiki kwenye mazungumzo ya umma. Mfumo ulioagizwa kubadili imani una nguvu isiyo ya kawaida, na waandishi wanabainisha kuwa mbinu kama hizo zinaweza pia kuongeza imani katika madai ya uwongo. Huduma yoyote halisi itahitaji uandishi ulio wazi, msingi wa matukio unaotegemewa, ulinzi dhidi ya ulengaji wa kisiasa, na majaribio huru ya usahihi na athari zisizotarajiwa.
Mbinu shirikishi: Jinsi Inavyofanya Kazi Kweli
Chunguza teknolojia msingi nyuma ya ukuzaji huu kwa maingiliano.
Impossibility results in algorithmic fairness (e.g. Kleinberg et al., Chouldechova) show what?
Nini cha kutazama baadaye
Tazama uhakiki wa marika, urudufishaji zaidi ya migogoro miwili ya kisiasa ya Marekani, na ushahidi wa eneo unaoonyesha kama watu watachagua kutumia zana kama hiyo bila kuajiriwa katika utafiti.
Hiki ni kielelezo kipya kilichojengwa karibu na visasili viwili. Jaribio la kwanza halikusajiliwa mapema, la pili lilikuwa, na zote mbili zilipima imani za kujiripoti mara tu baada ya mwingiliano mfupi wa mtandaoni badala ya tabia ya kushiriki katika ulimwengu halisi, upigaji kura au uaminifu wa muda mrefu.
Sampuli zilizochanganuliwa zilijumuisha washiriki pekee ambao majibu yao ya wazi yaliainishwa kama ya kula njama au kutokuwa na uhakika na GPT-4o, ingawa waandishi wanaripoti mifumo kama hiyo chini ya sheria mbadala za uainishaji. Masomo yote mawili yaliajiri watu wazima wa Marekani kupitia CloudResearch, kwa hivyo matokeo hayawezi kuhamishwa hadi nchi nyingine, lugha, matukio au idadi ya watu.
Mifano hazikutegemea ujuzi usiosaidiwa: watafiti walitoa misingi ya ukweli iliyokusanywa kwa uangalifu na maagizo ya ushawishi ya wazi. Kazi ya siku zijazo inapaswa kupima ni nani hudumisha ukweli huo chini ya shinikizo la tarehe ya mwisho, jinsi makosa yanavyorekebishwa, kama maoni yanayopingana yanashughulikiwa kwa uthabiti, na wakati mfumo unapaswa kuhifadhi kutokuwa na uhakika badala ya kujaribu kushawishi.
Pia kuna tofauti ya kipimo kati ya kubadilisha imani iliyotajwa na kuboresha uelewa wa mtu. Matokeo yalikuwa ukadiriaji ulioripotiwa kibinafsi uliokusanywa baada ya mazungumzo mafupi ya mtandaoni, bila kuzingatiwa tabia ya kushiriki, kuangalia vyanzo, kupiga kura au maamuzi yaliyofanywa wakati wa shida ya moja kwa moja. Ufuatiliaji wa karatasi hutoa ushahidi wa mapema kuhusu kuendelea, lakini matokeo mchanganyiko yanamaanisha kuwa utafiti wa baadaye unapaswa kusajili mapema matokeo ya muda mrefu, kufuatilia upungufu, na kupima ikiwa washiriki wanaweza kueleza ushahidi wenyewe badala ya kurudia tu hitimisho la mtindo.
Uigaji unapaswa kutofautiana chanzo cha rekodi ya ukweli na pia idadi ya watu. Majaribio haya yalitoa misingi ya ukweli ya watafiti wenyewe na kuajiri watu wazima wa Marekani kupitia CloudResearch, ambayo hufanya usanidi kudhibitiwa isivyo kawaida lakini huacha maswali wazi kuhusu matukio ya lugha nyingi, mipangilio ya muunganisho wa chini, na migogoro ambapo taarifa rasmi hucheleweshwa au kupingwa. Jaribio la uga linalowajibika litafanya uandishi wa modeli uonekane, kuruhusu washiriki kukataa kuingilia kati, kuweka kumbukumbu ya ushahidi ulioonyeshwa, na kutumia waamuzi huru kukagua kama mazungumzo yalisahihisha dhana potofu bila kuanzisha mpya. Inapaswa kupima uaminifu, mwitikio wa kihisia, na nia ya kushiriki madai pamoja na alama za imani.