Apa yang terjadi
Tim peneliti Carnegie Mellon, MIT, dan Cornell memposting dua studi kasus acak pada tanggal 6 Agustus yang menguji apakah percakapan singkat AI dapat melawan keyakinan konspirasi sementara fakta tentang peristiwa besar masih bermunculan.
Para peneliti menganalisis 472 orang dewasa AS yang menyatakan pandangan konspirasi setelah upaya pembunuhan Donald Trump pada Juli 2024 dan 1.035 setelah pembunuhan Charlie Kirk pada September 2025. Peserta secara acak ditugaskan untuk melakukan dialog sanggahan yang disesuaikan, percakapan AI yang tidak terkait, atau daftar statis fakta-fakta yang ada pada saat itu.
Kelompok dialog menyelesaikan setidaknya lima pertukaran dengan Gemini 1.5 Pro pada percobaan pertama dan Gemini 2.5 Pro pada percobaan kedua. Kedua model menerima basis fakta yang dikurasi yang memisahkan informasi yang dikonfirmasi, klaim yang terbantahkan, dan pertanyaan yang belum terselesaikan; model kedua juga dapat menelusuri web hanya untuk memverifikasi informasi faktual.
Pada ukuran kepercayaan 0 hingga 100 terhadap teori yang dinyatakan masing-masing peserta, dialog yang disesuaikan menghasilkan pengurangan sebesar 6,95 poin dibandingkan dengan kontrol obrolan yang tidak terkait pada percobaan pertama dan 7,56 poin pada percobaan kedua. Selisih dari lembar fakta statis adalah 5,60 dan 6,56 poin. Makalah ini melaporkan dampak standar sekitar 0,32 hingga 0,38 untuk perbandingan tersebut.
Kedua studi kasus tersebut dirancang berdasarkan momen ketika catatan faktual masih berkembang. Yang pertama terjadi setelah upaya pembunuhan Donald Trump pada Juli 2024; yang kedua menyusul pembunuhan Charlie Kirk pada September 2025. Peserta disaring untuk interpretasi konspirasi atau ketidakpastian, kemudian ditugaskan ke percakapan yang membahas teori mereka sendiri, obrolan AI yang tidak terkait, atau lembar fakta statis pada saat itu. Penelitian kedua telah didaftarkan sebelumnya, sedangkan penelitian pertama tidak, sehingga replikasi ini bersifat informatif namun tidak setara dengan dua uji coba konfirmasi independen.
Detail sumber: Costello and colleagues' research paper on arXiv โ
Mengapa itu penting
Hasilnya menunjukkan bahwa sistem percakapan dapat melakukan lebih dari sekadar mengulangi koreksi: sistem ini dapat menyesuaikan fakta, pertanyaan, dan ketidakpastian dengan alasan spesifik yang diberikan seseorang atas suatu keyakinan.
Pembedaan ini berguna ketika peristiwa terjadi dengan cepat, ketika bukti yang terverifikasi tidak lengkap dan lembar fakta umum mungkin tidak menjawab klaim yang dianggap persuasif oleh seseorang. Analisis strategi makalah ini menemukan bahwa model tersebut lebih mengandalkan sumber yang kredibel, pertanyaan terbuka, dan kehati-hatian ketika hanya sedikit yang diketahui, kemudian menggunakan lebih banyak bukti langsung ketika peristiwa kedua memiliki catatan faktual yang lebih besar.
Para penulis juga melaporkan bukti terbatas mengenai dampak limpahan di kemudian hari. Dua bulan setelah percobaan pertama, peserta yang ditugaskan untuk berdialog cenderung tidak mendukung dua interpretasi konspirasi terhadap peristiwa berikutnya dibandingkan kelompok kontrol. Pada tindak lanjut kedua, pemberian pengobatan langsung tidak secara signifikan mengurangi keyakinan mengenai penembakan berikutnya, meskipun analisis persistensi terpisah yang telah didaftarkan sebelumnya dan ukuran konspirasi yang lebih luas menunjukkan dampak yang lebih kecil.
Desain tersebut menunjukkan mengapa interaksi dapat mengungguli koreksi statis tanpa membuktikan bahwa persuasi selalu diinginkan. Gemini 1.5 Pro pada studi pertama dan Gemini 2.5 Pro pada studi kedua menerima basis fakta yang dikurasi peneliti yang memisahkan informasi yang dikonfirmasi, klaim yang dibantah, dan pertanyaan yang belum terselesaikan. Model tersebut dapat menanyakan alasan spesifik peserta dan memilih apakah akan menjawab secara langsung, mengutip bukti yang dapat dipercaya, atau mempertahankan ketidakpastian. Kemampuan beradaptasi tersebut berguna bagi pendidikan, namun juga memberikan keleluasaan pada sistem mengenai klaim mana yang perlu ditentang dan sumber mana yang harus dikedepankan.
Studi ini tidak membenarkan penggunaan bot persuasif secara otomatis dalam percakapan publik. Sebuah sistem yang diinstruksikan untuk mengubah keyakinan memiliki kekuatan yang tidak biasa, dan penulis mencatat bahwa teknik serupa juga dapat meningkatkan keyakinan terhadap klaim yang salah. Layanan nyata apa pun memerlukan penulis yang transparan, landasan acara yang andal, perlindungan terhadap penargetan politik, dan pengujian independen atas keakuratan dan dampak yang tidak diinginkan.
Mekanisme Interaktif: Cara Kerja Sebenarnya
Jelajahi teknologi yang mendasari di balik perkembangan ini secara interaktif.
Impossibility results in algorithmic fairness (e.g. Kleinberg et al., Chouldechova) show what?
Apa yang harus ditonton selanjutnya
Perhatikan tinjauan sejawat, replikasi setelah dua krisis politik AS, dan bukti lapangan yang menunjukkan apakah masyarakat memilih untuk menggunakan alat tersebut tanpa direkrut ke dalam penelitian.
Ini adalah pracetak baru yang dibangun berdasarkan dua studi kasus. Eksperimen pertama tidak didaftarkan sebelumnya, sedangkan eksperimen kedua sudah didaftarkan sebelumnya, dan keduanya mengukur keyakinan yang dilaporkan sendiri segera setelah interaksi online singkat, bukan perilaku berbagi, pemungutan suara, atau kepercayaan jangka panjang di dunia nyata.
Sampel yang dianalisis hanya mencakup peserta yang tanggapan terbukanya diklasifikasikan sebagai konspirasi atau ketidakpastian oleh GPT-4o, meskipun penulis melaporkan pola serupa berdasarkan aturan klasifikasi alternatif. Kedua penelitian tersebut merekrut orang dewasa Amerika melalui CloudResearch, sehingga temuannya tidak dapat ditransfer ke negara, bahasa, peristiwa, atau populasi lain.
Model-model tersebut tidak mengandalkan pengetahuan tanpa bantuan: para peneliti menyediakan basis fakta yang disusun dengan cermat dan instruksi persuasi yang eksplisit. Penelitian di masa depan harus menguji siapa yang mempertahankan fakta-fakta tersebut di bawah tekanan tenggat waktu, bagaimana kesalahan diperbaiki, apakah sudut pandang yang berlawanan diperlakukan secara konsisten, dan kapan suatu sistem harus menjaga ketidakpastian dan bukannya mencoba membujuk.
Ada juga perbedaan pengukuran antara mengubah keyakinan yang dinyatakan dan meningkatkan pemahaman seseorang. Hasilnya adalah penilaian yang dilaporkan sendiri yang dikumpulkan setelah percakapan online singkat, bukan perilaku berbagi yang diamati, pemeriksaan sumber, pemungutan suara, atau keputusan yang dibuat selama krisis langsung. Tindak lanjut dari makalah ini memberikan bukti awal tentang persistensi, namun hasil yang beragam berarti penelitian selanjutnya harus mencatat hasil jangka panjang, melacak pengurangan, dan menguji apakah peserta dapat menjelaskan sendiri bukti tersebut daripada sekadar mengulangi kesimpulan model.
Replikasi harus memvariasikan sumber catatan faktual dan juga populasinya. Eksperimen ini memberikan basis fakta yang dimiliki para peneliti dan merekrut orang dewasa AS melalui CloudResearch, yang membuat pengaturannya sangat terkontrol namun menyisakan pertanyaan terbuka tentang peristiwa multibahasa, pengaturan konektivitas yang lebih rendah, dan krisis di mana informasi resmi tertunda atau diperdebatkan. Uji coba lapangan yang bertanggung jawab akan membuat kepenulisan model terlihat, membiarkan peserta menolak intervensi, mencatat bukti mana yang ditunjukkan, dan menggunakan juri independen untuk memeriksa apakah dialog tersebut mengoreksi kesalahpahaman tanpa memperkenalkan yang baru. Penilaian ini harus mengukur kepercayaan, respons emosional, dan kesediaan untuk berbagi klaim serta skor keyakinan.