Ne oldu?
Carnegie Mellon, MIT ve Cornell araştırma ekibi, 6 Ağustos'ta, büyük olaylarla ilgili gerçekler henüz ortaya çıkarken, kısa yapay zeka konuşmalarının komplo inançlarına karşı gelip gelemeyeceğini test eden iki rastgele vaka çalışması yayınladı.
Araştırmacılar, Temmuz 2024'te Donald Trump'a düzenlenen suikast girişiminin ardından komplocu görüşlerini ifade eden 472 ABD'li yetişkini ve Eylül 2025'te Charlie Kirk'e düzenlenen suikastın ardından 1.035 yetişkini analiz etti. Katılımcılar, özel olarak hazırlanmış bir çürütme diyaloğuna, ilgisiz bir yapay zeka sohbetine veya güncel gerçeklerin statik bir listesine rastgele atandılar.
Diyalog grupları, ilk deneyde Gemini 1.5 Pro ve ikinci deneyde Gemini 2.5 Pro ile en az beş değişim gerçekleştirdi. Her iki modele de doğrulanmış bilgileri, çürütülmüş iddiaları ve çözülmemiş soruları ayıran seçilmiş bir bilgi tabanı verildi; ikinci model ayrıca yalnızca gerçek bilgileri doğrulamak için web'de arama yapabilir.
Her katılımcının kendi belirttiği teorisine olan inancının 0 ila 100'lük bir ölçüsünde, özel diyaloglar, ilk deneyde ilgisiz sohbet kontrolüne göre 6,95 puanlık ve ikinci deneyde 7,56 puanlık azalmalar üretti. Statik bilgi formundan farklar 5,60 ve 6,56 puandı. Makale, bu karşılaştırmalar için kabaca 0,32 ila 0,38 arasında standartlaştırılmış etkiler rapor ediyor.
The two case studies were designed around moments when the factual record was still developing. The first followed the July 2024 attempt to assassinate Donald Trump; the second followed the September 2025 assassination of Charlie Kirk. Participants were screened for conspiratorial or uncertain interpretations, then assigned to a conversation that addressed their own stated theory, an unrelated AI chat, or a static contemporaneous fact sheet. The second study was preregistered, while the first was not, so the replication is informative but not equivalent to two independent confirmatory trials.
Kaynak ayrıntıları: Costello and colleagues' research paper on arXiv ↗
Neden önemli?
Sonuç, konuşma sisteminin bir düzeltmeyi tekrarlamaktan daha fazlasını yapabileceğini gösteriyor: Gerçekleri, soruları ve belirsizliği, kişinin bir inanç için öne sürdüğü spesifik nedene göre uyarlayabiliyor.
Bu ayrım, hızlı gelişen olaylar sırasında, doğrulanmış kanıtların eksik olduğu ve genel bir bilgi formunun kişinin gerçekten ikna edici bulduğu iddiayı ele almayabileceği durumlarda faydalıdır. Makalenin strateji analizi, modelin daha çok güvenilir kaynaklara, açık sorulara ve çok az şey bilindiğinde ihtiyatlı olmaya dayandığını, daha sonra ikinci olay daha büyük bir olgu kaydına sahip olduğunda daha doğrudan kanıtlar kullandığını buldu.
Yazarlar ayrıca daha sonraki yayılmaya ilişkin sınırlı kanıt da rapor ediyorlar. İlk deneyden iki ay sonra, diyaloğa atanan katılımcıların daha sonraki bir olayla ilgili iki komplocu yorumu onaylama olasılıkları, birleştirilmiş kontrol gruplarına göre daha azdı. İkinci takipte, doğrudan tedavi ataması, daha sonraki bir silahlı saldırıyla ilgili inançları önemli ölçüde azaltmadı; ancak önceden kaydedilmiş ayrı bir devamlılık analizi ve daha geniş bir komplo ölçümü, daha küçük aktarma etkileri olduğunu gösterdi.
The design shows why the interaction may outperform a static correction without proving that persuasion is always desirable. Gemini 1.5 Pro in the first study and Gemini 2.5 Pro in the second received researcher-curated fact bases separating confirmed information, debunked claims, and unresolved questions. The model could ask about the participant's specific reasoning and choose whether to answer directly, cite credible evidence, or preserve uncertainty. That adaptability is useful for education, but it also gives the system discretion over which claims to challenge and which sources to foreground.
Çalışma, ikna edici botların kamuya açık konuşmalara otomatik olarak yerleştirilmesini haklı çıkarmıyor. İnançları değiştirmeye yönelik bir sistem olağandışı bir güce sahip ve yazarlar benzer tekniklerin aynı zamanda yanlış iddialara olan inancı da artırabileceğini belirtiyor. Herhangi bir gerçek hizmetin şeffaf yazarlığa, güvenilir olay temeline, siyasi hedeflemeye karşı önlemlere ve doğruluk ve istenmeyen etkilere ilişkin bağımsız testlere ihtiyacı olacaktır.
İnteraktif Mekanizma: Aslında Nasıl Çalışıyor?
Bu gelişmenin arkasında yatan teknolojiyi etkileşimli olarak keşfedin.
Impossibility results in algorithmic fairness (e.g. Kleinberg et al., Chouldechova) show what?
Bundan sonra ne izlenecek?
Hakem incelemesini, ABD'deki iki siyasi krizin ötesindeki kopyaları ve insanların bir çalışmaya dahil edilmeden böyle bir aracı kullanmayı tercih edip etmediklerini gösteren saha kanıtlarını izleyin.
Bu, iki vaka çalışması etrafında oluşturulmuş yeni bir ön baskıdır. İlk deney önceden kaydedilmemişti, ikincisi ise öyleydi ve her ikisi de gerçek dünyadaki paylaşım davranışı, oy verme veya uzun vadeli güven yerine, kısa bir çevrimiçi etkileşimin hemen ardından kişinin bildirdiği inançları ölçtü.
Analiz edilen örnekler yalnızca açık yanıtları GPT-4o tarafından komplocu veya belirsiz olarak sınıflandırılan katılımcıları içeriyordu, ancak yazarlar alternatif sınıflandırma kuralları altında benzer kalıplar bildiriyor. Her iki çalışmaya da CloudResearch aracılığıyla ABD'li yetişkinler dahil edildi; dolayısıyla bulgular diğer ülkelere, dillere, etkinliklere veya nüfuslara aktarılamayabilir.
Modeller yardımsız bilgiye dayanmıyordu: Araştırmacılar dikkatlice bir araya getirilmiş bilgi tabanları ve açık ikna talimatları sağladı. Gelecekteki çalışmalar, son tarih baskısı altında bu gerçekleri kimin koruduğunu, hataların nasıl düzeltildiğini, karşıt bakış açılarının tutarlı bir şekilde ele alınıp alınmadığını ve bir sistemin ne zaman ikna etmeye çalışmak yerine belirsizliği koruması gerektiğini test etmelidir.
There is also a measurement distinction between changing a stated belief and improving a person's understanding. The outcomes were self-reported ratings collected after short online conversations, not observed sharing behavior, source checking, voting, or decisions made during a live crisis. The paper's follow-ups provide early evidence about persistence, but the mixed results mean a later study should pre-register long-term outcomes, track attrition, and test whether participants can explain the evidence themselves rather than simply repeating the model's conclusion.
Replication should vary the source of the factual record as well as the population. These experiments supplied researchers' own fact bases and recruited US adults through CloudResearch, which makes the setup unusually controlled but leaves open questions about multilingual events, lower-connectivity settings, and crises in which official information is delayed or disputed. A responsible field trial would make the model's authorship visible, let participants decline the intervention, log which evidence was shown, and use independent adjudicators to check whether the dialogue corrected a misconception without introducing a new one. It should measure trust, emotional response, and willingness to share claims alongside belief scores.