Hva skjedde
Et forskerteam fra Carnegie Mellon, MIT og Cornell la ut to randomiserte casestudier 6. august som testet om korte AI-samtaler kunne motvirke konspirasjonstro mens fakta om store hendelser fortsatt dukket opp.
Forskerne analyserte 472 amerikanske voksne som uttrykte konspiratoriske synspunkter etter forsøket på å myrde Donald Trump i juli 2024 og 1035 etter attentatet mot Charlie Kirk i september 2025. Deltakerne ble tilfeldig tildelt en skreddersydd debunking-dialog, en ikke-relatert AI-samtale eller en statisk liste over samtidige fakta.
Dialoggruppene fullførte minst fem utvekslinger med Gemini 1.5 Pro i det første eksperimentet og Gemini 2.5 Pro i det andre. Begge modellene fikk en kurert faktabase som skilte bekreftet informasjon, avviste påstander og uløste spørsmål; den andre modellen kunne også søke på nettet bare for å bekrefte faktainformasjon.
På et 0-til-100-mål på troen på hver deltakers egen uttalte teori, ga de skreddersydde dialogene reduksjoner på 6,95 poeng i forhold til den ikke-relaterte chatkontrollen i det første eksperimentet og 7,56 poeng i det andre. Forskjeller fra det statiske faktaarket var 5,60 og 6,56 poeng. Papiret rapporterer standardiserte effekter på omtrent 0,32 til 0,38 for disse sammenligningene.
The two case studies were designed around moments when the factual record was still developing. The first followed the July 2024 attempt to assassinate Donald Trump; the second followed the September 2025 assassination of Charlie Kirk. Participants were screened for conspiratorial or uncertain interpretations, then assigned to a conversation that addressed their own stated theory, an unrelated AI chat, or a static contemporaneous fact sheet. The second study was preregistered, while the first was not, so the replication is informative but not equivalent to two independent confirmatory trials.
Kildedetaljer: Costello and colleagues' research paper on arXiv ↗
Hvorfor det betyr noe
Resultatet antyder at et samtalesystem kan gjøre mer enn å gjenta en korreksjon: det kan tilpasse fakta, spørsmål og usikkerhet til den spesifikke grunnen en person gir for en tro.
Denne forskjellen er nyttig under hendelser som beveger seg raskt, når bekreftede bevis er ufullstendige og et generisk faktaark kanskje ikke tar for seg påstanden en person faktisk finner overbevisende. Avisens strategianalyse fant at modellen støttet seg mer på troverdige kilder, åpne spørsmål og forsiktighet når lite var kjent, for så å bruke mer direkte bevis når den andre hendelsen hadde en større faktisk oversikt.
Forfatterne rapporterer også begrensede bevis for senere spillover. To måneder etter det første eksperimentet var det mindre sannsynlighet for at deltakere som ble tildelt dialogen, enn de sammenslåtte kontrollene, støttet to konspiratoriske tolkninger av en påfølgende hendelse. I den andre oppfølgingen reduserte ikke direkte behandlingsoppdrag signifikant troen på en senere skyting, selv om en egen forhåndsregistrert utholdenhetsanalyse og et bredere konspirasjonstiltak antydet mindre bæreeffekter.
The design shows why the interaction may outperform a static correction without proving that persuasion is always desirable. Gemini 1.5 Pro in the first study and Gemini 2.5 Pro in the second received researcher-curated fact bases separating confirmed information, debunked claims, and unresolved questions. The model could ask about the participant's specific reasoning and choose whether to answer directly, cite credible evidence, or preserve uncertainty. That adaptability is useful for education, but it also gives the system discretion over which claims to challenge and which sources to foreground.
Studien rettferdiggjør ikke automatisk distribusjon av overbevisende roboter i offentlige samtaler. Et system instruert om å endre tro har uvanlig kraft, og forfatterne bemerker at lignende teknikker også kan øke troen på falske påstander. Enhver reell tjeneste vil trenge gjennomsiktig forfatterskap, pålitelig hendelsesforankring, beskyttelse mot politisk målretting og uavhengige tester av nøyaktighet og utilsiktede effekter.
Interaktiv mekanisme: Hvordan det faktisk fungerer
Utforsk den underliggende teknologien bak denne utviklingen interaktivt.
Impossibility results in algorithmic fairness (e.g. Kleinberg et al., Chouldechova) show what?
Hva du skal se neste
Se etter fagfellevurdering, replikering utover to amerikanske politiske kriser, og feltbevis som viser om folk velger å bruke et slikt verktøy uten å bli rekruttert til en studie.
Dette er et nytt preprint bygget rundt to case-studier. Det første eksperimentet ble ikke forhåndsregistrert, det andre var, og begge målte selvrapporterte tro umiddelbart etter en kort interaksjon på nettet i stedet for delingsatferd, stemmegivning eller langsiktig tillit.
De analyserte prøvene inkluderte bare deltakere hvis åpne svar ble klassifisert som konspiratoriske eller usikre av GPT-4o, selv om forfatterne rapporterer lignende mønstre under alternative klassifiseringsregler. Begge studiene rekrutterte amerikanske voksne gjennom CloudResearch, så funnene kan ikke overføres til andre land, språk, begivenheter eller populasjoner.
Modellene var ikke avhengig av kunnskap uten hjelp: Forskerne leverte nøye sammensatte faktagrunnlag og eksplisitte overtalelsesinstruksjoner. Fremtidig arbeid bør teste hvem som opprettholder disse faktaene under tidsfristpress, hvordan feil korrigeres, om motstridende synspunkter behandles konsekvent, og når et system bør bevare usikkerhet i stedet for å prøve å overtale.
There is also a measurement distinction between changing a stated belief and improving a person's understanding. The outcomes were self-reported ratings collected after short online conversations, not observed sharing behavior, source checking, voting, or decisions made during a live crisis. The paper's follow-ups provide early evidence about persistence, but the mixed results mean a later study should pre-register long-term outcomes, track attrition, and test whether participants can explain the evidence themselves rather than simply repeating the model's conclusion.
Replication should vary the source of the factual record as well as the population. These experiments supplied researchers' own fact bases and recruited US adults through CloudResearch, which makes the setup unusually controlled but leaves open questions about multilingual events, lower-connectivity settings, and crises in which official information is delayed or disputed. A responsible field trial would make the model's authorship visible, let participants decline the intervention, log which evidence was shown, and use independent adjudicators to check whether the dialogue corrected a misconception without introducing a new one. It should measure trust, emotional response, and willingness to share claims alongside belief scores.