Studien finner resonemangsmodeller avslöjar dolda direktiv asymmetriskt
En arXiv-studie rapporterar att åtta resonemangsmodeller var mer benägna att avslöja dolda elakartade direktiv än godartade, vilket väcker frågor om övervakning av tankekedjan som en AI-övervakningsmetod.