Paper, Kendini Geliştiren Yapay Zeka Aracılarının Güvenli Olmayan Bir Başarıyı Yeniden Kullanılabilir Bir Beceriye Dönüştürebileceğini Söyledi
Yeni bir arXiv ön baskısı, belirli bir aracı hata modunu karşılaştırır: Kendini geliştiren bir aracı, güvenli olmayan bir prosedürü belleğe yazdığında, daha sonraki oturumlarda geri alınabilir ve yürütülebilir. Test edilen her geliştirilmiş konfigürasyon, güvenli olmayan yapılar üretti ve üç kötü amaçlı görev, aktarım saldırılarının başarısını iki kattan fazla artırdı.