Paper, Daha Güçlü Bir Modele Yakınsamayı Ölçerek Yapay Zeka Güvenlik Aracılarının Etiketsiz Derecelendirilmesini Öneriyor
Yeni bir arXiv ön baskısı, güvenlik ekiplerinin, bellek veya erişim donanımlı bir yapay zeka aracısının, çoğunlukla kıt veya bayat olan etiketli ölçütler yerine, daha güçlü bir "öğretmen" modeliyle aradaki farkı ne kadar kapattığını ölçerek öğrenip öğrenmediğini değerlendirebileceğini öne sürüyor. Benzer şekilde güçlü bir modele bakılırsa kullanılabilir bir sinyal verilmedi.