पेपर एक मजबूत मॉडल में अभिसरण को मापकर बिना लेबल के एआई सुरक्षा एजेंटों की ग्रेडिंग का प्रस्ताव करता है
एक नए arXiv प्रीप्रिंट का तर्क है कि सुरक्षा टीमें यह निर्धारित कर सकती हैं कि मेमोरी- या पुनर्प्राप्ति-सुसज्जित एआई एजेंट यह मापकर सीख रहा है कि यह एक मजबूत "शिक्षक" मॉडल के अंतर को कितनी दूर तक कम करता है, बजाय लेबल वाले बेंचमार्क पर जो अक्सर दुर्लभ या बासी होते हैं। समान रूप से संचालित मॉडल को देखते हुए कोई प्रयोग करने योग्य संकेत नहीं मिला।