কাগজ একটি শক্তিশালী মডেলের অভিসারী পরিমাপ করে লেবেল ছাড়া AI নিরাপত্তা এজেন্টদের গ্রেড করার প্রস্তাব দেয়
একটি নতুন arXiv প্রিপ্রিন্ট যুক্তি দেয় যে নিরাপত্তা দল বিচার করতে পারে যে একটি মেমরি- বা পুনরুদ্ধার-সজ্জিত AI এজেন্ট শিখছে কিনা তা পরিমাপ করে কতদূর এটি একটি শক্তিশালী "শিক্ষক" মডেলের ফাঁক বন্ধ করে, লেবেলযুক্ত বেঞ্চমার্কের পরিবর্তে যা প্রায়শই দুর্লভ বা বাসি। একইভাবে চালিত মডেল দ্বারা বিচার করা কোন ব্যবহারযোগ্য সংকেত দেয়নি।