Un documento propone calificar a los agentes de seguridad de IA sin etiquetas midiendo la convergencia hacia un modelo más sólido
Una nueva preimpresión de arXiv sostiene que los equipos de seguridad pueden juzgar si un agente de IA equipado con memoria o recuperación está aprendiendo midiendo hasta qué punto cierra la brecha con un modelo "maestro" más fuerte, en lugar de basarse en puntos de referencia etiquetados que a menudo son escasos o obsoletos. A juzgar por un modelo con potencia similar, no dio ninguna señal utilizable.