Preprint предлага геометричен метод за откриване на измамно поведение на AI извън линейните сонди
Нов препринт arXiv предлага измерване на геометрията на извода на модела за идентифициране на измамно поведение, което конвенционалните линейни сонди може да пропуснат.