Oblast zaměřená na snižování škodlivého chování, selhání a rizik zneužití v systémech umělé inteligence.