Preprint proposes adaptive safety shields for reinforcement-learning agents
A new preprint proposes updating safety constraints for reinforcement-learning agents as they learn unknown transition probabilities, potentially extending probabilistic shielding to settings where the environment model is incomplete.