Here are 59 public repositories matching this topic… Safe RLHF: Constrained Value Alignment via Safe Reinforcement Learning from Human Feedback. JMLR: OmniSafe is an infrastructural framework for accelerating SafeRL research. The repository is for safe reinforcement learning baselines.
Categories
