Directional Constraints for Efficient Exploration in Safe Reinforcement Learning
安全强化学习中高效探索的方向约束
Paolo Magliano, Puze Liu, Jan Peters, Davide Tateo, Raffaello Camoriano
机构
*
Dipartimento di Automatica e Informatica, Politecnico di Torino(自动控制与信息工程系,都灵理工大学)
;
Tongji University, Shanghai Research Institute for Intelligent Autonomous Systems(同济大学,上海智能自主系统研究院)
;
German Research Center for AI (DFKI)(德国人工智能研究中心(DFKI))
;
Intelligent Autonomous Systems Group, TU Darmstadt(智能自主系统组,达姆施塔特工业大学)
;
Lund University(隆德大学)
;
Istituto Italiano di Tecnologia(意大利技术研究院)
CommentsThis paper has been accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Pittsburgh, USA, 2026. 8 pages, 8 figures
Mastermind: Strategy-grounded Learning for Repository-Scale Vulnerability Reproduction
Mastermind: 基于策略学习的仓库级漏洞复现
Mingzhe Du, Luu Anh Tuan, Tianyi Wu, Renyang Liu, Zhijiang Guo, Dong Huang, See-Kiong Ng
机构
*
National University of Singapore(新加坡国立大学)
;
Nanyang Technological University(南洋理工大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))