CommentsWarning: This paper may contain unfiltered and potentially offensive jailbreaking examples. Accepted at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026
机构
*
Italian Institute of Technology (IIT)(意大利理工学院)
;
University of Manchester(曼彻斯特大学)
;
Dynamic Legged Systems Laboratory, IIT(意大利理工学院动态腿式系统实验室)
;
Generative Bionics S.R.L(生成仿生学有限公司)
;
DAUIN, Politecnico di Torino(都灵理工大学DAUIN)
;
Rehab Technologies Lab, IIT(意大利理工学院康复技术实验室)
;
Newcastle University(纽卡斯尔大学)
CommentsThis paper has been accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Pittsburgh, USA, 2026
Directional Constraints for Efficient Exploration in Safe Reinforcement Learning
安全强化学习中高效探索的方向约束
Paolo Magliano, Puze Liu, Jan Peters, Davide Tateo, Raffaello Camoriano
机构
*
Dipartimento di Automatica e Informatica, Politecnico di Torino(自动控制与信息工程系,都灵理工大学)
;
Tongji University, Shanghai Research Institute for Intelligent Autonomous Systems(同济大学,上海智能自主系统研究院)
;
German Research Center for AI (DFKI)(德国人工智能研究中心(DFKI))
;
Intelligent Autonomous Systems Group, TU Darmstadt(智能自主系统组,达姆施塔特工业大学)
;
Lund University(隆德大学)
;
Istituto Italiano di Tecnologia(意大利技术研究院)
CommentsThis paper has been accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Pittsburgh, USA, 2026. 8 pages, 8 figures
When Does Predictive Inverse Dynamics Outperform Behavior Cloning?
何时预测性逆动力学优于行为克隆?
Lukas Schäfer, Pallavi Choudhury, Abdelhak Lemkhenter, Chris Lovett, Somjit Nath, Luis França, Matheus Ribeiro Furtado de Mendonça, Alex Lamb, Riashat Islam, Siddhartha Sen, John Langford, Katja Hofmann, Sergio Valcarcel Macua
机构
*
University of Cambridge(剑桥大学)
;
Universitygrow
Multi-Agent Goal Recognition with Team- and Goal-Conditioned Reinforcement Learning and Factorized Branch-and-Bound
基于团队与目标条件强化学习和因子化分支定界的多智能体目标识别
Thiago Thomas, Gabriel de Oliveira Ramos, Felipe Meneguzzi
机构
*
Pontifícia Universidade Católica do Rio Grande do Sul (PUCRS)(里约格兰德杜斯阿伦斯天主教大学)
;
Universidade do Vale do Rio dos Sinos (Unisinos)(里约斯inos大学)
;
University of Aberdeen(阿伯丁大学)
Safe Learning Control with Optimality and Stability Guarantees
具有最优性和稳定性保证的安全学习控制
Xinyang Wang, Hongwei Zhang, Shimin Wang, Wei Xiao, Martin Guay
机构
*
Shenzhen Key Lab for Advanced Motion Control and Modern Automation Equipments, School of Intelligence Science and Engineering, Harbin Institute of Technology, Shenzhen, Guangdong 518055, China(深圳先进 motion 控制与现代自动化装备重点实验室,智能科学与工程学院,哈尔滨工业大学,深圳,广东 518055,中国)
;
School of Data Science, Lingnan University, Hong Kong(数据科学学院,岭南大学,香港)
;
School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(电气与电子工程学院,南洋理工大学,新加坡)
;
MIT CSAIL