Local Guidance, Global Impact: Gaussian-Reshaped Trust Region Unlocks Behavior Transitions
局部引导,全局影响:高斯重塑信任区域解锁行为转变
Bingxu Liu, Jiashun Liu, Johan Obando-Ceron, Hao Wang, Runze Liu, Pablo Samuel Castro, Aaron Courville, Ling Pan
机构
*
Hong Kong University of Science and Technology(香港科技大学)
;
Mila - Québec AI Institute(魁北克AI研究院)
;
Université de Montréal(蒙特利尔大学)
;
Fudan University(复旦大学)
;
City University of Hong Kong(香港城市大学)
COP-Q: Safety-First Reinforcement Learning for Robot Control via Cholesky-Ordered Projection
COP-Q:基于Cholesky有序投影的安全优先强化学习机器人控制
Guopeng Li, Moritz A. Zanger, Matthijs T. J. Spaan, Julian F. P. Kooij
机构
*
Department of Cognitive Robotics, Delft University of Technology(代尔夫特理工大学认知机器人系)
;
Department of Intelligent Systems, Delft University of Technology(代尔夫特理工大学智能系统系)
;
School of Transportation, Southeast University(东南大学交通学院)
Learning Stabilizable Dynamical Systems via Control Contraction Metrics
通过控制收缩度量学习可稳定化的动态系统
Sumeet Singh, Vikas Sindhwani, Jean-Jacques E. Slotine, Marco Pavone
机构
*
Dept. of Aeronautics and Astronautics, Stanford University(航空航天系,斯坦福大学)
;
Google Brain Robotics, New York(谷歌大脑机器人,纽约)
;
Dept. of Mechanical Engineering, Massachusetts Institute of Technology(机械工程系,麻省理工学院)
CommentsTo appear at WAFR 2018. v2: re-structured Sections 3 & 4 to improve clarity; expanded discussion on limitations & future work in Section 5; added details on training & validation, significantly expanded experiments
Mind Dreamer: Untethering Imagination via Active Causal Intervention on Latent Manifolds
Mind Dreamer: 通过潜在流形上的主动因果干预释放想象力
Shaojun Xu, Xiaoling Zhou, Yihan Lin, Yapeng Meng, Xinglong Ji, Luping Shi, Rong Zhao
机构
*
Center for Brain-Inspired Computing Research, Department of Precision Instrument, Tsinghua University, Beijing, China(脑启发计算研究中心,精密仪器系,清华大学,北京,中国)
;
College of Computer Science and Technology, Zhejiang University, Hangzhou, China(计算机科学与技术学院,浙江大学,杭州,中国)
;
Pen-Tung Sah Institute of Micro-Nano Science and Technology, Xiamen University, Xiamen, China(彭途萨微纳米科学与技术研究院,厦门大学,厦门,中国)
LASER: Learning Active Sensing for Continuum Field Reconstruction
LASER: 用于连续场重建的学习主动感知
Huayu Deng, Jinghui Zhong, Xiangming Zhu, Yunbo Wang, Xiaokang Yang
机构
*
MoE Key Lab of Artificial Intelligence, AI Institute, School of Computer Science, Shanghai Jiao Tong University(人工智能MOE重点实验室、人工智能研究院、计算机科学学院、上海交通大学)
Inversely Learning Transferable Rewards via Abstracted States
通过抽象状态逆向学习可迁移奖励
Yikang Gui, Prashant Doshi
机构
*
THINC Lab, School of Computing University of Georgia(THINC实验室,计算学院,佐治亚大学)
;
School of Computing and Institute for AI University of Georgia(计算学院和人工智能研究所,佐治亚大学)
Yu Luo, Shuo Han, Yihan Hu, Lei Lv, Huaping Liu, Fuchun Sun, Jianye Hao, Dong Li
机构
*
Department of Foundation Model, 2012 Labs, Huawei(华为基础模型部门,2012实验室)
;
Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(上海智能自主系统研究院,同济大学)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
College of Intelligence and Computing, Tianjin University(天津大学智能与计算学院)