arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4131 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4131 篇

2410.23535 2024-11-01 cs.CL cs.AI cs.RO 62%

Simulating User Agents for Embodied Conversational-AI

Daniel Philipov, Vardhan Dongre, Gokhan Tur, Dilek Hakkani-Tür

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.RO、cs.AI

Comments 8 pages, 5 figures, 4 tables

Journal ref NeurIPS 2024 Workshop on Open-World Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14916 2024-10-30 cs.MA cs.AI cs.RO 62%

Cooperation and Fairness in Multi-Agent Reinforcement Learning

Jasmine Jerry Aloor, Siddharth Nayak, Sydney Dolan, Hamsa Balakrishnan

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

Comments Manuscript accepted in ACM Journal on Autonomous Transportation Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00330 2024-10-28 cs.LG cs.AI 62%

Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions

Yinglun Xu, Tarun Suresh, Rohan Gumaste, David Zhu, Ruirui Li, Zhengyang Wang, Haoming Jiang, Xianfeng Tang, Qingyu Yin, Monica Xiao Cheng, Qi Zeng, Chao Zhang, Gagandeep Singh

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03157 2024-10-28 cs.RO cs.LG 62%

Learning to Recharge: UAV Coverage Path Planning through Deep Reinforcement Learning

Mirco Theile, Harald Bayerlein, Marco Caccamo, Alberto L. Sangiovanni-Vincentelli

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.04927 2024-10-28 cs.LG cs.AI 62%

Investigation of Factorized Optical Flows as Mid-Level Representations

Hsuan-Kung Yang, Tsu-Ching Hsiao, Ting-Hsuan Liao, Hsu-Shen Liu, Li-Yuan Tsao, Tzu-Wen Wang, Shan-Ya Yang, Yu-Wen Chen, Huang-Ru Liao, Chun-Yi Lee

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments Ting-Hsuan Liao, Hsu-Shen Liu, Li-Yuan Tsao, Tzu-Wen Wang, and Shan-Ya Yang contributed equally to this work, names listed in alphabetical order; This work has been submitted to the IEEE for possible publication

Journal ref 2022 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.08439 2024-10-25 cs.AI cs.LG 62%

Thinking Fast and Slow with Deep Learning and Tree Search

Thomas Anthony, Zheng Tian, David Barber

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments v1 to v2: - Add a value function in MCTS - Some MCTS hyper-parameters changed - Repetition of experiments: improved accuracy and errors shown. (note the reduction in effect size for the tpt/cat experiment) - Results from a longer training run, including changes in expert strength in training - Comparison to MoHex. v3: clarify independence of ExIt and AG0. v4: see appendix E

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17551 2024-10-24 cs.LG cs.RO 62%

Multimodal Information Bottleneck for Deep Reinforcement Learning with Multiple Sensors

Bang You, Huaping Liu

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 31 pages

Journal ref Neural Networks, 176(2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17186 2024-10-23 cs.RO cs.AI 62%

DyPNIPP: Predicting Environment Dynamics for RL-based Robust Informative Path Planning

Srujan Deolasee, Siva Kailas, Wenhao Luo, Katia Sycara, Woojun Kim

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 8 pages, 4 figures, submitted to IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15600 2024-10-22 cs.AI cs.GT cs.RO 62%

Patrol Security Game: Defending Against Adversary with Freedom in Attack Timing, Location, and Duration

Hao-Tsung Yang, Ting-Kai Weng, Ting-Yu Chang, Kin Sum Liu, Shan Lin, Jie Gao, Shih-Yu Tsai

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments Under review of TCPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10940 2024-10-22 cs.RO cs.LG 62%

ViSaRL: Visual Reinforcement Learning Guided by Human Saliency

Anthony Liang, Jesse Thomason, Erdem Bıyık

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09509 2024-10-22 cs.AI cs.RO 62%

Granger Causal Interaction Skill Chains

Caleb Chuck, Kevin Black, Aditya Arjun, Yuke Zhu, Scott Niekum

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments Accepted TMLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11359 2024-10-16 cs.LG cs.RO stat.ML 62%

DODT: Enhanced Online Decision Transformer Learning through Dreamer's Actor-Critic Trajectory Forecasting

Eric Hanchen Jiang, Zhi Zhang, Dinghuai Zhang, Andrew Lizarraga, Chenheng Xu, Yasi Zhang, Siyan Zhao, Zhengjie Xu, Peiyu Yu, Yuer Tang, Deqian Kong, Ying Nian Wu

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07525 2024-10-15 cs.LG cs.AI 62%

Offline Inverse Constrained Reinforcement Learning for Safe-Critical Decision Making in Healthcare

Nan Fang, Guiliang Liu, Wei Gong

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04322 2024-10-08 cs.SE cs.AI cs.LG 62%

Toward Debugging Deep Reinforcement Learning Programs with RLExplorer

Rached Bouchoucha, Ahmed Haj Yahmed, Darshan Patil, Janarthanan Rajendran, Amin Nikanjam, Sarath Chandar, Foutse Khomh

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication in The International Conference on Software Maintenance and Evolution (ICSME 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00490 2024-10-02 cs.RO cs.AI 62%

Learning Adaptive Hydrodynamic Models Using Neural ODEs in Complex Conditions

Cong Wang, Aoming Liang, Fei Han, Xinyu Zeng, Zhibin Li, Dixia Fan, Jens Kober

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15980 2024-10-01 cs.RO cs.AI 62%

In-Context Imitation Learning via Next-Token Prediction

Letian Fu, Huang Huang, Gaurav Datta, Lawrence Yunliang Chen, William Chung-Ho Panitch, Fangchen Liu, Hui Li, Ken Goldberg

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02569 2024-09-27 cs.RO cs.AI 62%

SliceIt! -- A Dual Simulator Framework for Learning Robot Food Slicing

Cristian C. Beltran-Hernandez, Nicolas Erbetti, Masashi Hamaya

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments Accepted to ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16830 2024-09-26 cs.RO cs.AI 62%

OffRIPP: Offline RL-based Informative Path Planning

Srikar Babu Gadipudi, Srujan Deolasee, Siva Kailas, Wenhao Luo, Katia Sycara, Woojun Kim

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

Comments 7 pages, 6 figures, submitted to ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13423 2024-09-23 cs.RO cs.LG 62%

Causal Reinforcement Learning for Optimisation of Robot Dynamics in Unknown Environments

Julian Gerald Dcruz, Sam Mahoney, Jia Yun Chua, Adoundeth Soukhabandith, John Mugabe, Weisi Guo, Miguel Arana-Catania

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments 6 pages, 12 figures, 3 tables. To be presented in 10th IEEE International Smart Cities Conference (ISC2-2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11897 2024-09-19 cs.RO cs.CR cs.LG 62%

Secure Control Systems for Autonomous Quadrotors against Cyber-Attacks

Samuel Belkadi

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments The paper is based on an undergraduate thesis and is not intended for publication in a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10554 2024-09-18 cs.CV cs.AI 62%

An Examination of Offline-Trained Encoders in Vision-Based Deep Reinforcement Learning for Autonomous Driving

Shawan Mohammed, Alp Argun, Nicolas Bonnotte, Gerd Ascheid

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08212 2024-09-17 cs.RO cs.LG 62%

Adaptive Language-Guided Abstraction from Contrastive Explanations

Andi Peng, Belinda Z. Li, Ilia Sucholutsky, Nishanth Kumar, Julie A. Shah, Jacob Andreas, Andreea Bobu

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO、cs.LG

Comments CoRL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08724 2024-09-16 cs.LG cs.AI 62%

Quasimetric Value Functions with Dense Rewards

Khadichabonu Valieva, Bikramjit Banerjee

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03881 2024-09-09 cs.RO cs.AI cs.MA 62%

Multi-agent Path Finding for Mixed Autonomy Traffic Coordination

Han Zheng, Zhongxia Yan, Cathy Wu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03429 2024-09-06 cs.RO cs.AI 62%

Reinforcement Learning Approach to Optimizing Profilometric Sensor Trajectories for Surface Inspection

Sara Roos-Hoefgeest, Mario Roos-Hoefgeest, Ignacio Alvarez, Rafael C. González

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01046 2024-09-04 cs.RO cs.AI 62%

Accelerated Multi-objective Task Learning using Modified Q-learning Algorithm

Varun Prakash Rajamohan, Senthil Kumar Jagatheesaperumal

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 9 pages, 9 figures, 7 tables

Journal ref International Journal of Ad Hoc and Ubiquitous Computing Vol. 47, No. 1, Year: 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04841 2024-09-04 cs.LG cs.AI 62%

Kolmogorov-Arnold Network for Online Reinforcement Learning

Victor Augusto Kich, Jair Augusto Bottega, Raul Steinmetz, Ricardo Bedin Grando, Ayano Yorozu, Akihisa Ohya

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Paper accepted at 24th International Conference on Control, Automation and Systems (ICCAS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11481 2024-08-26 cs.LG cs.AI 62%

Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms

Vaneet Aggarwal, Washim Uddin Mondal, Qinbo Bai

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: text overlap with arXiv:2402.02042

Journal ref Foundations and Trends in Optimization: Vol. 6: No. 4, pp 193-298, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10381 2024-08-21 stat.ML cs.AI cs.LG 62%

Efficient Reinforcement Learning in Probabilistic Reward Machines

Xiaofeng Lin, Xuezhou Zhang

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 33 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09125 2024-08-20 cs.LG cs.AI 62%

Markov Balance Satisfaction Improves Performance in Strictly Batch Offline Imitation Learning

Rishabh Agrawal, Nathan Dahlin, Rahul Jain, Ashutosh Nayyar

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏