arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

2410.01349 2025-07-17 cs.AI cs.NE 57%

Life, uh, Finds a Way: Hyperadaptability by Behavioral Search

Alex Baranski, Jun Tani

机构 * Okinawa Institute of Science and Technology(冲绳科学技术大学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments 39 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06151 2025-07-16 cs.CV 57%

Biomechanics-Guided Residual Approach to Generalizable Human Motion Generation and Estimation

Zixi Kang, Xinghan Wang, Yadong Mu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11173 2025-07-16 cs.LG 57%

Real-Time Bayesian Detection of Drift-Evasive GNSS Spoofing in Reinforcement Learning Based UAV Deconfliction

Deepak Kumar Panda, Weisi Guo

机构 * Centre for Connected and Assured Autonomy, Faculty of Engineering and Applied Sciences, Cranfield University(连接与可信自主性中心,工程与应用科学学院,克兰菲尔德大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10284 2025-07-15 cs.RO cs.MA 57%

Prompt Informed Reinforcement Learning for Visual Coverage Path Planning

Venkat Margapuri

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10030 2025-07-15 cs.RO 57%

Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots

Marco Calì, Alberto Sinigaglia, Niccolò Turcato, Ruggero Carli, Gian Antonio Susto

机构 * Department of Information Engineering, University of Padova(信息工程系,帕多瓦大学) Human-Inspired Technology Research Center, University of Padova(人机协同技术研究中心,帕多瓦大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08112 2025-07-14 cs.RO 57%

Imitation Learning for Obstacle Avoidance Using End-to-End CNN-Based Sensor Fusion

Lamiaa H. Zain, Hossam H. Ammar, Raafat E. Shalaby

机构 * School of Engineering(工程学院) Applied Science Nile University(应用科学尼罗大学) Computer Science University of Hertfordshire(计算机科学赫尔德福德郡大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05720 2025-07-09 cs.LG cs.CL 57%

MobileGUI-RL: Advancing Mobile GUI Agent through Reinforcement Learning in Online Environment

Yucheng Shi, Wenhao Yu, Zaitang Li, Yonglin Wang, Hongming Zhang, Ninghao Liu, Haitao Mi, Dong Yu

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10251 2025-07-09 cs.RO 57%

SRT-H: A Hierarchical Framework for Autonomous Surgery via Language Conditioned Imitation Learning

Ji Woong Kim, Juo-Tung Chen, Pascal Hansen, Lucy X. Shi, Antony Goldenberg, Samuel Schmidgall, Paul Maria Scheikl, Anton Deguet, Brandon M. White, De Ru Tsai, Richard Cha, Jeffrey Jopling, Chelsea Finn, Axel Krieger

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06495 2025-07-08 cs.LG 57%

Boosting Robustness in Preference-Based Reinforcement Learning with Dynamic Sparsity

Calarina Muslimani, Bram Grooten, Deepak Ranganatha Sastry Mamillapalli, Mykola Pechenizkiy, Decebal Constantin Mocanu, Matthew E. Taylor

机构 * University of Alberta(阿尔伯塔大学) Eindhoven University of Technology(埃因霍温理工大学) University of Luxembourg(卢森堡大学) Alberta Machine Intelligence Institute(阿尔伯塔人工智能研究所)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04164 2025-07-04 cs.LG 57%

MInCo: Mitigating Information Conflicts in Distracted Visual Model-based Reinforcement Learning

Shiguang Sun, Hanbo Zhang, Zeyang Liu, Xinrui Yang, Lipeng Wan, Xingyu Chen, Xuguang Lan

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) National Engineering Research Center for Visual Information and Applications(视觉信息与应用国家工程研究中心) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院) Xi’an Jiaotong University(西安交通大学) National University of Singapore(新加坡国立大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21899 2025-06-30 cs.LG 57%

Advancements and Challenges in Continual Reinforcement Learning: A Comprehensive Review

Amara Zuffer, Michael Burke, Mehrtash Harandi

机构 * Electrical and Computer Science Engineering Department, Faculty of Engineering, Monash University, Clayton, Victoria, Australia(莫纳什大学工程学院电气与计算机科学工程系)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 65 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18126 2025-06-24 cs.AI 57%

Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game

Xiang Yuming, Li Sizhao, Li Rongpeng, Zhao Zhifeng, Zhang Honggang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Zhejiang Lab(浙江省实验室) City University of Macau(澳门城市大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10048 2025-06-24 cs.SD cs.AI eess.AS 57%

Audio-Driven Reinforcement Learning for Head-Orientation in Naturalistic Environments

Wessel Ledder, Yuzhen Qin, Kiki van der Heijden

机构 * Radboud University(拉德堡德大学) Donders Institute(多纳德研究所)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments Accepted at ICASSP 2025

Journal ref Proc. IEEE Int. Conf. Acoust., Speech, Signal Process. (ICASSP), pp. 1-5, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16336 2025-06-23 cs.RO cs.MA 57%

Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections

Yiou Huang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15132 2025-06-19 cs.RO 57%

Booster Gym: An End-to-End Reinforcement Learning Framework for Humanoid Robot Locomotion

Yushi Wang, Penghui Chen, Xinyu Han, Feng Wu, Mingguo Zhao

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Booster Robotics Technology Co., Ltd(Booster机器人技术有限公司)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14973 2025-06-18 cs.AI 57%

Behaviour Discovery and Attribution for Explainable Reinforcement Learning

Rishav Rishav, Somjit Nath, Vincent Michalski, Samira Ebrahimi Kahou

机构 * University of Calgary(卡尔加里大学) Mila McGill University(麦吉尔大学) Université de Montréal(蒙特利尔大学) CIFAR AI Chair(CIFAR AI 职位)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12161 2025-06-17 cs.LG stat.ML 57%

Meta-Learning and Synthetic Data for Automated Pretraining and Finetuning

Fabio Ferreira

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11723 2025-06-16 cs.RO 57%

Dynamic Collaborative Material Distribution System for Intelligent Robots In Smart Manufacturing

Ziren Xiao, Ruxin Xiao, Chang Liu, Xinheng Wang

机构 * School of Advanced Technology, Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学先进科技学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11285 2025-06-16 cs.MA cs.GT cs.LG 57%

Shapley Machine: A Game-Theoretic Framework for N-Agent Ad Hoc Teamwork

Jianhong Wang, Yang Li, Samuel Kaski, Jonathan Lawry

机构 * INFORMED-AI Hub University of Bristol, UK(INFORMED-AI Hub 英国布里斯托大学) Centre for AI Fundamentals University of Manchester, UK(人工智能基础研究中心 英国曼彻斯特大学) School of Engineering Mathematics and Technology University of Bristol, UK(工程数学与技术学院 英国布里斯托大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08751 2025-06-13 cs.LG 57%

Zero-Shot Offline Imitation Learning via Optimal Transport

Thomas Rupf, Marco Bagatella, Nico Gürtler, Jonas Frey, Georg Martius

机构 * ETH, Zürich, Switzerland(苏黎世联邦理工学院)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08639 2025-06-11 cs.RO cs.SY eess.SY 57%

Deep Reinforcement Learning-Based Motion Planning and PDE Control for Flexible Manipulators

Amir Hossein Barjini, Seyed Adel Alizadeh Kolagar, Sadeq Yaqubi, Jouni Mattila

机构 * Department of Engineering and Natural Sciences, Tampere University(工程与自然科学系,塔尔皮耶大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22942 2025-06-10 cs.CL cs.AI 57%

WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning

Yuchen Zhuang, Di Jin, Jiaao Chen, Wenqi Shi, Hanrui Wang, Chao Zhang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10966 2025-06-09 cs.RO stat.ML 57%

Is Your Imitation Learning Policy Better than Mine? Policy Comparison with Near-Optimal Stopping

David Snyder, Asher James Hancock, Apurva Badithela, Emma Dixon, Patrick Miller, Rares Andrei Ambrus, Anirudha Majumdar, Masha Itkina, Haruki Nishimura

机构 * Toyota Research Institute (TRI)(丰田研究院) Princeton University(普林斯顿大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments 14 + 5 pages, 10 figures, 4 tables. Accepted to RSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11488 2025-06-09 cs.LG 57%

Informed POMDP: Leveraging Additional Information in Model-Based RL

Gaspard Lambrechts, Adrien Bolland, Damien Ernst

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

Comments In Reinforcement Learning Conference, 2024. 10 pages, 22 pages total, 10 figures

Journal ref Reinforcement Learning Journal, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04821 2025-06-06 cs.LG 57%

LogicPuzzleRL: Cultivating Robust Mathematical Reasoning in LLMs via Reinforcement Learning

Zhen Hao Wong, Jingwen Deng, Runming He, Zirong Chen, Qijie You, Hejun Dong, Hao Liang, Chengyu Shen, Bin Cui, Wentao Zhang

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04588 2025-06-05 cs.AI 57%

Zero-shot cross-modal transfer of Reinforcement Learning policies through a Global Workspace

Léopold Maytié, Benjamin Devillers, Alexandre Arnold, Rufin VanRullen

机构 * Airbus AI Research(空客人工智能研究)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Journal ref Reinforcement Learning Journal, Vol. 3, 2024, pp. 1410-1426

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14622 2025-06-04 cs.RO 57%

Learning Autonomous Surgical Irrigation and Suction with the da Vinci Research Kit Using Reinforcement Learning

Yafei Ou, Mahdi Tavakoli

机构 * Department of Electrical and Computer Engineering, University of Alberta(电气与计算机工程系,阿尔伯塔大学) Department of Biomedical Engineering, University of Alberta(生物医学工程系,阿尔伯塔大学)

专题命中 模仿学习与强化学习 :robot learning(abstract);分类 cs.RO

Comments 15 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13140 2025-06-04 cs.RO 57%

Learn With Imagination: Safe Set Guided State-wise Constrained Policy Optimization

Yifan Sun, Feihan Li, Weiye Zhao, Rui Chen, Tianhao Wei, Changliu Liu

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments arXiv admin note: text overlap with arXiv:2306.12594

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00276 2025-06-03 cs.RO cs.CL 57%

RoboMoRe: LLM-based Robot Co-design via Joint Optimization of Morphology and Reward

Jiawei Fang, Yuxuan Sun, Chengtian Ma, Qiuyu Lu, Lining Yao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

Comments 30 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08179 2025-06-02 cs.LG 57%

Feasibility-Aware Pessimistic Estimation: Toward Long-Horizon Safety in Offline RL

Zhikun Tao

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

Comments arXiv admin comment: This version removed due to inaccurate authorship

详情

展开后加载摘要…

URL PDF HTML 收藏