arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4131 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4131 篇

2502.01034 2025-02-04 cs.RO cs.LG 62%

End-to-End Imitation Learning for Optimal Asteroid Proximity Operations

Patrick Quinn, George Nehma, Madhur Tiwari

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 7 pages, 8 figures. Submitted to the 2025 IEEE Aerospace Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03195 2025-01-30 cs.LG cs.AI cs.NE 62%

Deep reinforcement learning for machine scheduling: Methodology, the state-of-the-art, and future directions

Maziyar Khadivi, Todd Charter, Marjan Yaghoubi, Masoud Jalayer, Maryam Ahang, Ardeshir Shojaeinasab, Homayoun Najjaran

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Journal ref Computers & Industrial Engineering, 2025, 110856

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15529 2025-01-28 cs.LG cs.AI cs.CR 62%

UNIDOOR: A Universal Framework for Action-Level Backdoor Attacks in Deep Reinforcement Learning

Oubo Ma, Linkang Du, Yang Dai, Chunyi Zhou, Qingming Li, Yuwen Pu, Shouling Ji

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 12 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05027 2025-01-28 cs.LG cs.AI 62%

Optimizing Automatic Differentiation with Deep Reinforcement Learning

Jamie Lohoff, Emre Neftci

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted as a spotlight paper at NeurIPS 2024

Journal ref Proceedings of the 38th Conference on Neural Information Processing Systems. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00204 2025-01-22 cs.RO cs.LG cs.SY eess.SY 62%

AirPilot: Interpretable PPO-based DRL Auto-Tuned Nonlinear PID Drone Controller for Robust Autonomous Flights

Junyang Zhang, Cristian Emanuel Ocampo Rivera, Kyle Tyni, Steven Nguyen

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

Comments 9 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02512 2025-01-16 cs.LG cs.AI 62%

Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal

Jifeng Hu, Li Shen, Sili Huang, Zhejian Yang, Hechang Chen, Lichao Sun, Yi Chang, Dacheng Tao

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03562 2025-01-09 cs.LG cs.AI 62%

Rethinking Adversarial Attacks in Reinforcement Learning from Policy Distribution Perspective

Tianyang Duan, Zongyuan Zhang, Zheng Lin, Yue Gao, Ling Xiong, Yong Cui, Hongbin Liang, Xianhao Chen, Heming Cui, Dong Huang

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00170 2025-01-03 cs.HC cs.AI cs.LG 62%

CREW: Facilitating Human-AI Teaming Research

Lingyu Zhang, Zhengran Ji, Boyuan Chen

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Our project website is at: http://generalroboticslab.com/CREW

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19765 2024-12-30 cs.RO cs.LG 62%

From Ceilings to Walls: Universal Dynamic Perching of Small Aerial Robots on Surfaces with Variable Orientations

Bryan Habas, Aaron Brown, Donghyeon Lee, Mitchell Goldman, Bo Cheng

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 7 pages, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19538 2024-12-30 cs.RO cs.AI cs.MA 62%

Scalable Hierarchical Reinforcement Learning for Hyper Scale Multi-Robot Task Planning

Xuan Zhou, Xiang Shi, Lele Zhang, Chen Chen, Hongbo Li, Lin Ma, Fang Deng, Jie Chen

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19311 2024-12-30 cs.AI cs.HC cs.LG cs.MA 62%

xSRL: Safety-Aware Explainable Reinforcement Learning -- Safety as a Product of Explainability

Risal Shahriar Shefin, Md Asifur Rahman, Thai Le, Sarra Alqahtani

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments Accepted to 24th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16145 2024-12-30 cs.LG cs.AI cs.CL 62%

Offline Reinforcement Learning for LLM Multi-Step Reasoning

Huaijie Wang, Shibo Hao, Hanze Dong, Shenao Zhang, Yilin Bao, Ziran Yang, Yi Wu

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15525 2024-12-23 cs.LG cs.AI 62%

Generalized Back-Stepping Experience Replay in Sparse-Reward Environments

Guwen Lyu, Masahiro Sato

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07675 2024-12-20 cs.LG cs.AI 62%

Goal Space Abstraction in Hierarchical Reinforcement Learning via Set-Based Reachability Analysis

Mehdi Zadem, Sergio Mover, Sao Mai Nguyen

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13492 2024-12-19 cs.RO cs.LG 62%

Efficient Language-instructed Skill Acquisition via Reward-Policy Co-Evolution

Changxin Huang, Yanbin Chang, Junfan Lin, Junyang Liang, Runhao Zeng, Jianqiang Li

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

Comments 14 pages, 5 figures, published to AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12953 2024-12-18 cs.LG cs.RO 62%

Efficient Diffusion Transformer Policies with Mixture of Expert Denoisers for Multitask Learning

Moritz Reuss, Jyothish Pari, Pulkit Agrawal, Rudolf Lioutikov

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06460 2024-12-16 cs.RO cs.AI 62%

Towards Real-World Efficiency: Domain Randomization in Reinforcement Learning for Pre-Capture of Free-Floating Moving Targets by Autonomous Robots

Bahador Beigomi, Zheng H. Zhu

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments This is a preprint for the work submitted to the ICRA 2024 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16677 2024-12-13 cs.RO cs.LG 62%

From Imitation to Refinement -- Residual RL for Precise Assembly

Lars Ankile, Anthony Simeonov, Idan Shenfeld, Marcel Torne, Pulkit Agrawal

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

Comments Project website: https://residual-assembly.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06685 2024-12-10 cs.LG cs.AI 62%

Policy Agnostic RL: Offline RL and Online RL Fine-Tuning of Any Class and Backbone

Max Sobol Mark, Tian Gao, Georgia Gabriela Sampaio, Mohan Kumar Srirama, Archit Sharma, Chelsea Finn, Aviral Kumar

专题命中 模仿学习与强化学习 :robot policy(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08464 2024-12-10 cs.LG cs.AI 62%

TLDR: Unsupervised Goal-Conditioned RL via Temporal Distance-Aware Representations

Junik Bae, Kwanyoung Park, Youngwoon Lee

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI、cs.LG

Comments CoRL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05766 2024-12-10 cs.LG cs.AI 62%

Policy-shaped prediction: avoiding distractions in model-based reinforcement learning

Miles Hutson, Isaac Kauvar, Nick Haber

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.02404 2024-12-05 cs.AI cs.LO cs.RO 62%

Model-Free Reinforcement Learning for Symbolic Automata-encoded Objectives

Anand Balakrishnan, Stefan Jakšić, Edgar A. Aguilar, Dejan Ničković, Jyotirmoy V. Deshmukh

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15007 2024-12-03 cs.LG cs.AI math.ST stat.ML stat.TH 62%

Is Behavior Cloning All You Need? Understanding Horizon in Imitation Learning

Dylan J. Foster, Adam Block, Dipendra Misra

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00086 2024-12-03 cs.RO cs.LG 62%

Dynamic Non-Prehensile Object Transport via Model-Predictive Reinforcement Learning

Neel Jawale, Byron Boots, Balakumar Sundaralingam, Mohak Bhardwaj

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00084 2024-12-03 cs.LG cs.RO 62%

Unpacking the Individual Components of Diffusion Policy

Xiu Yuan

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17764 2024-11-28 cs.RO cs.AI 62%

PROGRESSOR: A Perceptually Guided Reward Estimator with Self-Supervised Online Refinement

Tewodros Ayalew, Xiao Zhang, Kevin Yuanbo Wu, Tianchong Jiang, Michael Maire, Matthew R. Walter

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 15 pages,13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07932 2024-11-27 cs.LG cs.AI cs.MA cs.SI 62%

Reinforcement Learning Discovers Efficient Decentralized Graph Path Search Strategies

Alexei Pisacane, Victor-Alexandru Darvariu, Mirco Musolesi

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

Journal ref Proceedings of the Third Learning on Graphs Conference (LoG 2024), PMLR 269

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17137 2024-11-27 cs.RO cs.AI 62%

Self-reconfiguration Strategies for Space-distributed Spacecraft

Tianle Liu, Zhixiang Wang, Yongwei Zhang, Ziwei Wang, Zihao Liu, Yizhai Zhang, Panfeng Huang

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03555 2024-11-07 cs.CV cs.RO 62%

Object and Contact Point Tracking in Demonstrations Using 3D Gaussian Splatting

Michael Büttner, Jonathan Francis, Helge Rhodin, Andrew Melnik

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.CV

Comments CoRL 2024, Workshop on Lifelong Learning for Home Robots, Munich, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02345 2024-11-05 cs.RO cs.AI physics.med-ph q-bio.OT 62%

Simulation of Nanorobots with Artificial Intelligence and Reinforcement Learning for Advanced Cancer Cell Detection and Tracking

Shahab Kavousinejad

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

Comments The source code for this simulation is available on GitHub: https://github.com/SHAHAB-K93/cancer-and-smart-nanorobot

详情

展开后加载摘要…

URL PDF HTML 收藏