arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-09-30 至 2025-09-30 共收录 15 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 15 篇

2408.14183 2025-09-30 cs.RO cs.AI cs.LG 82%

Robot Navigation with Entity-Based Collision Avoidance using Deep Reinforcement Learning

Yury Kolomeytsev, Dmitry Golembiovsky

机构 * Lomonosov Moscow State University, Moscow, Russia(罗蒙诺索夫莫斯科国立大学,莫斯科,俄罗斯)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23958 2025-09-30 cs.CV 79%

Reinforcement Learning with Inverse Rewards for World Model Post-training

Yang Ye, Tianyu He, Shuo Yang, Jiang Bian

专题命中 模仿学习与强化学习 :world model(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24219 2025-09-30 cs.RO cs.AI cs.LG 78%

ViReSkill: Vision-Grounded Replanning with Skill Memory for LLM-Based Planning in Lifelong Robot Learning

Tomoyuki Kagaya, Subramanian Lakshmi, Anbang Ye, Thong Jing Yuan, Jayashree Karlekar, Sugiri Pranata, Natsuki Murakami, Akira Kinose, Yang You

机构 * Panasonic Connect Co., Ltd.(松下电器(株式会社)) Panasonic R&D Center(松下研发中心) National University of Singapore(新加坡国立大学)

专题命中 模仿学习与强化学习 :robot learning(title);分类 cs.RO、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24539 2025-09-30 cs.RO 70%

Unlocking the Potential of Soft Actor-Critic for Imitation Learning

Nayari Marie Lessa, Melya Boukheddimi, Frank Kirchner

机构 * DFKI GmbH(德累斯顿夫琅和斐研究所) University of Bremen(不莱梅大学)

专题命中 模仿学习与强化学习 :robotics(abstract);robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23802 2025-09-30 cs.LG 70%

STAIR: Addressing Stage Misalignment through Temporal-Aligned Preference Reinforcement Learning

Yao Luan, Ni Mu, Yiqin Yang, Bo Xu, Qing-Shan Jia

机构 * Beijing Key Laboratory of Embodied Intelligence Systems, Department of Automation, Tsinghua University, Beijing, China(北京智能体智能系统重点实验室,自动化系,清华大学,北京,中国) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences, Beijing, China(复杂系统认知与决策智能重点实验室,自动化研究所,中国科学院,北京,中国)

专题命中 模仿学习与强化学习 :manipulation(abstract);navigation(abstract);分类 cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20766 2025-09-30 cs.RO cs.LG 62%

Leveraging Temporally Extended Behavior Sharing for Multi-task Reinforcement Learning

Gawon Lee, Daesol Cho, H. Jin Kim

机构 * Department of Aerospace Engineering, Seoul National University(首尔国立大学航空航天工程系) Artificial Intelligence Institute, Seoul National University(首尔国立大学人工智能研究所)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

Comments Accepted for publication in the proceedings of the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06775 2025-09-30 eess.SY cs.AI cs.IT cs.LG cs.NI cs.SY math.IT 62%

Agentic DDQN-Based Scheduling for Licensed and Unlicensed Band Allocation in Sidelink Networks

Po-Heng Chou, Pin-Qi Fu, Walid Saad, Li-Chun Wang

机构 * Department of Electronics and Electrical Engineering(电子与电气工程系) Institute of Communications Engineering(通讯工程研究所) National Yang Ming Chiao Tung University(阳明交通大学) Research Center for Information Technology Innovation(信息技术创新研究中心) Academia Sinica(台湾“中央研究院”) Bradley Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 3 figures, accepted by 2025 IEEE Globecom Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08440 2025-09-30 cs.RO cs.AI 62%

TGRPO :Fine-tuning Vision-Language-Action Model via Trajectory-wise Group Relative Policy Optimization

Zengjue Chen, Runliang Niu, He Kong, Qi Wang, Qianli Xing, Zipei Fan

机构 * School of Artificial Intelligence, Jilin University(人工智能学院,吉林大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10482 2025-09-30 cs.LG cs.AI 62%

Fine-tuning Diffusion Policies with Backpropagation Through Diffusion Timesteps

Ningyuan Yang, Jiaxuan Gao, Feng Gao, Yi Wu, Chao Yu

机构 * Tsinghua University(清华大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI、cs.LG

Comments 9 pages for main text, 23 pages in total, submitted to Neurips, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12243 2025-09-30 cs.RO cs.AI 62%

RISE: Robust Imitation through Stochastic Encoding

Mumuksh Tayal, Manan Tayal, Ravi Prakash

机构 * Cyber Physical Systems, Indian Institute of Science (IISc), Bengaluru(印度科学研究院计算机物理系统,班加罗尔)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19752 2025-09-30 cs.RO 57%

Beyond Human Demonstrations: Diffusion-Based Reinforcement Learning to Generate Data for VLA Training

Rushuai Yang, Hangxing Wei, Ran Zhang, Zhiyuan Feng, Xiaoyu Chen, Tong Li, Chuheng Zhang, Li Zhao, Jiang Bian, Xiu Su, Yi Chen

机构 * Hong Kong University of Science and Technology(香港科技大学) Microsoft Research Asia(微软亚洲研究院) Wuhan University(武汉大学) University of Chinese Academy of Sciences(中国科学院大学) Tsinghua University(清华大学) Big Data Institute, Central South University(中南大学大数据研究院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23220 2025-09-30 cs.RO 57%

GLUE: Global-Local Unified Encoding for Imitation Learning via Key-Patch Tracking

Ye Chen, Zichen Zhou, Jianyu Dou, Te Cui, Yi Yang, Yufeng Yue

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23219 2025-09-30 cs.LG 57%

WirelessMathLM: Teaching Mathematical Reasoning for LLMs in Wireless Communications with Reinforcement Learning

Xin Li, Mengbing Liu, Yiyang Zhu, Wenhe Zhang, Li Wei, Jiancheng An, Chau Yuen

机构 * Nanyang Technological University(南洋理工大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

Comments Project Homepage: https://lixin.ai/WirelessMathLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16757 2025-09-30 cs.RO 57%

HDMI: Learning Interactive Humanoid Whole-Body Control from Human Videos

Haoyang Weng, Yitang Li, Nikhil Sobanbabu, Zihan Wang, Zhengyi Luo, Tairan He, Deva Ramanan, Guanya Shi

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments website: hdmi-humanoid.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23425 2025-09-30 cs.MA 50%

Situational Awareness for Safe and Robust Multi-Agent Interactions Under Uncertainty

Benjamin Alcorn, Eman Hammad

专题命中 模仿学习与强化学习 :robotics(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏