arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 4134 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 4134 篇

2511.12650 2025-11-18 cs.RO cs.SY eess.SY 57%

Task-Aware Morphology Optimization of Planar Manipulators via Reinforcement Learning

Arvind Kumar Mishra, Sohom Chakrabarty

机构 * Department of Electrical Engineering, Indian Institute of Technology Roorkee, Roorkee 247667,India(印度理工学院罗奥尔基分校电子工程系)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

Comments 10 pages, 11 figures, It is submitted as a journal option paper associated with the IFAC World Congress 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11402 2025-11-17 cs.LG 57%

Multi-Phase Spacecraft Trajectory Optimization via Transformer-Based Reinforcement Learning

Amit Jain, Victor Rodriguez-Fernandez, Richard Linares

机构 * Aeronautics & Astronautics, Massachusetts Institute of Technology(航空与宇航科学系,麻省理工学院) Department of Computer Systems Engineering, Universidad Politécnica de Madrid(计算机系统工程系,马德里理工大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10383 2025-11-14 stat.ML cs.LG cs.SY eess.SY math.OC 57%

Operator Models for Continuous-Time Offline Reinforcement Learning

Nicolas Hoischen, Petar Bevanda, Max Beier, Stefan Sosnowski, Boris Houska, Sandra Hirche

机构 * TU Munich(慕尼黑工业大学) ShanghaiTech University(上海交通大学)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01720 2025-11-14 cs.LG 57%

Succeed or Learn Slowly: Sample Efficient Off-Policy Reinforcement Learning for Mobile App Control

Georgios Papoudakis, Thomas Coste, Jianye Hao, Jun Wang, Kun Shao

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University College London(伦敦大学学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08926 2025-11-13 cs.MA cs.AI 57%

Achieving Equilibrium under Utility Heterogeneity: An Agent-Attention Framework for Multi-Agent Multi-Objective Reinforcement Learning

Zhuhui Li, Chunbo Luo, Liming Huang, Luyu Qi, Geyong Min

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08325 2025-11-12 cs.CL cs.IR cs.LG 57%

AgentPRM: Process Reward Models for LLM Agents via Step-Wise Promise and Progress

Zhiheng Xi, Chenyang Liao, Guanyu Li, Yajie Yang, Wenxiang Chen, Zhihao Zhang, Binghai Wang, Senjie Jin, Yuhao Zhou, Jian Guan, Wei Wu, Tao Ji, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学) Ant Group(蚂蚁集团)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07051 2025-11-11 cs.CV cs.CR 57%

Improving Deepfake Detection with Reinforcement Learning-Based Adaptive Data Augmentation

Yuxuan Zhou, Tao Yu, Wen Huang, Yuheng Zhang, Tao Dai, Shu-Tao Xia

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02507 2025-11-06 cs.RO 57%

AURA: Autonomous Upskilling with Retrieval-Augmented Agents

Alvin Zhu, Yusuke Tanaka, Andrew Goldberg, Dennis Hong

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02690 2025-11-05 cs.LG 57%

Curriculum Design for Trajectory-Constrained Agent: Compressing Chain-of-Thought Tokens in LLMs

Georgios Tzannetos, Parameswaran Kamalaruban, Adish Singla

机构 * MPI-SWS(马克斯·普朗克所际研究所)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments NeurIPS'25 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08655 2025-11-05 cs.RO 57%

FRASA: An End-to-End Reinforcement Learning Agent for Fall Recovery and Stand Up of Humanoid Robots

Clément Gaspard, Marc Duclusaud, Grégoire Passault, Mélodie Daniel, Olivier Ly

机构 * Univ. Bordeaux, CNRS, LaBRI, UMR 5800(波尔多大学、国家科学研究中心、LaBRI、UMR 5800)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22940 2025-11-05 cs.LG 57%

Generating Auxiliary Tasks with Reinforcement Learning

Judah Goldfeder, Matthew So, Hod Lipson

机构 * Department of Computer Science(计算机科学系) Columbia University(哥伦比亚大学) Department of Mechanical Engineering(机械工程系)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00034 2025-11-04 cs.MA cs.LG 57%

On the Fundamental Limitations of Decentralized Learnable Reward Shaping in Cooperative Multi-Agent Reinforcement Learning

Aditya Akella

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments 8 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22575 2025-11-03 cs.SE cs.AI 57%

On the Mistaken Assumption of Interchangeable Deep Reinforcement Learning Implementations

Rajdeep Singh Hundal, Yan Xiao, Xiaochun Cao, Jin Song Dong, Manuel Rigger

机构 * National University of Singapore(新加坡国立大学) Sun Yat-sen University(中山大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.AI

Comments Added the ACM Functional v1.1 badge, the full publication citation, and a link to the publication on IEEE Xplore

Journal ref IEEE/ACM 47th International Conference on Software Engineering (ICSE), Ottawa, ON, Canada, 2025, pp. 2225-2237

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03394 2025-11-03 cs.RO 57%

Faster Model Predictive Control via Self-Supervised Initialization Learning

Zhaoxin Li, Xiaoke Wang, Letian Chen, Rohan Paleja, Subramanya Nageshrao, Matthew Gombolay

机构 * Georgia Institute of Technology(佐治亚理工学院) MIT Lincoln Laboratory(麻省理工学院林肯实验室) Ford Motor Company(福特汽车公司)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25529 2025-10-30 cs.AI 57%

Off-policy Reinforcement Learning with Model-based Exploration Augmentation

Likun Wang, Xiangteng Zhang, Yinuo Wang, Guojian Zhan, Wenxuan Wang, Haoyu Gao, Jingliang Duan, Shengbo Eben Li

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25320 2025-10-30 cs.AI cs.CL 57%

GAP: Graph-Based Agent Planning with Parallel Tool Use and Reinforcement Learning

Jiaqi Wu, Qinlao Zhao, Zefeng Chen, Kai Qin, Yifei Zhao, Xueqian Wang, Yuhang Yao

机构 * Tsinghua University(清华大学) Huazhong University of Science and Technology(华中科技大学) National University of Singapore(新加坡国立大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14819 2025-10-30 cs.LG 57%

Learning from Reward-Free Offline Data: A Case for Planning with Latent Dynamics Models

Vlad Sobal, Wancong Zhang, Kyunghyun Cho, Randall Balestriero, Tim G. J. Rudner, Yann LeCun

机构 * New York University(纽约大学) Genentech(基因泰克) Brown University(布朗大学) University of Toronto(多伦多大学) Meta – FAIR

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

Comments Project web page: https://latent-planning.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24650 2025-10-29 cs.AI 57%

Advancing site-specific disease and pest management in precision agriculture: From reasoning-driven foundation models to adaptive, feedback-based learning

Nitin Rai, Daeun, Choi, Nathan S. Boyd, Arnold W. Schumann

机构 * Department of Horticultural Sciences(园艺科学系) Gulf Coast Research and Education Center(墨西哥湾沿岸研究与教育中心) University of Florida(佛罗里达大学) Department of Agricultural and Biological Engineering(农业与生物工程系) Department of Soil, Water, and Ecosystem Sciences(土壤、水与生态系统科学系) Citrus Research and Education Center(柑橘研究与教育中心)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.AI

Comments 26 pages, 8 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16372 2025-10-29 cs.RO 57%

COMPASS: Cross-embodiment Mobility Policy via Residual RL and Skill Synthesis

Wei Liu, Huihua Zhao, Chenran Li, Yuchen Deng, Joydeep Biswas, Soha Pouya, Yan Chang

机构 * NVIDIA(NVIDIA公司) UC Berkeley(加州大学伯克利分校) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11403 2025-10-28 cs.RO 57%

UniLCD: Unified Local-Cloud Decision-Making via Reinforcement Learning

Kathakoli Sengupta, Zhongkai Shangguan, Sandesh Bharadwaj, Sanjay Arora, Eshed Ohn-Bar, Renato Mancuso

机构 * Boston University(波士顿大学) Red Hat(红帽公司)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments ECCV 24

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22892 2025-10-28 cs.RO cs.SY eess.SY 57%

Never Too Rigid to Reach: Adaptive Virtual Model Control with LLM- and Lyapunov-Based Reinforcement Learning

Jingzehua Xu, Yangyang Li, Yangfei Chen, Guanwen Xie, Shuai Zhang

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电气工程与计算机科学系) Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际 Graduate School) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22699 2025-10-28 cs.RO 57%

RL-AVIST: Reinforcement Learning for Autonomous Visual Inspection of Space Targets

Matteo El-Hariry, Andrej Orsula, Matthieu Geist, Miguel Olivares-Mendez

机构 * Earth Species Project(地球物种计划)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22524 2025-10-28 cs.RO 57%

Ant-inspired Walling Strategies for Scalable Swarm Separation: Reinforcement Learning Approaches Based on Finite State Machines

Shenbagaraj Kannapiran, Elena Oikonomou, Albert Chu, Spring Berman, Theodore P. Pavlic

机构 * School for Engineering of Matter, Transport and Energy, Arizona State University, Tempe, AZ 85287, USA(1 工程物质、运输与能量学院,亚利桑那州立大学,Tempe, AZ 85287, USA) School of Computing and Augmented Intelligence, Arizona State University, Tempe, AZ 85281, USA(2 计算与增强智能学院,亚利桑那州立大学,Tempe, AZ 85281, USA) School of Life Sciences, Arizona State University, Tempe, AZ 85281, USA(3 生命科学学院,亚利桑那州立大学,Tempe, AZ 85281, USA)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21840 2025-10-28 cs.CV cs.GR 57%

Improving the Physics of Video Generation with VJEPA-2 Reward Signal

Jianhao Yuan, Xiaofeng Zhang, Felix Friedrich, Nicolas Beltran-Velez, Melissa Hall, Reyhane Askari-Hemmat, Xiaochuang Han, Nicolas Ballas, Michal Drozdzal, Adriana Romero-Soriano

机构 * FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室) University of Oxford(牛津大学) Mila - Québec AI Institute(魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Columbia University(哥伦比亚大学) McGill University(麦吉尔大学) Canada CIFAR AI Chair(加拿大CIFAR人工智能 chair)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.CV

Comments 2 pages

Journal ref Winning entry of the ICCV 2025 Physics IQ Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20176 2025-10-27 cs.CL cs.AI 57%

Mixture-of-Minds: Multi-Agent Reinforcement Learning for Table Understanding

Yuhang Zhou, Mingrui Zhang, Ke Li, Mingyi Wang, Qiao Liu, Qifei Wang, Jiayi Liu, Fei Liu, Serena Li, Weiwei Li, Mingze Gao, Abhishek Kumar, Xiangjun Fan, Zhuokai Zhao, Lizhu Zhang

机构 * Meta AI

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03119 2025-10-27 cs.LG 57%

Spatial-Aware Decision-Making with Ring Attractors in Reinforcement Learning Systems

Marcos Negre Saura, Richard Allmendinger, Wei Pan, Theodore Papamarkou

机构 * The University of Manchester(曼彻斯特大学) PolyShape

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20436 2025-10-24 stat.ML cs.LG 57%

Learning Decentralized Routing Policies via Graph Attention-based Multi-Agent Reinforcement Learning in Lunar Delay-Tolerant Networks

Federico Lozano-Cuadra, Beatriz Soret, Marc Sanchez Net, Abhishek Cauligi, Federico Rossi

机构 * Telecommunications Research Institute, University of Málaga(马德里大学电信研究所) Jet Propulsion Laboratory, California Institute of Technology(加州理工学院喷气推进实验室) Department of Mechanical Engineering, Johns Hopkins University(约翰霍普金斯大学机械工程系)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20347 2025-10-24 cs.RO cs.MA 57%

Multi-Modal Decentralized Reinforcement Learning for Modular Reconfigurable Lunar Robots

Ashutosh Mishra, Shreya Santra, Elian Neppel, Edoardo M. Rossi Lombardi, Shamistan Karimov, Kentaro Uno, Kazuya Yoshida

机构 * Space Robotics Lab. (SRL) in Department of Aerospace Engineering, Graduate School of Engineering, Tohoku University(太空机器人实验室(SRL)位于东东北大学航空航天工程系研究生院) Politecnico di Milano(米兰理工大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

Comments Accepted in IEEE iSpaRo 2025. Awaiting Publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07376 2025-10-23 eess.SY cs.RO cs.SY 57%

AttentionSwarm: Reinforcement Learning with Attention Control Barier Function for Crazyflie Drones in Dynamic Environments

Grik Tadevosyan, Valerii Serpiva, Aleksey Fedoseev, Roohan Ahmed Khan, Demetros Aschu, Faryal Batool, Nickolay Efanov, Artem Mikhaylov, Dzmitry Tsetserukou

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Intelligent Space Robotics Laboratory(智能空间机器人实验室) Skolkovo Institute of Science and Technology(斯克尔科维科学与技术学院) AI Center(人工智能中心) Moscow Institute of Physics and Technology(莫斯科物理技术学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

Comments 6 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03762 2025-10-23 cs.LG cs.FL 57%

Learning Reward Machines from Partially Observed Policies

Mohamad Louai Shehab, Antoine Aspeel, Necmiye Ozay

机构 * Department of Robotics(机器人学系) University of Michigan(密歇根大学) Universite Paris-Saclay(巴黎-萨克莱大学) CNRS(国家科学研究中心) Centrale-Supélec(中央-圣艾克苏佩里) Laboratoire des Signaux et Systèmes(信号与系统实验室) Department of Electrical Engineering and Computer Science(电气与计算机工程系)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏