arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-08-07 至 2025-08-07 共收录 5 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 5 篇

2411.05273 2025-08-07 cs.RO cs.AI cs.LG 67%

Real-World Offline Reinforcement Learning from Vision Language Model Feedback

Sreyas Venkataraman, Yufei Wang, Ziyu Wang, Navin Sriram Ravie, Zackory Erickson, David Held

机构 * Indian Institute of Technology, Kharagpur(印度理工学院,克哈格浦尔分校) IIIS, Tsinghua University(清华大学人工智能研究所) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

Comments 7 pages. Accepted at the LangRob Workshop 2024 @ CoRL, 2024. Accepted at 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04280 2025-08-07 cs.LG cs.AI 62%

Enhancing Vision-Language Model Training with Reinforcement Learning in Synthetic Worlds for Real-World Success

George Bredis, Stanislav Dereka, Viacheslav Sinii, Ruslan Rakhimov, Daniil Gavrilov

机构 * George Bredis(无) Stanislav Dereka(无) Viacheslav Sinii(无) Ruslan Rakhimov(无) Daniil Gavrilov(无)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03910 2025-08-07 q-fin.CP cs.LG 57%

Comparing Normalization Methods for Portfolio Optimization with Reinforcement Learning

Caio de Souza Barbosa Costa, Anna Helena Reali Costa

机构 * Escola Politécnica Universidade de São Paulo (USP)(圣保罗大学理工学院)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03012 2025-08-07 cs.SE cs.AI 57%

Tool-integrated Reinforcement Learning for Repo Deep Search

Zexiong Ma, Chao Peng, Qunhong Zeng, Pengfei Gao, Yanzhen Zou, Bing Xie

机构 * Peking University(北京大学) ByteDance(字节跳动) Beijing Institute of Technology(北京理工大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05858 2025-08-07 cs.LG cs.SY eess.SY 57%

Distributional Soft Actor-Critic with Three Refinements

Jingliang Duan, Wenxuan Wang, Liming Xiao, Jiaxin Gao, Shengbo Eben Li, Chang Liu, Ya-Qin Zhang, Bo Cheng, Keqiang Li

机构 * School of Mechanical Engineering, University of Science and Technology Beijing(北京科技大学机械工程学院) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院) College of Engineering, Peking University(北京大学工程学院) Institute for AI Industry Research, Tsinghua University(清华大学人工智能产业研究院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

Comments Title updated in this version. The previous version was titled "DSAC-T: Distributional Soft Actor-Critic With Three Refinements". Added a footnote with the BibTeX entry for the published journal version. No other major changes

Journal ref IEEE Trans. PAMI,47(5): 3935-3946,2025

详情

展开后加载摘要…

URL PDF HTML 收藏