arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-03 至 2025-12-03 共收录 46 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 3 篇

2512.02631 2025-12-03 cs.LG 79%

SeeNav-Agent: Enhancing Vision-Language Navigation with Visual Prompt and Step-Level Policy Optimization

SeeNav-Agent: 通过视觉提示和分步策略优化增强视觉语言导航

Zhengcheng Wang, Zichuan Lin, Yijun Yang, Haobo Fu, Deheng Ye

机构 * Tencent AI Lab(腾讯AI实验室)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.LG

AI总结 SeeNav-Agent通过视觉提示和分步策略优化提升视觉语言导航性能,实验显示其在导航成功率上优于现有模型。

Comments 12 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19785 2025-12-03 cs.LG cs.AI 62%

medDreamer: Model-Based Reinforcement Learning with Latent Imagination on Complex EHRs for Clinical Decision Support

medDreamer:基于复杂电子病历的潜在想象的模型驱动强化学习用于临床决策支持

Qianyi Xu, Gousia Habib, Feng Wu, Dilruk Perera, Mengling Feng

机构 * National University of Singapore(新加坡国立大学)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI、cs.LG

AI总结 medDreamer通过结合潜在想象和自适应特征集成模块,实现基于复杂电子病历的模型驱动强化学习,以提升个性化治疗推荐的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 人机交互与遥操作 3 篇

2311.07226 2025-12-03 cs.RO cs.AI 86%

Large Language Models for Robotics: A Survey

大语言模型在机器人中的应用:综述

Fanlong Zeng, Wensheng Gan, Zezheng Huai, Lichao Sun, Hechang Chen, Yongheng Wang, Ning Liu, Philip S. Yu

机构 * School of Intelligent Systems Science and Engineering(智能系统科学与工程学院) Jinan University(济南大学) School of Artificial Intelligence(人工智能学院) Jilin University(吉林大学) Shanghai Innovation Institute(上海创新研究院) Lehigh University(莱文斯顿大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 人机交互与遥操作 :robotics(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文综述了大语言模型在机器人领域的应用,探讨了其在机器人控制、感知、决策和规划等方面的影响与挑战。

Comments Preprint. 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02549 2025-12-03 cs.RO 83%

Robotic capabilities framework: A boundary object and intermediate-level knowledge artifact for co-designing robotic processes

机器人能力框架:一种边界对象和中间级知识 artifacts,用于协同设计机器人流程

Alessandro Ianniello, Dave Murray-Rust, Sara Muscolo, Olger Siebinga, Nicky Mol, Denis Zatyagov, Eva Verhoef, Deborah Forster, David Abbink

专题命中 人机交互与遥操作 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文提出机器人能力框架,通过跨学科协作设计,促进人机协作的公正与协作未来。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11359 2025-12-03 cs.HC 50%

Using Game Design to Inform a Plastics Treaty: Fostering Collaboration between Science, Machine Learning, and Policymaking

利用游戏设计促进塑料条约:促进科学、机器学习与政策制定之间的协作

A Samuel Pottinger, Nivedita Biyani, Roland Geyer, Douglas J McCauley, Magali de Bruyn, Molly R Morse, Neil Nathan, Kevin Koy, Ciera Martinez

专题命中 人机交互与遥操作 :manipulation(abstract)

AI总结 本研究通过游戏化设计开发交互式决策支持工具,促进科学、机器学习与政策制定的协作,以支持国际塑料污染条约的制定。

Comments 17 pages, 3 figures, latex generated from markdown via Pandoc (https://pandoc.org/) for Arxiv,

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人数据与评测 8 篇

2508.03692 2025-12-03 cs.CV cs.RO 81%

LiDARCrafter: Dynamic 4D World Modeling from LiDAR Sequences

LiDARCrafter:从LiDAR序列动态构建4D世界模型

Ao Liang, Youquan Liu, Yu Yang, Dongyue Lu, Linfeng Li, Lingdong Kong, Huaici Zhao, Wei Tsang Ooi

机构 * WorldBench Team(WorldBench团队)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.RO、cs.CV

AI总结 LiDARCrafter通过自然语言输入生成和编辑4D LiDAR数据,实现高保真度、可控性和时间一致性,为自动驾驶数据增强和模拟提供新方法。

Comments AAAI 2026 Oral Presentation; 38 pages, 18 figures, 12 tables; Project Page at https://lidarcrafter.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02729 2025-12-03 cs.RO 79%

RoboWheel: A Data Engine from Real-World Human Demonstrations for Cross-Embodiment Robotic Learning

RoboWheel: 从现实世界人类示范数据中提取的机器人学习跨形态数据引擎

Yuhong Zhang, Zihan Gao, Shengpeng Li, Ling-Hao Chen, Kaisheng Liu, Runqing Cheng, Xiao Lin, Junjia Liu, Zhuoheng Li, Jingyi Feng, Ziyan He, Jintian Lin, Zheyan Huang, Zhifang Liu, Haoqian Wang

机构 * Tsinghua University(清华大学) Synapath CUHK(香港中文大学) HKU(香港大学) PolyU

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 RoboWheel通过高精度HOI重建和强化学习优化,将现实世界人类示范转化为跨形态机器人学习的有效数据,提供轻量级、通用的运动表示,提升机器人学习性能。

Comments 27 Pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02270 2025-12-03 cs.CR cs.RO 79%

Property-Guided Cyber-Physical Reduction and Surrogation for Safety Analysis in Robotic Vehicles

基于属性引导的网络物理系统安全分析中的降维与代理建模

Nazmus Shakib Sayom, Luis Garcia

机构 * University of Utah(犹他大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种属性引导的降维与代理建模方法,用于高效验证机器人系统安全属性,通过减少复杂性并利用逻辑感知测试生成实现语义验证。

Comments Accepted at EAI SmartSP 2025 (EAI International Conference on Security and Privacy in Cyber-Physical Systems and Smart Vehicles), Springer LNICST. The code repository is available here: https://doi.org/10.5281/zenodo.17497068

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02810 2025-12-03 cs.RO cs.AI cs.LG 67%

Phase-Adaptive LLM Framework with Multi-Stage Validation for Construction Robot Task Allocation: A Systematic Benchmark Against Traditional Optimization Algorithms

具有多阶段验证的相适应LLM框架用于施工机器人任务分配:与传统优化算法的系统基准测试

Shyam prasad reddy Kaitha, Hongrui Yu

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出LTAA框架,结合LLM推理与结构化验证,实现施工机器人任务分配的高效协调,展示LLM在任务分配中的优越性能和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04096 2025-12-03 cs.RO cs.CV 62%

Image-Based Relocalization and Alignment for Long-Term Monitoring of Dynamic Underwater Environments

基于图像的重定位与对齐用于动态水下环境的长期监测

Beverley Gorry, Tobias Fischer, Michael Milford, Alejandro Fontan

机构 * Queensland University of Technology(昆士兰理工大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种结合VPR、特征匹配和图像分割的方法,用于水下环境的长期监测,并引入了首个大规模水下VPR基准测试。

Journal ref Proceedings of the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Hangzhou, China, pp. 10749-10756, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02282 2025-12-03 cs.AI cs.HC cs.MA 57%

DialogGuard: Multi-Agent Psychosocial Safety Evaluation of Sensitive LLM Responses

DialogGuard: 多智能体心理社会安全评估框架用于敏感LLM响应

Han Luo, Guy Laban

机构 * University of Leeds(利兹大学) Southwest Jiaotong University(西南交通大学) Department of Industrial Engineering and Management(工业工程与管理系) Ben-Gurion University of the Negev(贝内尔·加隆大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 DialogGuard通过多智能体框架评估LLM响应的心理社会风险,提供高准确性的风险检测与可解释的评估结果,支持安全提示设计和脆弱用户应用的监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02443 2025-12-03 cs.GR cs.CV 57%

PRIMU: Uncertainty Estimation for Novel Views in Gaussian Splatting from Primitive-Based Representations of Error and Coverage

PRIMU:基于原始体表示的误差与覆盖度的不确定性估计

Thomas Gottwald, Edgar Heinert, Peter Stehr, Chamuditha Jayanga Galappaththige, Matthias Rottmann

机构 * Department of Mathematics(数学系) University of Wuppertal(乌珀塔尔大学) Institute of Computer Science(计算机科学研究所) University of Osnabrück(奥斯纳布吕克大学) Centre for Robotics(机器人中心) Queensland University of Technology(昆士兰理工大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 PRIMU通过基于原始体的误差和覆盖度表示,实现了高斯点扩散中对新视图不确定性的有效估计,优于现有方法,尤其在深度和前景物体估计上表现突出。

Comments Revised writing and figures; additional Gaussian Splatting experiments; added baselines and datasets; active view-selection experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02858 2025-12-03 eess.SY cs.SY 50%

PAC-Bayesian Optimal Control with Stability and Generalization Guarantees

具有稳定性和泛化保证的PAC-Bayesian最优控制

Mahrokh Ghoddousi Boroujeni, Clara Lucía Galimberti, Andreas Krause, Giancarlo Ferrari-Trecate

专题命中 机器人数据与评测 :robotics(abstract)

AI总结 本文提出一种基于PAC-Bayesian框架的最优控制方法,通过平衡经验性能与先验知识,保证闭环稳定性并提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他机器人 3 篇

2312.01135 2025-12-03 cs.RO 57%

Vision-based FDM Printing for Fabricating Airtight Soft Actuators

基于视觉的FDM打印用于制造密封软执行器

Yijia Wu, Zilin Dai, Haotian Liu, Lehong Wang, Markus P. Nemitz

机构 * Department of Robotics Engineering, Worcester Polytechnic Institute(机器人工程系,沃斯特理工学院) Department of Computer Science, Worcester Polytechnic Institute(计算机科学系,沃斯特理工学院) Department of Mechanical and Materials Engineering, Worcester Polytechnic Institute(机械与材料工程系,沃斯特理工学院) Department of Electrical and Computer Engineering, Worcester Polytechnic Institute(电气与计算机工程系,沃斯特理工学院)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于视觉的FDM打印方法,通过摄像头监控和纠正打印缺陷,提升气动执行器的密封性,无需调整打印参数。

Comments 6 pages, 7 figures, Accepted at IEEE RoboSoft conference 2024, San Diego CA

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18152 2025-12-03 astro-ph.HE 50%

Extremely luminous optical afterglow of an energetic gamma-ray burst GRB 230204B

超亮光学余辉的高能伽马射线暴GRB 230204B

Rahul Gupta, Judith Racusin, Vladimir Lipunov, Y. -D. Hu, Ashna Gulati, Alberto J. Castro-Tirado, Tara Murphy, Motoko Serino, Kirill Zhirkov, S. Shilling, Samantha R. Oates, James K. Leung, T. Parsotan, Amit K. Ror, Shashi B. Pandey, S. Iyyani, V. Sharma, A. Aryan, Jin-Ming Bai, Pavel Balanutsa, David Buckley, María D. Caballero-García, I. M. Carrasco-García, A. Castellón, Sebastián Castillo, Chen-Zhou Cui, Yu-Feng Fan, Emilio Fernández-García, Guillermo García-Segura, Maria Gritsevich, Sergiy Guziy, David Hiriart, William H. Lee, Soomin Jeong, Carlos Jesus Pérez del Pulgar, Ignacio Olivares, I. H. Park, Ignacio Pérez-García, S. Razzaque, Rubén Sánchez-Ramírez, Nataly Tyurina, Vladislav Topolev, Chuan-Jun Wang, Si-Yu Wu, Yu-Xin Xin, Ding-Rong Xiong, Xiao-Hong Zhao, Jirong Mao, Bao-Li Lun, Ye Kai

专题命中 其他机器人 :robotic(abstract)

AI总结 本研究利用机器人望远镜网络发现并表征了高能GRB 230204B的超亮光学余辉,揭示了其喷流成分和周围星际介质的物理特性。

Comments 32 pages, 15 figures, 9 tables, accepted for publication in ApJ

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05036 2025-12-03 cs.CL 50%

From Word Vectors to Multimodal Embeddings: Techniques, Applications, and Future Directions For Large Language Models

从词向量到多模态嵌入:大型语言模型的技术、应用与未来方向

Charles Zhang, Benji Peng, Xintian Sun, Qian Niu, Junyu Liu, Keyu Chen, Ming Li, Pohsun Feng, Ziqian Bi, Ming Liu, Yichao Zhang, Xinyuan Song, Cheng Fei, Caitlyn Heqi Yin, Lawrence KQ Yan, Hongyang He, Tianyang Wang

机构 * Georgia Institute of Technology(佐治亚理工学院) Simon Fraser University(西蒙弗雷泽大学) Kyoto University(京都大学) National Taiwan Normal University(台湾师范大学) Purdue University(普渡大学) The University of Texas at Dallas(德克萨斯大学达拉斯分校) Emory University(埃默里大学) Cornell University(康奈尔大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) The Hong Kong University of Science(香港科学大学) University of Liverpool(利物浦大学) University of Warwick(沃里克大学)

专题命中 其他机器人 :robotics(abstract)

AI总结 本文综述了从词向量到多模态嵌入的发展,探讨了大型语言模型的技术、应用及未来方向。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏