arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-07 至 2026-01-07 共收录 12 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 12 篇

2601.02766 2026-01-07 cs.RO cs.AR 88%

Advancing Assistive Robotics: Multi-Modal Navigation and Biophysical Monitoring for Next-Generation Wheelchairs

推动辅助机器人:多模态导航与生物物理监测用于下一代轮椅

Md. Anowar Hossain, Mohd. Ehsanul Hoque

专题命中 具身导航 :robotics(title,abstract);navigation(title,abstract);分类 cs.RO

AI总结 本文提出了一种多模态轮椅控制系统,结合多种输入接口与生物物理监测,提升患者独立性并实现护理人员实时监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02798 2026-01-07 cs.RO 86%

Reinforcement Learning for Follow-the-Leader Robotic Endoscopic Navigation via Synthetic Data

基于合成数据的强化学习用于跟随领导者机器人内窥镜导航

Sicong Gao, Chen Qian, Laurence Xian, Liao Wu, Maurice Pagnucco, Yang Song

机构 * School of Computer Science and Engineering, The University of New South Wales(计算机科学与工程学院,新南威尔士大学) School of Mechanical and Manufacturing Engineering, The University of New South Wales(机械与制造工程学院,新南威尔士大学)

专题命中 具身导航 :navigation(title,abstract);robotic(title);分类 cs.RO

AI总结 本文提出了一种基于合成数据的强化学习方法,用于提高内窥镜机器人在狭窄管状环境中的自主导航能力,通过深度学习和几何感知机制提升了导航精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24851 2026-01-07 cs.CV cs.RO 84%

VLN-MME: Diagnosing MLLMs as Language-guided Visual Navigation agents

VLN-MME: 诊断MLLMs作为语言引导的视觉导航代理

Xunyi Zhao, Gengze Zhou, Qi Wu

机构 * Australian Institute for Machine Learning(澳大利亚机器学习研究所) Adelaide University(阿德莱德大学)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 VLN-MME通过统一评估框架揭示MLLMs在具身导航任务中的局限性,发现其3D空间推理能力不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18539 2026-01-07 cs.CV cs.RO 81%

AdaVLN: Towards Visual Language Navigation in Continuous Indoor Environments with Moving Humans

AdaVLN: 向具有移动人类的连续室内环境中的视觉语言导航迈进

Dillon Loh, Tomasz Bednarz, Xinxing Xia, Frank Guan

机构 * Hiverlab Pte. Ltd.(Hiverlab公司) NVIDIA(NVIDIA公司) Shanghai University(上海大学) Singapore Institute of Technology(新加坡科技学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 AdaVLN通过引入动态人类障碍物和冻结时间机制,提升机器人在连续室内环境中的视觉语言导航能力,以缩小仿真与现实的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03251 2026-01-07 cs.SE 78%

NavAI: A Generalizable LLM Framework for Navigation Tasks in Virtual Reality Environments

NavAI: 一种适用于虚拟现实环境导航任务的通用大语言模型框架

Xue Qin, Matthew DiGiovanni

专题命中 具身导航 :navigation(title,abstract)

AI总结 NavAI是一种基于大语言模型的通用导航框架,能够有效支持虚拟现实环境中的基础动作和复杂目标导向任务,实验显示其在目标导向任务中达到89%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02382 2026-01-07 cs.NI cs.AI cs.IR cs.LG 62%

How to Discover Knowledge for FutureG: Contextual RAG and LLM Prompting for O-RAN

如何为未来G发现知识:面向O-RAN的上下文RAG和LLM提示

Nathan Conger, Nathan Scollar, Kemal Davaslioglu, Yalin E. Sagduyu, Sastry Kompella

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出上下文RAG方法,通过引导文档检索和上下文增强LLM性能,提升ORAN领域问答的准确性和效率,同时保持低运行时间和碳排放。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03159 2026-01-07 cs.RO cs.LG 62%

Systematic Evaluation of Initial States and Exploration-Exploitation Strategies in PID Auto-Tuning: A Framework-Driven Approach Applied on Mobile Robots

PID自整定初始状态与探索-利用策略的系统评估:一种框架驱动方法应用于移动机器人

Zaid Ghazal, Ali Al-Bustami, Khouloud Gaaloul, Jaerock Kwon

机构 * Department of Computer Information Systems, Collage of Engineering and Computer Science, University of Michigan-Dearborn(计算机信息系统系,工程与计算机科学学院,密歇根大学迪尔伯恩分校) Department of Electrical and Computer Engineering, Collage of Engineering and Computer Science, University of Michigan-Dearborn(电气与计算机工程系,工程与计算机科学学院,密歇根大学迪尔伯恩分校)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出一种框架驱动方法,系统评估PID自整定中初始状态和探索-利用策略的影响,通过移动机器人实验验证其对收敛性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03097 2026-01-07 cs.RO cs.SY eess.SY math.OC 57%

Dual-quaternion learning control for autonomous vehicle trajectory tracking with safety guarantees

双四元数学习控制用于具有安全保证的自动驾驶轨迹跟踪

Omayra Yago Nieto, Alexandre Anahory Simoes, Juan I. Giribet, Leonardo Colombo

机构 * Universidad Politécnica de Madrid(西班牙马德里理工大学) School of Science and Technology, IE University(IE大学科学与技术学院) Universidad de San Andrés (UdeSA) and CONICET(阿根廷圣安德烈斯大学(UdeSA)和CONICET) Centre for Automation and Robotics (CSIC-UPM)(自动化与机器人中心(CSIC-UPM))

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出基于双四元数的学习控制方法,用于自主机器人在存在扰动时实现鲁棒的轨迹跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02714 2026-01-07 cs.AI cs.CL 57%

Time-Scaling Is What Agents Need Now

现在智能体需要时间扩展

Zhi Liu, Guangzhi Wang

机构 * CareerInternational Research Team(CareerInternational研究团队)

专题命中 具身导航 :world model(abstract);分类 cs.AI

AI总结 本文提出时间扩展概念,旨在通过扩展时间路径提升智能体的深度推理和问题解决能力,无需增加静态参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02645 2026-01-07 cs.RO 57%

Making Infeasible Tasks Feasible: Planning to Reconfigure Disconnected 3D Environments with Movable Objects

使不可行的任务可行:通过可移动物体重新配置断开的3D环境进行规划

Samarth Kalluraya, Yiannis Kantaros

机构 * Department of Electrical and Systems Engineering, Washington University in St. Louis(华盛顿大学圣路易斯分校电子工程与系统工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出BRiDGE规划器,通过重新配置可移动物体解决断开3D环境中不可达目标区域的导航问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09111 2026-01-07 cs.CV 57%

DenseSplat: Densifying Gaussian Splatting SLAM with Neural Radiance Prior

DenseSplat: 基于神经辐射先验的高密度高斯喷射SLAM

Mingrui Li, Shuhong Liu, Tianchen Deng, Hongyu Wang

机构 * Department of Computer Science, Dalian University of Technology(大连理工大学计算机科学系) Department of Mechano-informatics, Information Science and Technology, The University of Tokyo(东京大学机械信息学系、信息科学与技术系) Institute of Medical Robotics and Department of Automation, Shanghai Jiao Tong University(上海交通大学医学机器人研究所、自动化系) Key Laboratory of System Control and Information Processing, Ministry of Education(教育部系统控制与信息处理重点实验室)

专题命中 具身导航 :robotic(abstract);分类 cs.CV

AI总结 DenseSplat结合NeRF和3DGS优势,通过稀疏关键帧和神经辐射先验实现高密度SLAM,提升地图完整性和跟踪精度。

Comments IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02363 2026-01-07 cs.HC cs.CY 50%

Acceptance of cybernetic avatars for capability enhancement: a large-scale survey

对能力增强的赛博格仿生人接受度的研究:一项大规模调查

Laura Aymerich-Franch, Tarek Taha, Hiroko Kamide, Takahiro Miyashita, Hiroshi Ishiguro, Paolo Dario

专题命中 具身导航 :robotic(abstract)

AI总结 本研究通过大规模调查探讨了赛博格仿生人在六个领域中对能力增强的接受度,发现多语言交流和学习能力最受支持,而永生场景支持率最低。

Comments 22 pages, 1 Table, 1 Figure

详情

展开后加载摘要…

URL PDF HTML 收藏