arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-09-01 至 2026-09-01 共收录 87 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22 篇

2608.30237 2026-09-01 cs.RO cs.AI cs.CV cs.LG 新提交 90%

Motus2: A Self-Evolving General World Model for Dexterous Manipulation

Motus2:一种用于灵巧操作的自进化通用世界模型

Hongzhe Bi, Zihao Zhou, Yihang Tang, Jingrui Pang, Shuhe Huang, Haitian Liu, Runqing Wang, Shuai Huang, Yichen Wang, Yiming Cheng, Ruowen Zhao, Zhenghua Li, Hengkai Tan, Xiaolong Liu, Jinhui Wan, Jiabao Liu, Min Zhao, Fan Bao, Jun Zhu

机构 * GensPI Tsinghua University(清华大学) BUAA(北京航空航天大学) BIT(北京理工大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);embodied agent(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出Motus2,一种用于灵巧操作的自进化通用世界模型,通过模型缩放与数据缩放构建闭环决策学习循环,结合多模态数据与仿生平台实现通用具身智能体的灵巧操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30983 2026-09-01 cs.RO 新提交 85%

Autonomously Acquiring Robot Manipulation Skills with Language-Driven Quality-Diversity

通过语言驱动的质量多样性自主获取机器人操作技能

Émiland Garrabé, Mahdi Khoramshahi, Stéphane Doncieux

机构 * ISIR, Sorbonne Université(ISIR,索邦大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出仅需自然语言任务描述,即可自主生成多样化机器人运动原语档案的方法,在4项操作任务上优于经典QD算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29379 2026-09-01 cs.RO 新提交 84%

Bridging Semantics and Physics with Constrained LLMs for Safe and Trustworthy Robotic Manipulation

用受约束的大语言模型(LLM)弥合语义与物理鸿沟,实现安全可信的机器人操纵

Wenhao Hong, Lan Wei, Dandan Zhang

机构 * Imperial College London(帝国理工学院)

专题命中 机器人操作 :manipulation(title);robotic(title);分类 cs.RO

AI总结 该研究针对语言引导机器人操纵的语言-动作鸿沟,通过类型化契约约束LLM决策,结合MoveIt流水线验证,在多类机器人任务上实现了优于脚本策略的安全可靠性能。

Comments ECCV Workshop paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31002 2026-09-01 cs.RO cs.CV 新提交 84%

DARP: A Calibrated Dual-Arm RGB-D-IR Dataset for Multi-View Robotic Perception

DARP:用于多视角机器人感知的校准双臂RGB-D-IR数据集

Manish Kansana, Mohammed Yusuf Mujawar, Sudip Mittal, Shahram Rahimi, Noorbakhsh Amiri Golilarz

机构 * The University of Alabama(阿拉巴马大学)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出DARP双臂机器人感知数据集,含10种桌面物体,经评估几何一致性良好,可用于多视角重建等多类机器人感知相关研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29828 2026-09-01 eess.SY cs.SY 新提交 82%

SymVD: Symmetric Vision Language Action Distillation for Robot Manipulation

SymVD:面向机器人操作的对称视觉语言动作蒸馏

Hyewon Choi, Donggyu Kim, Soojean Han

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract)

AI总结 SymVD是利用操作任务几何对称性的VLA蒸馏框架,采用等变actor-critic架构与自适应加权方案,提升了机器人操作任务的样本效率与泛化能力,优于标准蒸馏及SAC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30880 2026-09-01 cs.RO 新提交 79%

Zeva: In-Context Causal Learning for Generalizable Embodied Manipulation

Zeva:用于泛化具身操作的上下文因果学习

Fu Chen, Xin Ding, Bingjia Huang, Xiangyu Li, Mingju Wang, Jiawei He, Kun Li, Wei Sun, Yunxin Liu, Hao Wu, Ting Cao

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR)) Z-Trans AI

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出Zeva框架,通过上下文因果学习让机器人从自身物理交互经验中学习,无需更新策略模型,在模拟与真实操作中性能优于前沿模型,还能自进化并跨任务泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29487 2026-09-01 cs.RO 新提交 79%

Blind Dexterity: Whole-Body Humanoid Manipulation via Pure Proprioception

盲态灵巧性:仅通过本体感知实现人形机器人全身操作

Aditya Bhatt, Oleg Kaidanov, Puze Liu, Jan Peters

机构 * TU Darmstadt(达姆施塔特工业大学) German Research Center for AI (DFKI)(德国人工智能研究中心) Tongji University(同济大学) Shanghai Research Institute for Autonomous Intelligent Systems(上海自主智能系统研究院) Robotics Institute Germany(德国机器人研究所)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 该研究提出仅用关节编码器本体感知的策略,让Unitree G1人形机器人完成抗推行走、接球等盲态全身操作,证明其可作为灵巧操作与交互式感知的实用基础。

Comments 9 pages, 6 figures. Project page: https://aditya.bhatts.org/BlindDexterity/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29146 2026-09-01 cs.RO 新提交 79%

Systematic Lightweight Method for Robotics Based on Strain Energy Distribution Optimization

基于应变能分布优化的机器人系统轻量化方法

Jingchen Li

机构 * Tencent Robotics X Lab(腾讯Robotics X实验室)

专题命中 机器人操作 :robotics(title);robotic(abstract);分类 cs.RO

AI总结 本研究提出应变能分布优化的机器人系统轻量化方法,可解耦系统级问题,兼顾减重与机械性能,经机械臂案例验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29184 2026-09-01 cs.CR 新提交 71%

GhostSplat: Input-Triggered Backdoors for Multi-View-Consistent 3D Content Manipulation in Feed-Forward Gaussian Splatting

GhostSplat:前馈高斯溅射中用于多视图一致3D内容操纵的输入触发后门

Yudong Gao, Zongjian Ding, Linghan Chen, Yajing Chen, Yu Xinglin, Jiale Liu, Shan Huang, Mingjun Cheng

专题命中 机器人操作 :manipulation(title)

AI总结 GhostSplat是针对前馈3D高斯溅射的输入触发后门,可植入共享生成器权重实现多视图一致的3D内容操纵,在多架构数据集上攻击成功率高且抗常见图像变换,现有防御措施无法有效应对。

Comments 10 pages, 6 figures, 6 tables; includes technical appendix and ancillary reproduction code

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30773 2026-09-01 cs.RO 新提交 70%

Learning to infer and manipulate through distributed whole-arm interaction in a soft robot

通过软体机器人的分布式全臂交互学习推理与操作

Chuhan Zhang, Ebrahim Shahabi, Kseniia Khomenko, Wei Pan, Cosimo Della Santina

机构 * Faculty of Mechanical Engineering(机械工程学院) School of Engineering, Newcastle University(纽卡斯尔大学工程学院) Delft University of Technology(代尔夫特理工大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文针对软体机器人交互利用不足问题,提出含预训练探索策略等创新的强化学习框架,通过混合刚柔臂的IMU实现盲全臂抓取,成功完成物体识别与抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30765 2026-09-01 cs.LG 新提交 70%

T3S: Improving Multi-Task Reinforcement Learning with Task-Specific Feature Selector and Scheduler

T3S:利用任务特定特征选择器与调度器改进多任务强化学习

Yuanqiang Yu, Tianpei Yang, Yongliang Lv, Yan Zheng, Jianye Hao

机构 * Alberta Machine Intelligence Institute(阿尔伯塔机器智能研究所)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.LG

AI总结 该研究针对多任务强化学习的任务间干扰问题,提出含特征选择器与任务调度器的T3S框架,在机器人操作任务上性能优于现有最优多任务强化学习算法。

Comments 8 pages, 7 figures, 4 tables. Published in the 2023 International Joint Conference on Neural Networks (IJCNN)

Journal ref 2023 International Joint Conference on Neural Networks (IJCNN), pp. 1-8, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28733 2026-09-01 cs.RO cs.LG 新提交 62%

Generation of High-Level Concepts in 3D Scene Graphs via Autoregressive Diffusion

基于自回归扩散的3D场景图中高层概念生成

Jose Andres Millan-Romera, Samuel Cognolato, Holger Voos, Jose Luis Sanchez-Lopez, Luciano Serafini

机构 * University of Luxembourg(卢森堡大学) University of Padova(帕多瓦大学) Fondazione Bruno Kessler(布鲁诺·凯塞勒基金会) Faculty of Science, Technology and Medicine(科学、技术与医学学院)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 针对现有3D场景图高层概念生成方法可扩展性不足的问题,提出联合学习结构与特征的自回归扩散图生成模型,在多类数据集上优于基线方法,还提出适配的图级评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28685 2026-09-01 cs.CV cs.LG cs.MM 新提交 62%

Data Diversity, Not Frequency Invariance: A Controlled and Self-Audited Study of Compression-Robust Deepfake Detection

数据多样性,而非频率不变性:一项关于抗压缩深度伪造检测的受控自审计研究

Abbas Aliyev, Samir Rustamov

机构 * ADA University(ADA大学) MegaSec AI Company(MegaSec人工智能公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV、cs.LG

AI总结 该研究通过受控实验发现,抗压缩深度伪造检测的关键是数据多样性而非频率不变性,普通EfficientNet-B0优于CAFRL,对抗分支无增益,需匹配训练配方并利用编解码器多样性提升鲁棒性。

Comments 38 pages, 4 figures. Submitted to IEEE Access. Code, per-video predictions and a claims-to-artifacts map: https://github.com/Capta1n-n9m0/cafrl-negative (v1.0.0); archival deposit: https://doi.org/10.5281/zenodo.22032529

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30656 2026-09-01 cs.CV 新提交 57%

APT: Anchor-aligned Perturbations for Tamper Localization in Fully Regenerated Images

APT:用于完全再生图像篡改定位的锚点对齐扰动

Suhyeon Ha, Woo Jae Kim, Joonsung Jeon, Sooel Son, Sung-eui Yoon

机构 * KAIST(韩国科学技术院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 针对现有篡改定位方法在完全再生图像中失效的问题,提出半脆弱潜在空间扰动APT,通过锚点对齐特征实现篡改定位,在COCO数据集上FR IoU达0.92,性能优于基线,可泛化到未知篡改类型。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29997 2026-09-01 cs.CV 新提交 57%

Discrete Diffusion Bridges for Spatiotemporally Aligned Image Translation and Generation

用于时空对齐图像翻译与生成的离散扩散桥

Xing Xie, Jiawei Liu, Shijun Zhou, Huijie Fan, Zhi Han, Yandong Tang, Liangqiong Qu

机构 * Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) The University of Hong Kong(香港大学) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 该研究提出离散扩散桥(DDB)框架,解决离散扩散在图像翻译与生成中的时空错位问题,通过混合吸收机制和信息引导噪声调度实现平衡,在多生成任务中表现优异且适配低采样步数场景。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29459 2026-09-01 cs.AI 新提交 57%

Toward Latent Language Model Skills Steering and Optimization: An Empirical Study

面向潜在语言模型技能的引导与优化:一项实证研究

Xunyi Jiang, Junda Wu, Yuxin Xiong, Sheldon Yu, Tong Yu, David Arbour, Ritwik Sinha, Julian McAuley, Hongyi Wen

机构 * New York University(纽约大学) Adobe Research(奥多比研究院) UC San Diego(加州大学圣迭戈分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究通过实证探究发现大型语言模型(LLM)的过程技能可表征为激活空间中的向量方向,且可通过向量操作实现技能引导与优化,为LLM过程技能的潜在空间操控提供了表征级视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29456 2026-09-01 cs.CV 新提交 57%

Text-Guided Diffusion-Based Adversarial Attacks on Chest X-Ray Images

基于文本引导扩散模型的胸部X射线图像对抗攻击

Basudha Pal, Arjun Narayanan, Neha Ajith, Vikas R Bhat, Muhammad Umair

机构 * The Johns Hopkins University(约翰斯·霍普金斯大学) Manipal Institute of Technology(马尼帕尔理工学院) Manipal Academy of Higher Education(马尼帕尔高等教育学院) The Johns Hopkins Hospital(约翰斯·霍普金斯医院) Columbia University Irving Medical Center(哥伦比亚大学欧文医学中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 该研究提出文本引导扩散对抗框架攻击胸部X射线分类模型,在多架构上验证其能显著降低分类性能,同时发现人机判读存在重要差异,凸显需扩展医疗AI鲁棒性评估方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29137 2026-09-01 cs.CV 新提交 57%

Chat-Edit-3D++: Interactive 3D and 4D Scene Editing via Large Language Models

Chat-Edit-3D++:基于大语言模型的交互式3D与4D场景编辑

Shuangkang Fang, Yufeng Wang, Yi-Hsuan Tsai, Wenrui Ding, Yi Yang, Shuchang Zhou, Ming-Hsuan Yang

机构 * School of Electrical and Information Engineering, Beihang University(北京航空航天大学电子信息工程学院) Institute of Unmanned System, Beihang University(北京航空航天大学无人系统研究院) Atmanity Inc.(Atmanity公司) Megvii Research(旷视研究院) University of California at Merced(加州大学默塞德分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 该研究针对现有3D场景编辑方案的缺陷,提出Hash-Atlas网络及基于LLM的CE3D++方法,实现2D编辑与3D重建解耦,可调度30种视觉工具,支持3D/4D场景交互式文本驱动编辑。

Comments Project Website: https://sk-fun.fun/CE3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28875 2026-09-01 cs.CL cs.AI cs.SD 新提交 57%

No Detectable Change in Side-Level WER from Prompt-Level Context: A Preregistered Ablation on a Production Oral-History Corpus

提示词层面上下文未检测到侧边级词错误率(WER)变化:对生产级口述历史语料库的预注册消融实验

Theodore O. Cochran, Stephanie Dodson, Keith Nore

机构 * AI for Altruism(利他智能)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该预注册实验在生产级口述历史转录工具上发现,提示词层面上下文未改变侧边级WER,仅短语有小幅改善,需结合序列对齐指标评估上下文机制。

Comments 31 pages, 1 figure. Preregistered on OSF (https://osf.io/ns49b, DOI 10.17605/OSF.IO/NS49B); release materials and dated provider-documentation snapshots in the study component (https://osf.io/9nsvr)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30574 2026-09-01 eess.SY cs.SY 新提交 50%

Exposing the Invisible: Detecting Stealthy Parameter-Based Cyber-Attacks on Inverter Synchronization Loops

揭示隐形威胁:检测针对逆变器同步环路的隐蔽性基于参数的网络攻击

Zaint A. Alexakis, Michal M. Drewniak, Charalambos Konstantinou

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文针对物联网技术应用下逆变器同步环路面临的隐蔽性基于参数的网络攻击,提出一种改进型锁相环,可在保留传统性能的同时检测此类攻击,实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30204 2026-09-01 cs.CL 新提交 50%

When Models Hear What They Expect: Diagnosing Prosodic Heuristics in Multimodal Sarcasm Detection

当模型“听到”它们所期待的:诊断多模态讽刺检测中的韵律启发式算法

Yongjian Chen, Pengfei Wei, Yiqun Sun, Zhu Li, Lawrence B. Hsieh

机构 * Magellan Technology Research Institute (MTRI)(麦哲伦技术研究所(MTRI)) Center for Language and Cognition, University of Groningen(格罗宁根大学语言与认知中心)

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文以讽刺检测为切入点,评估Qwen2.5-Omni等多模态大语言模型,发现模型依赖音高升高、停顿不规则的韵律刻板印象,操控该维度可使假阳性率达60%,且该效应可跨模型复现。

Comments Accepted to EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28902 2026-09-01 physics.optics 新提交 50%

Defects encode high-dimensional topological information

缺陷编码高维拓扑信息

Yunqi Zhang, Fengjun Li, Runchen Zhang, Zi-Lan Deng, Liangyu Deng, Zhikai Zhou, Ruofu Liu, Zimo Zhao, Yifei Ma, Yuanzhe Xu, Zixuan Wang, Yixuan Zhao, Jize Yan, Honghui He, Xiangping Li, Chao He

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究发现斯托克斯缺陷可作为拓扑信息载体,提出斯托克斯缺陷斯格明子,利用全介质超表面实现其结构,达成纳米尺度高维光学信息编码,拓展了缺陷的应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 19 篇

2608.28995 2026-09-01 cs.RO cs.CV 新提交 84%

Hydra: A Navigation World Action Model with Discrete Latent Planning and Continuous Flow-Matching Execution

Hydra:一种具有离散潜在规划与连续流匹配执行能力的导航世界动作模型

Mohammad Nazeri, Alexandyr Card, Samira Huber, Anuj Pokhrel, Yujun Wang, Ruben Hammele, Daeun Song, Sören Pirk, Xuesu Xiao

机构 * George Mason University(乔治梅森大学) Kiel University(基尔大学) Ludwig Maximilian University Munich(慕尼黑大学) Ewha Womans University(梨花女子大学)

专题命中 具身导航 :navigation(title);world model(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Hydra模型,通过将规划器移入模型内部消除生成模型与规划器的表示不对齐问题,结合离散潜在规划与条件流匹配,在物理机器人平台上的目标导向规划与闭环执行能力表现优异。

Comments 29 pages, 12 figures. https://robotixx.github.io/hydra

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30689 2026-09-01 cs.CV 新提交 83%

CANVAS: Consistency-Aware Navigation via Visual Adaptive Sampling for Long-Context Text-to-SVG Generation

CANVAS:面向长上下文文本到SVG生成的一致性感知视觉自适应采样导航

Yichen Wu, Haoxuan Qu, Yihang Lou, Hossein Rahmani, Jun Liu

机构 * University of Nottingham(诺丁汉大学) Lancaster University(兰卡斯特大学) Peking University(北京大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出无训练的CANVAS框架,通过视觉自适应采样提升长上下文文本到SVG生成的全局一致性,无需额外训练即可在多基准上取得良好效果。

Comments 30 pages (including supplementary material), 9 figures, 10 tables. Code: https://github.com/Louis-YW/CANVAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30935 2026-09-01 cs.RO cs.AI 新提交 81%

LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation

LightNav-0:激发视觉语言模型的空间智能以实现通用具身导航

Shaoan Wang, Aocheng Luo, Fei Huang, Jingyi Xu, Xiaoyang Wang, Yueyu Wang, Qianli Ma, Fan Yang, Ran Mei, Jia Wei, Jiangpeng Hu, Xuhao Liu, Hongming Chen, Yuanbin Shao, Yiyang Lin, Ziliang Li, Liang Pan, Xinhang Liu, Yuntao Ma, Tingxiang Fan

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 LightNav-0 是激发 VLM 空间智能的通用具身导航模型,单模型支持多导航任务,在仿真基准和真实场景中均实现最优性能,具备强泛化能力。

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30396 2026-09-01 cs.AI cs.RO 新提交 81%

Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation

将基础模型搭建为物理世界智能体以推动长时程导航前沿

Zixing Lei, Gengze Zhou, Xiong-Hui Chen, Jiazhao Zhang, Yiyang Huang, Hang Yin, Haoqi Yuan, Qi Wu, Weixin Li, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Inc(阿里巴巴集团) Zhongguancun Academy(中关村学院) Adelaide University(阿德莱德大学) Peking University(北京大学) Tsinghua University(清华大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出NavMCP框架,结合VLM推理智能体与NFM执行器实现长时程导航,在多个具身问答基准及Unitree Go2机器人上取得优于基线的性能,验证了该方法的有效性。

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29114 2026-09-01 cs.RO cs.AI 新提交 81%

CGFM-Nav: Cognitive Graph-Field Memory for Semantic-Guided Lifelong Multimodal Embodied Navigation

CGFM-Nav:用于语义引导的终身多模态具身导航的认知图场记忆

Yuxiang Xiao, Xibei Chen, Xin Zhou, Jie Chen, Yifeng Zhang, Guillaume Sartoretti

机构 * National University of Singapore(新加坡国立大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究针对视觉与语言导航中环境表征的不足,提出CGFM及基于其的CGFM-Nav框架,在GOAT-Bench实验中提升了导航的成功率与SPL,验证了方法的有效性。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30242 2026-09-01 cs.RO 新提交 79%

CanonNav: Disentangling Navigation Behavior from Camera Geometry in Cross-Platform Visual Navigation

CanonNav:跨平台视觉导航中解耦导航行为与相机几何

Dong-Wook Kim, Ji-Hoon Hwang, E-In Son, Mintaek Oh, Seung-Woo Seo

机构 * Seoul National University(首尔大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 CanonNav框架解耦导航行为与相机几何,引入相机几何规范化并结合规划监督,仅用RGB推理便在多场景视觉导航中优于相关基线与RGB-D方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30220 2026-09-01 cs.RO 新提交 79%

Contrast-Free Autonomous Navigation of Untethered Endovascular Microrobots Using Single-Plane Fluoroscopy

基于单平面荧光透视的无造影剂 untethered 血管内微型机器人自主导航

Husnu Halid Alabay, Tuan-Anh Le, Ping Wang, Hakan Ceylan

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本研究针对磁驱动 untethered 血管内微型机器人三维导航的临床障碍,提出 VISTA 数字孪生框架,利用单平面荧光透视实现无造影剂自主导航,显著缩短导航时间、减少校正指令与辐射暴露。

Comments 34 pages, 9374 words

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29514 2026-09-01 cs.RO 新提交 79%

A Sliding Window Filter on the Galilean Group for Consistent Aided Inertial Navigation with Unknown Measurement Delays

适用于伽利略群的滑动窗口滤波器:处理未知测量延迟的一致辅助惯性导航

Jonathan Kelly

机构 * Vector Institute(向量研究所) University of Toronto Institute for Aerospace Studies (UTIAS)(多伦多大学航空航天研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对辅助惯性导航中辅助测量的未知恒定延迟问题,提出基于伽利略群的滑动窗口滤波器,联合估计延迟与导航状态,仿真表明该滤波器可显著提升估计一致性。

Comments Accepted to the IEEE International Conference on Multisensor Fusion and Integration (MFI), Pilsen, Czechia, Sep 2-4, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏