arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

期刊&会议

International Conference on Intelligent Robots and Systems · 会议 · Robotics

至 收录 190
2608.13448 2026-08-14 cs.RO 新提交

Mind the Context: Continual Learning of Socially Appropriate Robot Actions via Environmental-Social Disentanglement

关注上下文:通过环境-社会解耦实现社会适配机器人动作的持续学习

Rafal Robert Karpinski, Fethiye Irmak Dogan, Nikhil Churamani, Yiming Luo, Maartje M. A. de Graaf, Davide Dell'Anna, Hatice Gunes

机构 * Utrecht University(乌得勒支大学) University of Cambridge(剑桥大学)

AI总结 该研究针对社交机器人在多样上下文场景下的持续学习问题,提出EDD框架解耦环境与社会知识,缓解遗忘,性能优于现有基线,相关代码已公开。

Comments Extended version of the paper accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2608.11876 2026-08-13 cs.RO cs.HC 新提交

D3D-GEN: Robot-Aware Domain-Grounded Interactive 3D World Generation for Social Robotics

D3D-GEN:面向社交机器人的机器人感知、领域锚定的交互式3D世界生成

Anh Duc Do, Volodymyr Scherbyna, Tai Duc Nguyen, Spaarsh Thakkar, Zhengcheng Shen, Teham Buiyan, Archan Misra, Linh Kästner

机构 * Singapore Management University(新加坡管理大学) Technical University Berlin(柏林工业大学) Max Planck Institute(马克斯·普朗克研究所) Technical University Braunschweig(布伦瑞克工业大学)

AI总结 D3D-GEN是一种新型3D世界生成系统,结合领域智能体与RAG流水线,可快速生成领域锚定的交互式3D世界,已构建多领域数据库并生成数十种仿真环境,适配Isaac Sim等仿真器。

Comments 8 pages, 5 figures, and 5 tables. Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2608.11564 2026-08-13 cs.CV cs.RO 新提交

Repurposing RGB-based Foundation Model for Depth Estimation on Thermal Images Using Hierarchical Supervision

利用分层监督将基于RGB的基础模型重新用于热图像的深度估计

Jie Hong, Tingtian Li, Xuesong Li, Xiao Li

机构 * The University of Hong Kong(香港大学) Commonwealth Scientific and Industrial Research Organisation (CSIRO)(英联邦科学与工业研究组织)

AI总结 针对热图像深度估计中RGB基础模型分层表示利用不足的问题,提出RGB-HS框架,通过分层监督和基于图像质量的标记加权对齐,在基准上实现了有竞争力的性能。

Comments Accepted in IROS 2026

URL PDF HTML 收藏
2608.10938 2026-08-12 cs.CV 新提交

GS-CPE: Unified 6-Degree-of-Freedom Camera Pose Estimation via 3D Gaussian Splatting

GS-CPE:基于3D高斯溅射的统一6自由度相机位姿估计

Huaiyuan Weng, Chul Min Yeum, Su-Min Kang

机构 * University of Waterloo(滑铁卢大学) Soongsil University(崇实大学)

AI总结 该研究提出GS-CPE框架,通过由粗到细策略统一几何粗位姿估计与3D高斯溅射精调,在多数据集上实现最优视觉定位性能,兼顾精度与泛化能力。

Comments 8 pages, accepted at IROS 2026

URL PDF HTML 收藏
2608.10824 2026-08-12 cs.RO cs.CV 新提交

Neural Introspection Gating for Adaptive KV-Cache Reuse in Vision-Language-Action Models

面向视觉-语言-动作模型的自适应KV缓存复用的神经内部门控机制

Zhijie Wu, Kento Kawaharazuka, Kei Okada

机构 * Graduate School of Information Science and Technology, The University of Tokyo(东京大学情报理工学系研究科)

AI总结 针对VLA模型视觉标记KV缓存复用未考虑模型不确定性的问题,提出轻量无训练的Gated VLA-Cache,通过监控动作标记对数几率间隔控制缓存,在LIBERO基准上恢复超100%精度并保留80%算力节省。

Comments 6 pages, 5 figures, Accepted in IROS 2026. Project Page: https://zjw4321.github.io/neural-introspection-gating-page/

URL PDF HTML 收藏
2608.10056 2026-08-12 cs.RO cs.AI cs.LG cs.SY eess.SY 新提交

Navigating the Proximity-Safety Balance: Constraint Decomposition for Human Following in Pedestrian Crowds

权衡 proximity 与安全:人群中跟随目标行人的约束分解方法

Shiting Gong, Jianpeng Yao, Jinfeng Wang, Marco Pavone, Jiachen Li

机构 * University of Pennsylvania(宾夕法尼亚大学) University of California, Riverside(加州大学河滨分校) Stanford University(斯坦福大学) NVIDIA Research(英伟达研究院) Georgia Institute of Technology(佐治亚理工学院)

AI总结 该研究针对人群中行人跟随的 proximity 与安全平衡问题,提出多约束强化学习框架,量化行人运动不确定性以增强安全性,经实验和真实机器人部署验证了方法的有效性。

Comments IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026); Project Website: https://nav-ps-balance.github.io/

URL PDF HTML 收藏
2608.09658 2026-08-11 cs.RO cs.CV cs.HC cs.NI 新提交

Removing Infrastructure Barriers in Human-Robot Collaboration Through Wireless Reconfigurable Cells

通过无线可重构工作单元消除人机协作中的基础设施障碍

Emma Takács, Mátyás Hajós, Ádám Juniki, Ádám Fischer, Zoltán Komáromi, Kristóf Abai, Dániel Horváth, Sándor Máthé, Konstantinos Kousias, Bence Tipary

AI总结 本文提出基于5G的无线可重构人机协作系统,集成多传感器平台与增强的计算机视觉模块,在匈、挪两地5G环境中验证了其可用于安全自适应人机协作的性能。

Comments Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS). A supplementary video demonstrating the workcell is available at https://youtu.be/zobin6oytGk

URL PDF HTML 收藏
2608.09520 2026-08-11 cs.CV cs.RO 新提交

A Height-Constrained 2-Point Minimal Solver for Pose Estimation from Active LED Markers with Event Cameras

带事件相机的主动LED标记点位姿估计的高度约束两点最小求解器

Runze Yuan, Alexander Kappler, Jun Zhang, Kuangyi Chen, Fabio Morbidi, Pascal Vasseur, Cédric Demonceaux, Friedrich Fraundorfer

机构 * Graz University of Technology(格拉茨工业大学) University of Picardie Jules Verne(皮卡迪儒勒·凡尔纳大学) University of Burgundy(勃艮第大学)

AI总结 针对空间受限场景的位姿估计难题,提出结合机载传感器高度与倾斜角的事件相机主动LED标记点两点最小求解器,实验显示其精度优于P2P、性能与P3P相当。

Comments 8 pages, 6 figures, accepted by IEEE/RSJ International Conference on INTELLIGENT ROBOTS & SYSTEMS (IROS) 2026

URL PDF HTML 收藏
2608.08815 2026-08-11 cs.LG 新提交

Distilling Vision-Language Models for Robust Traffic Sign Perception in Autonomous Vehicles

用于自动驾驶汽车鲁棒交通标志感知的视觉-语言模型蒸馏

Pedram MohajerAnsari, Amir Salarpour, Mert D. Pesé

机构 * Clemson University(克莱姆森大学)

AI总结 本研究提出LAMDA框架,通过冻结OpenCLIP文本编码器构建原型库监督视觉特征,在GTSRB和LISA数据集上,可同时提升TSR模型对三类物理攻击的鲁棒性且不降低干净准确率。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2608.07328 2026-08-10 cs.RO cs.LG 新提交

Learning Fault-Tolerant Locomotion with Adaptive Gait Timing

通过自适应步态时序学习容错运动

Giovanbattista Gravina, Luca Rossini, Carlo Rizzardo, Arturo Laurenzi, Nikos Tsagarakis

机构 * Italian Institute of Technology(意大利技术研究院)

AI总结 针对大型四足机器人执行器动力损失的容错运动问题,提出带潜在对齐损失的非对称Actor-Critic深度强化学习方法,通过自适应步态频率实现容错,经仿真与真实实验验证有效。

Comments Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

URL PDF HTML 收藏
2608.06919 2026-08-10 cs.CV cs.RO 新提交

Vernata: Self-Supervised Learning of LiDAR Point Representations

Vernata:激光雷达点表示的自监督学习

Oliver Lemke, Alexander Liniger, Abel Gawel, Marco Hutter

机构 * Robotics and AI Institute(机器人与人工智能研究院) ETH Zurich(苏黎世联邦理工学院)

AI总结 本研究提出基于Sonata架构的Vernata自监督学习框架,通过三项扩展优化激光雷达点云表示,在多数据集上相比基线取得显著性能提升,模态减少场景下仍保持竞争力

Comments IROS 2026. Implementation: https://github.com/rai-opensource/vernata

URL PDF HTML 收藏
2608.06587 2026-08-10 cs.RO cs.AI 新提交

SyncSBC: Decentralized Swarm Behavior Prediction for Synchronized Autonomous Control

SyncSBC:用于同步自主控制的去中心化群体行为预测

Varun Raveendra, Connor Mattson, Daniel S. Brown

机构 * Kahlert School of Computing, University of Utah(犹他大学卡勒特计算学院)

AI总结 SyncSBC 是一种去中心化方法,结合机器学习与分布式共识实现群体行为分类及决策同步,准确率高、延迟低,可用于机器人异常识别与行为协同。

Comments 8 pages, 10 figures, IROS 2026

URL PDF HTML 收藏
2608.05365 2026-08-07 cs.RO 新提交

Unified Planning-Learning Framework for Robust UUV Navigation Under Partial Observability

部分可观测条件下用于自主水下航行器(UUV)鲁棒导航的统一规划-学习框架

Md Ether Deowan, Eleni Kelasidi

机构 * NTNU(挪威科技大学)

AI总结 该研究提出统一规划-学习框架,结合占用地图构建、规划与控制,通过行为树蒸馏等技术提升UUV在部分可观测动态水下环境的导航鲁棒性与安全性,经仿真验证优于基线方法。

Comments 8 pages, 6 figures. Accepted for presentation at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026), Philadelphia, PA, USA

URL PDF HTML 收藏
2608.05215 2026-08-07 cs.RO cs.CV 新提交

VLAff: Vision-Language-Affordance Model for Unified Actionable Affordances

VLAff:用于统一可操作 affordance 的视觉-语言-affordance 模型

Jihoon Oh, Kento Kawaharazuka, Kei Okada

机构 * University of Tokyo(东京大学)

AI总结 本研究提出 VLAff 模型,结合 EgoAffordance 数据集,解决人类与机器人 embodiment 不匹配问题,实现视觉 affordance 预测及真实机器人零样本操作等应用。

Comments 8 pages, 5 figures. Accepted to IEEE/RSJ IROS 2026. Project page: https://ojh6404.github.io/vlaff/

URL PDF HTML 收藏
2608.05209 2026-08-07 cs.CV 新提交

MapTCL: Temporal Consistency Learning via Bidirectional Alignment for Vectorized HD Map Construction

MapTCL:用于矢量化高清地图构建的双向对齐时序一致性学习

Hyeonseo Kim, Juyeb Shin, Hyeonjun Jeong, Hiwon Shin, Dongsuk Kum

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 针对动态城市环境下在线高清地图构建的时序稳定性问题,提出即插即用模块MapTCL,通过双向矢量一致性学习与栅格地图一致性学习联合训练,在两个基准上显著提升基线模型性能且无额外推理开销。

Comments Accepted at 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

URL PDF HTML 收藏
2608.03563 2026-08-05 cs.RO 新提交

Unified Visuomotor Targets: Supervising VLAs Beyond Physical Actions

统一视觉运动目标:监督视觉语言智能体(VLA)超越物理动作

Zhenyang Feng, Unnat Jain

AI总结 本研究针对VLA模型训练中视觉语言高级表示与机器人低级动作的不匹配问题,提出UVT统一视觉运动目标,无需改动架构或额外数据,在仿真与真实双臂任务中提升了VLA的训练效率、性能与鲁棒性

Comments Accepted at IROS 2026. Project page: https://unified-visuomotor-targets.github.io/

URL PDF HTML 收藏
2608.03296 2026-08-05 cs.RO cs.CV 新提交

PLS-Calib: A Partial Least Squares Framework for Event Camera and Odometry Calibration under Ground Motion Constraints

PLS-Calib:一种在地面运动约束下用于事件相机与里程计校准的偏最小二乘框架

Guangyu Li, Xiao Li, Yujie Wu, Changshuo Wang, Prayag Tiwari, Jiang Cai, Fangwen Yu, Mingkun Xu

AI总结 针对地面约束机器人的传感器校准难题,提出PLS-Calib框架,利用PLS回归建模传感器流相关性,结合极性感知事件表示,在合成与真实数据集上验证其校准鲁棒性和精度优于现有最优方法。

Comments 8 pages, 10 figures, 4 tables. Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2608.03231 2026-08-05 cs.RO cs.AI 新提交

Structure-Aware Robust Fine-Tuning: Defending Vision-Language-Action Robots Against Physical Attention Hijacking

结构感知鲁棒微调:防御视觉-语言-动作机器人抵御物理注意力劫持

Jinquan Zhang, Dongfu Yin, Run Yang, Yufeng Yan, Zhen Tian, F. Richard Yu

AI总结 本研究针对视觉-语言-动作机器人面临的物理注意力劫持攻击,提出注意力引导语义破坏攻击方法,并开发结构感知鲁棒微调防御方法,大幅降低攻击失败率并提升真实机械臂操控成功率。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2608.03155 2026-08-05 cs.RO 新提交

POMDPs for Autonomous Science Exploration

用于自主科学探测的POMDP

Daniel Guirguis, Nathan Wallace, Hanna Kurniawati, Salah Sukkarieh

AI总结 该研究提出SHM-POMDP模型,解决高维观测下POMDP规划融入科学表征的难题,在RockSample域和Cuprite地质探测任务中,其性能优于传统POMDP与信息论基线方法。

Comments 8 pages, 3 figures, 2 tables. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2608.02320 2026-08-04 cs.RO cs.CV 新提交

TravKAN: Fast and Interpretable Nonlinear Traversability Analysis with Kolmogorov-Arnold Networks

TravKAN:基于Kolmogorov-Arnold网络的快速可解释非线性可通行性分析

Daniel Fusaro, Simone Mosco, Wanmeng Li, Alberto Pretto

AI总结 本文提出基于Kolmogorov-Arnold网络的TravKAN框架,结合LiDAR反射率手工特征,在公开数据集上性能优于传统深度模型,兼具可解释性与高效性,适用于安全关键的机器人可通行性分析。

Comments This paper has been accepted for publication at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

URL PDF HTML 收藏
2608.01015 2026-08-04 cs.RO cs.AI 新提交

KING: Embodiment-Aware Kinematic Graph Neural Network for Unified Motion Representation of Legged and Wheeled Robots

KING:具身感知运动图神经网络,用于轮式与腿式机器人的统一运动表示

Taku Okawara, Aoki Takanose, Kenji Koide, Shuji Oishi, Masashi Yokozuka

机构 * the National Institute of Advanced Industrial Science and Technology(国立先进工业科学技术研究院)

AI总结 本文针对现有运动模型对新机器人具身泛化能力差的问题,提出基于GNN的KING模型,实现轮式与腿式机器人的统一运动表示,仅需少量数据即可适配新具身并实现高精度里程计估计。

Comments IROS 2026

URL PDF HTML 收藏
2608.00730 2026-08-04 cs.RO 新提交

Push-Wiper: Toward General-Purpose Robotic Cleaning across Varied Stains and Surfaces with Segmented Pushing Trajectories

Push-Wiper:基于分段推动轨迹的通用机器人清洁方案,用于处理不同污渍与表面

Renhao Lu, Mingxin Wang, Chenyang Cao, Yang Yang, Guoping Pan, Kangkang Dong, Yi Cheng, Houde Liu

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Z-Lab, Zerith Robotics(Zerith机器人公司Z-Lab实验室) University of Toronto(多伦多大学)

AI总结 Push-Wiper 框架将粘性污渍清洁转化为聚合问题,通过分段推动轨迹结合 Diffusion Policy 与 ASPI 控制器,清洁得分比基线高130%,可零样本泛化至多种污渍与表面。

Comments 8 pages, 8 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2608.00715 2026-08-04 cs.RO cs.LG 新提交

Staged Multi-Agent Training (SMAT) for Hip Exoskeletons: Metabolic and Biomechanical Validation of a Simulation-Trained Co-Adaptive Controller

用于髋部外骨骼的分阶段多智能体训练(SMAT):仿真训练的协同自适应控制器的代谢与生物力学验证

Yifei Yuan, Jakob Wolf, Ghaith Androwis, Xianlian Zhou

机构 * New Jersey Institute of Technology(新泽西理工学院) Kessler Foundation(凯斯勒基金会)

AI总结 本研究提出分阶段多智能体训练(SMAT)策略,将其部署于髋部外骨骼并经8名健康成人测试,证实该策略可显著降低代谢率,且在不同步行速度和地形上具备泛化性。

Comments 14 pages, 9 figures. Extended version of a paper to appear at IROS 2026 (arXiv:2603.07618)

URL PDF HTML 收藏
2608.00272 2026-08-04 cs.RO 新提交

Localization in Spatiotemporal Fields via Environmental PDEs

基于环境偏微分方程的时空场定位方法

Jose Fuentes, Abdullah Al Redwan Newaz, Ana Cavalcanti, Leonardo Bobadilla

AI总结 该研究提出基于PDE控制的环境时空场的定位框架,采用Rao-Blackwellized粒子滤波器分解车辆状态,仿真与实验表明其定位精度优于标准粒子滤波器,验证了环境场用于实际定位的可行性。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2607.29482 2026-08-03 cs.RO 新提交

Temporal Policy: History-Initialized Action Generation for Robotic Learning from Demonstration

时间策略:用于机器人演示学习的历史初始化动作生成

Dylan Miller, Martin Jagersand

机构 * University of Alberta(阿尔伯塔大学)

AI总结 本文提出Temporal Policy生成框架,将动作生成为时间耦合传输问题,在降低近一个数量级传输成本的同时匹配基线成功率,实现高频闭环控制。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2607.28995 2026-08-03 cs.RO 新提交

Receding-Horizon Next-Best-View Planner for Autonomous Leaf Surface Reconstruction

面向自主叶片表面重建的滚动时域次最佳视点规划器

Arif Ahmed, Sajal K. Das, Parikshit Maini

机构 * University of Nevada, Reno(内华达大学雷诺分校) Missouri University of Science and Technology(密苏里科技大学)

AI总结 本研究针对自主叶片表面重建的规划预算与计算资源限制,提出滚动时域次最佳视点规划器,通过基于质心的信息增益函数优化视点效用,在草莓数据集上使重建精度较基线最高提升10%。

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

URL PDF HTML 收藏
2607.27881 2026-07-31 cs.RO cs.AI 新提交

RoboBRIDGE: A Modular Framework for Bridging Policies to Robust Real-World Robotic Agents

RoboBRIDGE:一种将策略桥接至鲁棒现实世界机器人智能体的模块化框架

Sihyung Yoon, Minjong Yoo, Sanghyun Ahn, Seojeong Choi, Honguk Woo

机构 * Sungkyunkwan University(成均馆大学)

AI总结 该研究针对视觉-语言-动作模型部署为机器人智能体的缺陷,提出 RoboBRIDGE 模块化框架,通过五大协同模块结合预训练 VLAs 构建鲁棒智能体,在多基准和现实场景中性能优于现有方案。

Comments Accepted to IROS 2026. 8 pages, 6 figures

URL PDF HTML 收藏
2607.26337 2026-07-30 cs.RO eess.IV 新提交

Reeling It In: Flexible Needle Pick Up via Thread Manipulation for Autonomous Suturing

收线:通过线操作实现自主缝合的柔性缝针拾取

Emma Huang, Zih-Yun Chiu, Neelay Joglekar, Shanglei Liu, Michael C. Yip

机构 * University of California San Diego(加利福尼亚大学圣迭戈分校) Johns Hopkins University(约翰斯·霍普金斯大学) Carnegie Mellon University(卡内基梅隆大学) UC San Diego Health(加州大学圣迭戈分校健康中心)

AI总结 本研究提出一种基于缝合线辅助的自主缝针拾取框架,通过线操作实现间接拾取,可应对缝针被遮挡或不可接近等场景,提升了自主缝合的鲁棒性。

Comments Accepted to IROS 2026

URL PDF HTML 收藏
2607.26283 2026-07-30 cs.CV cs.RO 新提交

HeteroPROPMT: A Real-time and Privacy-Preserving Heterogeneous Collaborative Perception Framework

HeteroPROPMT:一种实时且隐私保护的异构协同感知框架

Armin Maleki, Hayder Radha

机构 * Michigan State University(密歇根州立大学)

AI总结 HeteroPROPMT是一种实时隐私保护异构协同感知框架,通过模块化提示与轻量调优对齐异构智能体特征,在OPV2V-H等数据集上性能优于现有方法,且参数效率高、隐私性好。

Comments Accepted to 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS). 9 pages, 4 figures, 5 tables

URL PDF HTML 收藏
2607.25448 2026-07-29 cs.RO 新提交

Room-Mediated Co-occurrence for Zero-Shot Object-Centric Semantic Navigation via Frontier Scoring

通过前沿评分实现基于零样本目标中心语义导航的房间介导共现

Adam Scicluna, Gavin Paul, Alen Alempijevic

机构 * Robotics Institute, Faculty of Engineering and Information Technology, University of Technology Sydney (UTS)(悉尼科技大学工程与信息技术学院机器人研究所)

AI总结 研究零样本目标中心语义导航,提出通过房间词汇表介导对象关系的无需训练的管道,利用CLIP-derived的RPV计算共现,经洪水填充传播投影到值图排序前沿,相比基线提升了SR和SPL,保留可解释性与灵活性。

Comments 8 pages. Accepted to IROS 2026

URL PDF HTML 收藏