arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-25 至 2026-08-25 共收录 156 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 3 篇

2608.22701 2026-08-25 cs.RO 新提交 84%

Physics Filtering Favors the Generalization of Robot Learning

物理滤波有利于机器人学习的泛化

Jindou Jia, Shixuan Han, Meng Wang, Gen Li, Zihan Yang, Sicheng Zhou, Kexin Guo, Jianfei Yang, Xiang Yu, Wei Wang, Lei Guo

机构 * Nanyang Technological University(南洋理工大学) Beihang University(北京航空航天大学) National University of Singapore(新加坡国立大学) Beijing Aerospace Control Instrument Research Institute(北京航天测控仪器研究所)

专题命中 机器人学习 :robot learning(title);robotics(abstract,comments);robotic(abstract);分类 cs.RO

AI总结 该研究提出轻量、模型无关的 PhyFilter 反馈机制,无需海量训练数据,即可提升机器人在动态不确定性下的泛化能力,在四类机器人系统上验证了其有效性。

Comments Accepted by npj Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22197 2026-08-25 cs.LG 新提交 57%

On the Capability Separation Between World-Model Policy Learning and Imitated World-Action Models

世界模型策略学习与模仿世界-动作模型之间的能力分离

Yang Yu

机构 * Nanjing University(南京大学)

专题命中 机器人学习 :world model(abstract);分类 cs.LG

AI总结 该研究对比了直接行为克隆策略等三类策略,明确世界-动作模型学习与直接行为克隆的能力差异,指出观测演示无法识别动作效果,干预可实现零遗憾值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14255 2026-08-25 cs.RO 版本更新 57%

A Latency-Aware Framework for Visuomotor Policy Learning on Industrial Robots

面向工业机器人视觉-运动策略学习的延迟感知框架

Daniel Ruan (1), Salma Mozaffari (1), Sigrid Adriaenssens (1), Arash Adel (1) ((1) Princeton University)

机构 * Princeton University(普林斯顿大学)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种面向工业机器人视觉-运动策略学习的延迟感知框架,通过优化执行策略以应对延迟问题,提升策略在现实环境中的可靠性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 42 篇

2509.23155 2026-08-25 cs.RO 版本更新 92%

LaGEA: Language Guided Embodied Agents for Robotic Manipulation

LAGEA:基于语言引导的机器人操作代理

Abdul Monaf Chowdhury, Akm Moshiur Rahman Mazumder, Safaeid Hossain Arib, Rabeya Akter

机构 * Department of Robotics Mechatronics Engineering, University of Dhaka, Bangladesh Center for Computational \& Data Sciences, Independent University, Bangladesh

专题命中 机器人操作 :robotic(title,abstract);embodied agent(title,abstract);manipulation(title,abstract);分类 cs.RO

AI总结 LAGEA通过语言引导具身代理学习,提升机器人操作任务的成功率和效率。

Comments ICML 2026 Main Track Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01027 2026-08-25 cs.RO 版本更新 92%

$τ_0$-WM: A Unified Video-Action World Model for Robotic Manipulation

$\tau_0$-WM:一种用于机器人操作的统一视频-动作世界模型

Pengfei Zhou, Shengcong Chen, Di Chen, Jiaxu Wang, Rongjun Jin, Bingwen Zhu, Yike Pan, Songen Gu, Kuanning Wang, Shufeng Nan, Xingyu Qiu, Chenhao Qiu, Pu Yang, Yunuo Cai, Jianxiong Gao, Yifan Li, Yanwei Fu, Xiangyu Yue, Zhi Chen, Jianlan Luo

机构 * Shanghai Innovation Institute(上海创新研究院) AGIBOT Finch

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 提出$\tau_0$-WM,一个统一视频-动作世界模型,通过共享视频扩散骨干集成策略学习、视频预测和动作评估,在长时域和精细操作任务上优于基线。

Comments Our project homepge: this https URL (https://tau0-wm.github.io)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22067 2026-08-25 cs.RO cs.AI cs.CV cs.LG 新提交 90%

Inferring Action from Future Latent State for Robotic Manipulation

从未来隐状态推断机器人操纵动作

Fenghao Lei, Zhixiong Huang, Long Yang, Jiabao Chen, Jie Cheng, Peilin Huang, Han Fu, Zhuo Li, Xiaoxue Ren

机构 * DeepLeap Research(DeepLeap研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);world model(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出无需视频生成的机器人操纵模型DELE-w0.5,通过从捕获动作相关物理结果的未来隐状态推断动作,在4项长程操纵任务的480次试验中,其性能优于最强基线47.5和30.7个百分点,实现最优表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22100 2026-08-25 cs.RO 新提交 89%

Contact-Rich Robotic Manipulation in Construction via Zero-Shot Learning: A Diffusion Policy-Guided Adaptive Control

基于零样本学习的建筑领域接触丰富型机器人操作:扩散策略引导的自适应控制

Roman Ibrahimov (1), Salma Mozaffari (1), Arash Adel (1) ((1) Princeton University)

机构 * Princeton University(普林斯顿大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本研究提出扩散策略与L1启发自适应控制器耦合的框架,实现建筑接触丰富型机器人装配的零样本仿真到真实迁移,在多类任务中取得高成功率,降低真实数据需求,推进多阶段装配自动化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22296 2026-08-25 cs.RO cs.CV 新提交 88%

TONAV: Task-Oriented Navigation and Action-Velocity Chunk Learning for Articulated Object Quadrupedal Mobile Manipulation

TONAV:面向关节物体四足移动操作的任务导向导航与动作-速度块学习

Haoran Lin, Mingyu Yang, Pengfei Qi, Kehan Chen, Qiang Diao, Liangji Zeng, Wenrui Chen, Yaonan Wang, Kailun Yang

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University(湖南大学机器人视觉感知与控制技术国家工程研究中心) College of Semiconductors (College of Integrated Circuits), Hunan University(湖南大学半导体学院(集成电路学院))

专题命中 机器人操作 :manipulation(title,abstract);navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 该研究针对四足移动操作中导航与操作的耦合问题,提出TONAV框架,结合任务导向导航与动作-速度块学习,通过遥操作、视觉语言推理及速度监督实现更优的操作性能。

Comments The project page is at this https URL (https://haochen611.github.io/TONAV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22278 2026-08-25 cs.RO 新提交 88%

DreamMimic: Learning Visuomotor Whole-Body Loco-Manipulation via World Model

DreamMimic:通过世界模型学习视觉运动全身移动操作

Jie Yin, Xingyu Lai

机构 * Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);分类 cs.RO

AI总结 DreamMimic 框架通过世界模型辅助蒸馏,将特权教师策略提炼为基于视觉的人形机器人控制器,引入 PCG 平衡引导与探索,在 OMOMO 和 BEHAVE 上提升了视觉移动操作性能。

Comments accepted to IROS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21592 2026-08-25 cs.RO 新提交 88%

Force/Torque-Based Kinematic Adaptation for Robotic Manipulation Tasks

基于力/力矩的机器人操作任务运动学自适应

Carl Glen Henshaw (US Naval Research Laboratory)

机构 * U.S. Naval Research Laboratory(美国海军研究实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种仅用关节角与腕部力/力矩传感器的在线自适应方案,推导了稳定的运动学更新律,通过仿真验证其在孔轴插入任务中的有效性,为操作学习分解为任务策略与自适应运动学组件奠定基础。

Comments 29 pages including appendices, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17774 2026-08-25 cs.RO 版本更新 88%

Learning Diffusion Policies for Robotic Manipulation of Timber Joinery under Fabrication Uncertainty

通过扩散策略学习实现建筑中的接触密集机器人装配

Salma Mozaffari (1), Daniel Ruan (1), William van den Bogert (2), Nima Fazeli (2), Sigrid Adriaenssens (1), Arash Adel (1) ((1) Princeton University, (2) University of Michigan)

机构 * Princeton University(普林斯顿大学) University of Michigan(密歇根大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文研究了在建筑施工中使用扩散策略学习提升机器人装配的鲁棒性和精度,通过紧密契合的木构接合作为案例,证明扩散策略能通过接触感知控制补偿对齐误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22800 2026-08-25 cs.RO cs.AI 新提交 84%

Triplet2Track: A Hierarchical System with Object-Centric Representations for Reliable Long-Horizon Manipulation

Triplet2Track:一种基于以对象为中心表征的可靠长 horizon 操作分层系统

Jianxiang Liu, Gaojing Zhang, Chuan Wen, Qipeng Liu, Yuxuan Zhao, Ning Guo, Wenzhao Lian

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) School of Engineering and Informatics, University of Sussex(萨塞克斯大学工程与信息学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对长 horizon 机器人操作可靠性难题,提出 Triplet-to-Track System(TTS),该闭环模仿学习系统用人类视频减少数据依赖,经实验平均成功率达74.8%,支持对象级与组合泛化。

Comments 8 pages, 6 figures. Accepted for presentation at the 2026 IEEE International Conference on Systems, Man, and Cybernetics (SMC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26757 2026-08-25 cs.RO 版本更新 83%

Beyond Viewpoint Generalization: What Multi-View Demonstrations Offer and How to Synthesize Them for Robot Manipulation?

超越视角泛化:多视角演示提供了什么以及如何为机器人操作合成它们

Boyang Cai, Qiwei Liang, Jiawei Li, Shihang Weng, Zhaoxin Zhang, Tao Lin, Xiangyu Chen, Wenjie Zhang, Jiaqi Mao, Weisheng Xu, Bin Yang, Jiaming Liang, Junhao Cai, Renjing Xu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Shenzhen University(深圳大学) Beijing Jiaotong University(北京交通大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究通过实验验证多视角演示在机器人操作中的性能提升,揭示了多视角数据在提升泛化能力和突破单视角限制方面的优势,提出RoboNVS框架合成多视角数据以提升下游政策表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17885 2026-08-25 cs.CV cs.AI cs.RO 版本更新 83%

PEAfowl: Perception-Enhanced Multi-View Vision-Language-Action for Bimanual Manipulation

PEAfowl:感知增强的多视角视觉-语言-动作用于双臂操作

Qingyu Fan, Zhaoxiang Li, Jinrui Hu, Yi Lu, Wang Chen, Qiu Shen, Xiao-xiao Long, Yinghao Cai, Tao Lu, Shuo Wang, Xun Cao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanjing University(南京大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.CV;robotics(comments)

AI总结 PEAfowl通过增强感知的多视角视觉-语言-动作策略,提升双臂操作在复杂环境中的稳定性和成功率。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L), 2026. This version includes an extended appendix with additional implementation details, deployment analysis, robustness evaluation, and real-world evaluation protocol. DOI: https://doi.org/10.1109/LRA.2026.3726379

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22799 2026-08-25 cs.RO cs.CV eess.SY 新提交 81%

Reproducible Vision-Guided 6-DoF Robotic Manipulator with a Mixed Stepper-Driver Architecture and Browser-Native Control

可复现的视觉引导6自由度机械臂:混合步进电机驱动器架构与浏览器原生控制

Lasan Perera, Deneth Priyadarshana, Dulana Pitiwaduge, Isitha Dinujaya, Mokshan Colambage

机构 * University of Moratuwa(莫拉图瓦大学)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 该研究推出开源低成本6自由度机械臂NeuralNexus Arm,采用混合步进驱动器架构与浏览器原生控制,具备视觉引导自主抓取能力,所有设计开源且可复现。

Comments 13 pages, 16 figures, 7 tables. Design files and firmware: this https URL (https://github.com/Lasan-Perera/6-dof-arm-neuralnexus)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22449 2026-08-25 cs.RO cs.AI 新提交 81%

EMPIRE: Explicit Manipulation Planning as a Learnable Intermediate Representation for Egocentric Hand-Motion Forecasting

EMPIRE:将显式操作规划作为可学习中间表征用于自我中心视角下手运动预测

Wen Wang, Ruibing Hou, Hong Chang, Shiguang Shan, Xilin Chen

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究针对现有手运动预测方法忽略操作过程、梯度干扰的问题,提出两阶段框架EMPIRE,构建EMPIRE-651K数据集,实现了更优的手运动预测精度。

Comments 14 pages, 10 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23238 2026-08-25 cs.CV 新提交 79%

Mover360: Controllable Object Manipulation in 360° Panoramic Images

Mover360:360°全景图像中的可控物体操作

Haoyi Zhong, Fang-Lue Zhang, Andrew Chalmers, Taehyun Rhee

机构 * Victoria University of Wellington(惠灵顿维多利亚大学) University of New South Wales(新南威尔士大学) The University of Melbourne(墨尔本大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 Mover360是针对360°全景图像的可控物体操作框架,以物体平移为核心,支持插入、移除辅助任务,在多域多评估协议下优于相关强基线,代码与基准数据集已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21735 2026-08-25 cs.RO 新提交 79%

Safety-Critical Bilateral Teleoperation for Omnidirectional Aerial Manipulation Using Force-Sensorless Haptic Feedback

采用无力传感器触觉反馈的全向空中操纵安全关键双边遥操作

Yubin Kim, Jinwoo Lee, Yongjun You, H. Jin Kim, Jeonghyun Byun

机构 * Seoul National University(首尔大学) Automation and System Research Institute (ASRI)(自动化与系统研究所) Institute of Advanced Aerospace Technology (IAAT)(先进航空航天技术研究所)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出一种整合视觉与无力传感器触觉力反馈的安全关键双边遥操作框架,采用基于控制障碍函数的分层安全滤波器,避免自由飞行时的意外反馈,提升空中操纵的安全性与稳定性。

Comments 8 pages, 10 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17443 2026-08-25 cs.AI cs.CL cs.CY 版本更新 74%

Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems

在位优势:LLM推荐系统中的品牌偏见与认知操纵动态

Xi Chu, Yupeng Hou

机构 * Trine University(特莱恩大学) Texas A&M University(德克萨斯农工大学)

专题命中 机器人操作 :manipulation(title);分类 cs.AI

AI总结 研究LLM推荐中的品牌动态,发现知名品牌在同等规格下获100%推荐(IAI=10.0),但微弱评分优势可打破垄断;权威营销语言(如虚假临床证据)以+0.17评分点的偏差剩余价值打破垄断;多品牌GEO竞争存在社会困境,集体优化降低个体收益。

Comments 16 pages, 4 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27533 2026-08-25 cs.RO 版本更新 74%

Inducing Calmness With Pocket-Sized Robotics: Reducing Movement and Heart Rate in Children through Hand-Held Tactile Interactions

用口袋大小的机器人诱导平静:通过手持触觉交互降低儿童的心率和运动

Morten Roed Frederiksen, Kasper Støy, Maja Matarić

机构 * Data Systems and Robotics, IT-University of Copenhagen(数据系统与机器人,丹麦IT大学) Interaction Lab, University of Southern California(交互实验室,南加州大学)

专题命中 机器人操作 :robotics(title);分类 cs.RO

AI总结 本研究通过手持触觉设备上的节奏振动匹配游戏,发现触觉交互能显著降低儿童的生理唤醒(心率下降3.56 bpm)和身体躁动(整体运动减少38%),从而促进平静和专注状态。

Comments 34 pages, 2 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22419 2026-08-25 cs.RO cs.CV 新提交 73%

Robust Bimanual Vision-Language-Action Models via Embarrassingly Simple Modality Masking

基于极其简单的模态掩码机制的鲁棒双臂视觉-语言-动作模型

Dongzhou Cheng, Ziang Li, Yixiao Zhou, Haojuan Li, Jinghao Zhang, Lei Lei, Minjing Dong, Jie Gui, Jiaqi Wang

机构 * Shanghai Innovation Institute(上海创新研究院) Wuhan University(武汉大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Southeast University(东南大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究针对双臂操作中查询式VLA模型的动作不连续问题,提出仅训练用的模态掩码机制(M3),在RoboTwin 2.0等任务上使平均成功率提升超11.4%至30%以上,有效增强了模型鲁棒性。

Comments 35 pages, 22 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22398 2026-08-25 cs.RO cs.CV 新提交 73%

MotionDLO: Hybrid Event- and Frame-Based Tracking of Deformable Linear Objects

MotionDLO:基于事件与帧的混合可变形线性物体跟踪框架

Annalena Hartmann, Priyamvada Ajithkumar, Patrick Bründl, Jörg Franke

机构 * Institute for Factory Automation and Production Systems, Friedrich-Alexander-Universität Erlangen-Nürnberg(弗里德里希-亚历山大-埃尔兰根-纽伦堡大学工厂自动化与生产系统研究所)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 MotionDLO是基于事件与帧的混合可变形线性物体跟踪框架,结合CPD算法,以12ms更新速率实现实时、高精度DLO跟踪,适用于机器人操作,源代码与数据集公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21550 2026-08-25 cs.RO 新提交 70%

GOLEM: Modular Humanoid Autonomy Towards Electric Vehicle Battery Disassembly

GOLEM:面向电动汽车电池拆解的模块化人形自主系统

Max Conway, William Xie, Allen Devaraj, Yutong Zhang, Niraj Pudasaini, Mateo Feit, Adam Abid, Zachary Allen, Chen Liu, Xuan Tan, Jensen Lavering, Jason Chen, Lyle Antieau, Anthony Von Pischke, Alessandro Roncone, Zachary Sunberg, Nikolaus Correll

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) University of Notre Dame(圣母大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 该研究针对人工拆解报废EV电池的痛点,提出适配Unitree H1-2人形机器人的GOLEM开源模块化架构,通过仿真与现实实验验证了其在电池拆解各模块的性能,可用于人形机器人相关能力的公平对比与开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20817 2026-08-25 cs.CR cs.RO 版本更新 70%

GhostTac: Manipulating Tactile Sensors without Physical Contact

GhostTac:无物理接触的触觉传感器操纵技术

Kun Wang, Xuancun Lu, Ruochen Zhou, Kai Wang, Tongjun Ye, Yihao Shao, Chen Yan, Xiaoyu Ji, Wenyuan Xu

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究人员提出首个非接触式触觉传感器操纵攻击GhostTac,利用电磁干扰引发测量偏差,在15个传感器上验证有效性,揭示机器人触觉传感的新型物理攻击向量。

Comments Accepted at ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21424 2026-08-25 cs.CV cs.GR cs.HC cs.LG cs.MM 新提交 62%

EditStream: A Unified Autoregressive Framework for Interactive Video Generation and Editing

EditStream:用于交互式视频生成与编辑的统一自回归框架

Yuqian Zhou, Zhenghong Zhou, Zongze Wu, Cameron Smith, Richard Zhang, Jiebo Luo, Eli Shechtman, Zhe Lin

机构 * Adobe Research(Adobe研究院) University of Rochester(罗切斯特大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV、cs.LG

AI总结 本研究提出EditStream框架,整合多类视频生成编辑任务,通过两阶段蒸馏方法优化自回归模型,实现高质量交互式视频创作,填补了扩散模型与创意工作流的衔接空白。

Comments 25 pages, 12 figures, Project page: this https URL (https://real-time-video-research.github.io/editstream/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22965 2026-08-25 cs.CV 新提交 57%

Simplified Cross-Modal Calibration for Heterogeneous Event-RGB Stereo Systems

面向异构事件-RGB立体系统的简化跨模态标定

Nico Hessenthaler, Adam T. Müller, Nicolaj C. Stache

机构 * Center for Machine Learning Heilbronn University of Applied Sciences(海尔布隆应用科学大学机器学习中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.CV

AI总结 针对异构事件-RGB立体系统的标定瓶颈,提出无运动跨模态标定框架,简化流程且降低重投影误差,在机器人眼到手标定中具实用性。

Comments Accepted to the 37th British Machine Vision Conference (BMVC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22126 2026-08-25 cs.LG cs.CL 新提交 57%

Decoupled Physical Modeling and Execution for Physics Reasoning

用于物理推理的解耦物理建模与执行

Ye Zhang, Xuehang Guo, Rui Pan, Pengfei Yu, Denghui Zhang, Manling Li, Qingyun Wang

机构 * University of Pennsylvania(宾夕法尼亚大学) William & Mary(威廉玛丽学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊公司) Stevens Institute of Technology(史蒂文斯理工学院) Northwestern University(西北大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 该研究提出解耦物理建模与执行的统一框架,通过两阶段后训练策略提升小型大语言模型物理推理性能,在多个基准上实现约3%的平均性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21894 2026-08-25 cs.RO cs.HC 新提交 57%

An Interpretable Deep Learning Framework for Material Perception and Classification from Multisensory Tactile Data

用于多感官触觉数据材料感知与分类的可解释深度学习框架

Li Zou, Dave Hogendoorn, Yasemin Vardar

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 该研究开发含三个深度学习模型的可解释框架,结合集成梯度实现高准确率与可解释性,揭示热线索具高信息价值,为触觉信号到材料感知提供计算解释。

Comments 7 pages, 5 figures, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21841 2026-08-25 cs.AI cs.HC 新提交 57%

AI Watchdog: Agent Interfaces for Detecting and Defending Against Manipulative Dark Patterns in AI Conversations

AI 看门狗:用于检测和防御 AI 对话中操纵性黑暗模式的智能体接口

Rachel Poonsiriwong, Chayapatr (Pub) Archiwaranguprok, Constanze Albrecht, Monchai Lertsutthiwong, Pattie Maes, Pat Pataranutaporn

机构 * MIT Media Lab(麻省理工学院媒体实验室) KASIKORN Labs(Kasikorn实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究提出 AI Watchdog 浏览器智能体接口,可检测对话式 AI 的五类黑暗模式,实验发现无认知强制的即时警告能显著降低用户对含黑暗模式的 AI 引导建议的依从性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21803 2026-08-25 cs.CR cs.AI 新提交 57%

ExplainGuard: A Zero Trust Framework for Post-Hoc Explanation Integrity Guarantees in Blackbox XAI Models

ExplainGuard:一种用于黑盒XAI模型事后解释完整性保证的零信任框架

Maraz Mia, Shovan Roy, Mir Mehedi A. Pritom, Maanak Gupta

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出ExplainGuard零信任框架,通过策略决策点的三项验证支柱,中和XAI解释操纵攻击,将审计过程转为可验证操作,保障黑盒XAI模型事后解释的完整性。

Comments 9 pages, 2 figures. Accepted at the IEEE Cybersecurity Awareness and Research Symposium 2026 (IEEE CARS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏