arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-15 至 2026-01-15 共收录 40 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8 篇

2510.16281 2026-01-15 cs.RO cs.AI cs.LG 67%

Do What You Say: Steering Vision-Language-Action Models via Runtime Reasoning-Action Alignment Verification

按言行事:通过运行时推理-动作对齐验证引导视觉-语言-动作模型

Yilin Wu, Anqi Li, Tucker Hermans, Fabio Ramos, Andrea Bajcsy, Claudia Pérez-D'Arpino

机构 * NVIDIA(NVIDIA公司) Carnegie Mellon University(卡内基梅隆大学) University of Utah(犹他大学) University of Sydney(悉尼大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 通过运行时推理-动作对齐验证方法提升视觉-语言-动作模型的鲁棒性和行为组合能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09652 2026-01-15 cs.CV 57%

AquaFeat+: an Underwater Vision Learning-based Enhancement Method for Object Detection, Classification, and Tracking

AquaFeat+: 一种基于水下视觉学习的增强方法,用于目标检测、分类和跟踪

Emanuel da Costa Silva, Tatiana Taís Schein, José David García Ramos, Eduardo Lawson da Silva, Stephanie Loi Brião, Felipe Gomes de Oliveira, Paulo Lilles Jorge Drews-Jr

机构 * Centro de Ciências Computacionais (C3), Universidade Federal do Rio Grande (FURG), Brazil(巴西里约格兰德联邦大学计算科学研究中心(C3)) Instituto de Ciências Exatas e Tecnologia (ICET), Universidade Federal do Amazonas (UFAM), Brazil(巴西亚马逊联邦大学精确科学与技术研究所(ICET))

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 AquaFeat+是一种基于水下视觉学习的增强方法,通过端到端训练提升目标检测、分类和跟踪的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09287 2026-01-15 cs.CR cs.LG eess.SP 57%

Explainable Autoencoder-Based Anomaly Detection in IEC 61850 GOOSE Networks

基于可解释自动编码器的IEC 61850 GOOSE网络异常检测

Dafne Lozano-Paredes, Luis Bote-Curiel, Juan Ramón Feijóo-Martínez, Ismael Gómez-Talal, José Luis Rojo-Álvarez

机构 * Universidad Rey Juan Carlos(雷奥恩卡洛斯大学) Red Eléctrica (REDEIA Group)(电力公司(REDEIA小组)) Centro de Investigación for Data, Complex Networks and Cybersecurity Sciences(数据、复杂网络和网络安全科学研究中心)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文提出一种基于可解释自动编码器的IEC 61850 GOOSE网络异常检测框架,通过多视图分析和特征重建实现高检测率与低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09265 2026-01-15 cs.CV 57%

GaussianFluent: Gaussian Simulation for Dynamic Scenes with Mixed Materials

GaussianFluent: 用于混合材料动态场景的高斯模拟

Bei Huang, Yixin Chen, Ruijie Lu, Gang Zeng, Hongbin Zha, Yuru Pei, Siyuan Huang

机构 * State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) State Key Laboratory of General Artificial Intelligence, BIGAI(北京大学通用人工智能国家重点实验室,BIGAI)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 GaussianFluent通过生成模型和优化的CD-MPM方法,实现了混合材料动态场景的高保真实时渲染和脆性断裂模拟。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09471 2026-01-15 math.OC 50%

A Canonical Internal Model for Disturbance Rejection for a Class of Nonlinear Systems Subject to Trigonometric-Polynomial Disturbances

一类受三角多项式扰动非线性系统的扰动抑制的规范内部模型

Changran He, Jie Huang

专题命中 机器人数据与评测 :robotic(abstract)

AI总结 本文提出了一种针对受三角多项式扰动非线性系统的规范内部模型,通过自适应观测器实现扰动抑制和轨迹跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他机器人 5 篇

2503.04038 2026-01-15 cs.RO cs.SY eess.SY 80%

Autonomous Robotic Bone Micro-Milling System with Automatic Calibration and 3D Surface Fitting

自主机器人骨微铣系统与自动校准及3D表面拟合

Enduo Zhao, Xiaofeng Lin, Yifan Wang, Kanako Harada

机构 * Department of Mechanical Engineering, Graduate School of Engineering, The University of Tokyo(东京大学工学研究生院机械工程系) School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院) Center for Disease Biology and Integrative Medicine, Graduate School of Medicine, The University of Tokyo(东京大学医学研究生院疾病生物学与整合医学中心)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO;robotics(journal_ref)

AI总结 本研究提出了一种自主机器人骨微铣系统,通过集成微立体相机和CNN关键点检测,实现自动校准和3D表面拟合,显著提升小鼠颅窗创建的自动化水平和精度。

Comments 8 pages, 8 figures, accepted by RA-L. Please refer to the DOI to access the accepted version

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 2, pp. 2250-2257 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09378 2026-01-15 cond-mat.mtrl-sci 78%

Batch-Fabricated PDMS Templates for the Robotic Transfer of 2D Materials

批量制备的PDMS模板用于二维材料的机器人转移

Zhili Lin, Luosha Han, Jinkun He, Xiaoxue Fan, Tongyao Zhang, Xiaoxi Li, Baojuan Dong, Kai Zhao

专题命中 其他机器人 :robotic(title,abstract)

AI总结 本文提出了一种批量制备PDMS模板的方法,用于二维材料的机器人干燥转移,通过可控参数实现高精度接触面积定义。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13087 2026-01-15 cs.RO cs.AI cs.LG 67%

IKDiffuser: a Diffusion-based Generative Inverse Kinematics Solver for Kinematic Trees

IKDiffuser: 一种基于扩散的生成逆运动学求解器用于运动链

Zeyu Zhang, Ziyuan Jiao

机构 * Zeyu Zhang, Ziyuan Jiao

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 IKDiffuser是一种基于扩散模型的逆运动学求解器,通过学习配置空间分布,实现高精度、多样化的逆运动学求解,并提升复杂冗余系统求解效率。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09406 2026-01-15 cs.CV cs.HC cs.LG cs.RO 67%

Human-in-the-Loop Segmentation of Multi-species Coral Imagery

人机协同的多物种珊瑚图像分割

Scarlett Raine, Ross Marchant, Brano Kusy, Frederic Maire, Niko Suenderhauf, Tobias Fischer

机构 * QUT Centre for Robotics(QUT机器人中心) Image Analytics(图像分析) CSIRO Data61(CSIRO数据61)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 本文提出利用DINOv2特征和KNN实现高效珊瑚图像分割,仅用5个点标签即可在mIoU上提升13.5%。

Comments IEEE Journal of Oceanic Engineering accepted preprint of extended paper, 36 pages, 14 figures. Original conference paper (v2) accepted at the CVPR 2024 3rd Workshop on Learning with Limited Labelled Data for Image and Video Understanding (L3D-IVU)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09697 2026-01-15 cs.CV 57%

Efficient Camera-Controlled Video Generation of Static Scenes via Sparse Diffusion and 3D Rendering

通过稀疏扩散和3D渲染实现静态场景的高效摄像机控制视频生成

Jieying Chen, Jeffrey Hu, Joan Lasenby, Ayush Tewari

机构 * University of Cambridge(剑桥大学)

专题命中 其他机器人 :embodied AI(abstract);分类 cs.CV

AI总结 本文提出SRENDER方法,通过稀疏扩散和3D渲染生成静态场景的高效视频,使视频生成速度提升40倍,保持高质量和稳定性。

Comments Project page: https://ayushtewari.com/projects/srender/

详情

展开后加载摘要…

URL PDF HTML 收藏