arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-05 至 2026-01-05 共收录 38 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 9 篇

2504.19571 2026-01-05 cs.RO 79%

Video-Based Detection and Analysis of Errors in Robotic Surgical Training

基于视频的机器人手术培训中错误检测与分析

Hanna Kossowsky Lev, Yarden Sharon, Alex Geftler, Ilana Nisky

机构 * Ben-Gurion University of the Negev(本·古里安大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本研究通过视频分析检测机器人手术培训中的错误,采用图像处理算法实现约95%的检测准确率,揭示了住培医生在六个月内技能提升的过程。

Comments Title change; 9 pages, 4 figures, 1 table. Alex Geftler and Ilana Nisky contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00562 2026-01-05 cs.CV 57%

A Cascaded Information Interaction Network for Precise Image Segmentation

用于精确图像分割的级联信息交互网络

Hewen Xiao, Jie Mei, Guangfu Ma, Weiren Wu

机构 * The Institute of Space Science and Applied Technology(空间科学与应用技术研究所) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文提出一种级联信息交互网络,通过融合低级纹理与高级语义特征提升图像分割精度,尤其在复杂环境中的表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00421 2026-01-05 cs.AI 57%

Can Semantic Methods Enhance Team Sports Tactics? A Methodology for Football with Broader Applications

语义方法能否提升团队体育战术?一种适用于足球的通用方法

Alessio Di Rubbo, Mattia Neri, Remo Pareschi, Marco Pedroni, Roberto Valtancoli, Paolino Zica

机构 * Stake Lab, University of Molise, Italy(斯泰克实验室,莫利塞大学,意大利) Bioretics, Bologna, Italy(生物反应公司,博洛尼亚,意大利) Institute for Generative Strategy, Ferrara, Italy(生成战略研究所,费拉拉,意大利) Cesena Femminile Football Club, Cesena, Italy(塞斯纳女子足球俱乐部,塞斯纳,意大利) Zica Sport, Benevento, Italy(齐卡体育,贝内文托,意大利)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 本文提出了一种基于语义空间推理的团队体育战术决策方法,通过多维向量表示球员属性并评估战术契合度,为足球及其他团队领域提供通用决策框架。

Comments Submitted to Sci (MDPI) for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00352 2026-01-05 cs.CV 57%

OmniVaT: Single Domain Generalization for Multimodal Visual-Tactile Learning

OmniVaT:单域泛化用于多模态视觉-触觉学习

Liuxiang Qiu, Hui Da, Yuzhen Niu, Tiesong Zhao, Yang Cao, Zheng-Jun Zha

机构 * Fujian Key Laboratory for Intelligent Processing and Wireless Transmission of Media Information(福建智能媒体信息处理与无线传输重点实验室) College of Physics and Information Engineering(物理与信息工程学院) Fuzhou University(福州市大学) College of Computer and Data Science(计算机与数据科学学院) MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition(MoE脑启发智能感知与认知重点实验室) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 OmniVaT通过多模态分数傅里叶适配器和离散树生成模块,首次实现单域泛化多模态视觉-触觉学习任务,提升跨领域适应性与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00303 2026-01-05 cs.CL cs.AI 57%

DepFlow: Disentangled Speech Generation to Mitigate Semantic Bias in Depression Detection

DepFlow:解耦语音生成以缓解抑郁检测中的语义偏差

Yuxin Li, Xiangyu Zhang, Yifei Li, Zhiwei Guo, Haoyang Zhang, Eng Siong Chng, Cuntai Guan

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) School of Electrical Engineering and Telecommunications, UNSW(新南威尔士大学电信工程学院) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) Center for AI in Medicine (C-AIM), Lee Kong Chian School of Medicine, NTU(人工智能医学中心(C-AIM)、李光耀医学院、南洋理工大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 DepFlow通过三阶段框架解耦语音生成,缓解抑郁症检测中的语义偏差,提升模型鲁棒性并提供可控合成平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23400 2026-01-05 cs.SI cs.LG 57%

Quantum Intelligence Meets BD-RIS-Enabled AmBC: Challenges, Opportunities, and Practical Insights

量子智能遇见BD-RIS赋能的AmBC:挑战、机遇与实用洞察

Abd Ullah Khan, Uman Khalid, Trung Q. Duong, Hyundong Shin

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 本文探讨了BD-RIS在AmBC中的应用,分析了其挑战与机遇,并通过量子增强的机器学习模型提升波束成形性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07955 2026-01-05 cs.RO 57%

PLK-Calib: Single-shot and Target-less LiDAR-Camera Extrinsic Calibration using Plücker Lines

PLK-Calib: 基于普吕弗线的单次拍摄无目标激光雷达-摄像头外参校准

Yanyu Zhang, Jie Xu, Wei Ren

机构 * Department of Electrical and Computer Engineering, University of California, Riverside(电气与计算机工程系,加州大学河滨分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出基于普吕弗线的单次拍摄无目标算法,用于高精度激光雷达-摄像头外参校准,通过几何特性分解旋转和平移,提升校准精度。

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 16091-16097, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他机器人 1 篇

2512.18159 2026-01-05 cs.CV 57%

EndoStreamDepth: Temporally Consistent Monocular Depth Estimation for Endoscopic Video Streams

EndoStreamDepth:用于内窥镜视频流的时序一致单目深度估计

Hao Li, Daiwei Lu, Jiacheng Wang, Robert J. Webster, Ipek Oguz

机构 * Vanderbilt University(范德比大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.CV

AI总结 EndoStreamDepth通过时间模块和多尺度监督提升内窥镜视频流中单目深度估计的准确性和一致性。

Comments fixed typo in appendix table 3

详情

展开后加载摘要…

URL PDF HTML 收藏