arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 6095 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 其他机器人 6095 篇

2601.18222 2026-01-27 cs.CV 57%

HomoFM: Deep Homography Estimation with Flow Matching

HomoFM:基于流匹配的深度视角估计

Mengfan He, Liangzheng Sun, Chunyu Li, Ziyang Meng

机构 * Department of Precision Instrument, Tsinghua University(清华大学精密仪器系) School of Instrument Science and Opto-Electronics Engineering, Beijing Information Science and Technology University(北京信息科技大学仪器科学与光电工程学院) School of Aerospace Engineering, Beijing Institute of Technology(北京理工大学航空航天工程学院)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 HomoFM通过引入流匹配技术,首次将生成建模中的速度场学习应用于视角估计,提升估计精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15871 2026-01-27 cs.CV cs.MM 57%

Zero-Shot Visual Grounding in 3D Gaussians via View Retrieval

通过视图检索实现3D高斯体的零样本视觉定位

Liwei Liao, Xufeng Li, Xiaoyun Zheng, Boning Liu, Feng Gao, Ronggang Wang

机构 * Peking University(北京大学) Peng Cheng Laboratory(鹏城实验室) City University of Hongkong(香港城市大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 本文提出GVR框架,通过视图检索将3DVG转化为2D检索任务,实现零样本3DGS的视觉定位,无需每场景训练和3D标注。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15222 2026-01-22 cs.RO 57%

MonoRace: Winning Champion-Level Drone Racing with Robust Monocular AI

MonoRace: 通过鲁棒的单目AI赢得冠军级别的无人机竞速

Stavrow A. Bahnam, Robin Ferede, Till M. Blaha, Anton E. Lang, Erin Lucassen, Quentin Missinne, Aderik E. C. Verraest, Christophe De Wagter, Guido C. H. E. de Croon

机构 * Control & Operation, Delft University of Technology(控制与操作,代尔夫特理工大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 MonoRace通过单目AI和鲁棒状态估计,在无外部跟踪系统下实现冠军级无人机竞速,以500Hz运行神经网络,超越所有AI和人类冠军。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13777 2026-01-21 cs.RO 57%

Sample Efficient Learning of Body-Environment Interaction of an Under-Actuated System

欠驱动系统身体-环境交互的样本高效学习

Zvi Chapnik, Yizhar Or, Shai Revzen

机构 * Mechanical Engineering, Technion, Haifa, Israel(技术学院机械工程系,海法,以色列) Electrical Engineering and Computer Science, Ecology and Evolutionary Biology, University of Michigan, Ann Arbor, MI USA(密歇根大学电气工程与计算机科学系、生态与进化生物学系,安娜堡,密歇根州,美国)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文研究了欠驱动系统身体-环境交互的样本高效学习方法,比较了四种建模方法在不同训练数据量下的表现,发现简单方法在小数据集上更优,复杂方法在大数据集上更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01346 2026-01-21 cs.RO physics.bio-ph 57%

Thermo-responsive closing and reopening artificial Venus Flytrap utilizing shape memory elastomers

温度响应式闭合与开启人工维多利亚捕蝇草利用形状记忆弹性体

Shun Yoshida, Qingchuan Song, Bastian E. Rapp, Thomas Speck, Falk J. Tauber

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本研究提出了一种能自主闭合和开启的人工维多利亚捕蝇草,利用温度响应性形状记忆材料实现自主双向运动。

Comments Conference Proceedings Paper Living Machines 2025

Journal ref Biomimetic and Biohybrid Systems. Living Machines 2025. Lecture Notes in Computer Science, LNAI,vol.15582, (2025), 3-15

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11543 2026-01-21 cs.HC cs.RO 57%

Affective Translation: Material and Virtual Embodiments of Kinetic Textile Robots

情感翻译:动能纺织机器人材料与虚拟具身

Berfin Ataman, Rodrigo Gallardo, Qilmeg Doudatcz

机构 * SMArchS Computation, MS Mechanical Engineering(SMArchS计算系,机械工程硕士) SMArchS Computation, EECS(SMArchS计算系,电子工程与计算机科学系) EECS(电子工程与计算机科学系)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本研究通过对比实体与虚拟动能纺织机器人,探讨情感参与和感知反应的差异,旨在设计能引发有意义人机交互的混合系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09178 2026-01-19 cs.RO 57%

Vision-Conditioned Variational Bayesian Last Layer Dynamics Models

基于视觉的变分贝叶斯最后一层动力学模型

Paul Brunzema, Thomas Lew, Ray Zhang, Takeru Shirasawa, John Subosits, Marcus Greiff

机构 * department of Mechanical Engineering, Aachen University(机械工程系,亚琛大学) Toyota Research Institute(丰田研究院)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种基于视觉的变分贝叶斯最后一层动力学模型,通过视觉上下文预测环境变化,提升赛车在动态条件下的控制性能。

Comments 9 pages, 7 figures, currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17702 2026-01-16 cs.CV 57%

Depth Edge Alignment Loss: DEALing with Depth in Weakly Supervised Semantic Segmentation

深度边缘对齐损失:在弱监督语义分割中处理深度

Patrick Schmidt, Vasileios Belagiannis, Lazaros Nalpantidis

机构 * DTU - Technical University of Denmark(丹麦技术大学) Friedrich-Alexander-Universität Erlangen-Nürnberg(埃朗根-纽伦堡弗里德里希-亚历山大大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.CV

AI总结 提出深度边缘对齐损失以提升弱监督语义分割性能,通过像素级深度信息增强模型表现。

Comments Submitted to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09697 2026-01-15 cs.CV 57%

Efficient Camera-Controlled Video Generation of Static Scenes via Sparse Diffusion and 3D Rendering

通过稀疏扩散和3D渲染实现静态场景的高效摄像机控制视频生成

Jieying Chen, Jeffrey Hu, Joan Lasenby, Ayush Tewari

机构 * University of Cambridge(剑桥大学)

专题命中 其他机器人 :embodied AI(abstract);分类 cs.CV

AI总结 本文提出SRENDER方法,通过稀疏扩散和3D渲染生成静态场景的高效视频,使视频生成速度提升40倍,保持高质量和稳定性。

Comments Project page: https://ayushtewari.com/projects/srender/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24616 2026-01-14 cs.AI cs.FL cs.LO 57%

LTL$_f$ Learning Meets Boolean Set Cover

LTLf学习与布尔集合覆盖

Gabriel Bathie, Nathanaël Fijalkow, Théo Matricon, Baptiste Mouillon, Pierre Vandenhove

机构 * LaBRI, Université de Bordeaux, France(拉伯里实验室,波尔多大学,法国) DIENS, Paris, France(巴黎迪恩斯研究所,法国) LaBRI, CNRS, Université de Bordeaux, France(拉伯里实验室,法国国家科学研究中心,波尔多大学,法国) Univ Rennes, CNRS, Inria, IRISA, Rennes, France(里昂大学,法国国家科学研究中心,法国国家信息与自动化研究所,IRISA,法国) UMONS – Université de Mons, Belgium(蒙斯大学,比利时)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI

AI总结 本文提出了一种基于布尔集合覆盖的高效方法,用于从有限轨迹中加速学习LTLf公式,显著提升了学习速度和公式规模控制。

Comments Full version of TACAS 2026 conference paper. 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15235 2026-01-14 cs.CV 57%

Learning-based Multi-View Stereo: A Survey

基于学习的多视图立体:综述

Fangjinhua Wang, Qingtian Zhu, Di Chang, Quankai Gao, Junlin Han, Tong Zhang, Richard Hartley, Marc Pollefeys

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) Graduate School of Information Science and Technology, The University of Tokyo(东京大学信息科学与技术研究生院) Department of Computer Science, University of Southern California(南加州大学计算机科学系) Department of Engineering Science, University of Oxford(牛津大学工程科学系) University of Chinese Academy of Sciences(中国科学院大学) School of Computer and Communication Sciences, EPFL(苏黎世联邦理工学院计算机与通信科学学院) Australian National University(澳大利亚国立大学) Microsoft, Zurich(微软(瑞士))

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 本文综述了基于学习的多视图立体方法,重点介绍了基于深度图的方法,并讨论了该领域未来的研究方向。

Comments Accepted to IEEE T-PAMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05246 2026-01-09 cs.CV 57%

Pixel-Perfect Visual Geometry Estimation

像素级视觉几何估计

Gangwei Xu, Haotong Lin, Hongcheng Luo, Haiyang Sun, Bing Wang, Guang Chen, Sida Peng, Hangjun Ye, Xin Yang

机构 * School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Xiaomi EV(小米电动车)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 本文提出像素级视觉几何模型,通过生成建模技术实现高质量无飞像素点云,提升单目和视频深度估计的性能和准确性。

Comments Code: https://github.com/gangweix/pixel-perfect-depth

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04795 2026-01-09 cs.AI cs.CL cs.CR cs.MA 57%

Defense Against Indirect Prompt Injection via Tool Result Parsing

通过工具结果解析防御间接提示注入

Qiang Yu, Xinran Cheng, Chuanyi Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI

AI总结 本文提出通过工具结果解析来防御间接提示注入,有效过滤恶意代码并降低攻击成功率。

Comments 20 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15119 2026-01-09 eess.SY cs.RO cs.SY math.DS math.OC 57%

Nonholonomic Robot Parking by Feedback -- Part I: Modular Strict CLF Designs

非holonomic机器人泊车的反馈方法——第一部分:模块化严格CLF设计

Velimir Todorovski, Kwang Hak Kim, Alessandro Astolfi, Miroslav Krstic

机构 * Department of Mechanical and Aerospace Engineering, UC San Diego(加州大学圣地亚哥分校机械与航空航天工程系) Imperial College London(伦敦帝国学院) University of Rome Tor Vergata(罗马托维加塔大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种模块化设计框架,通过解耦径向坐标实现非holonomic单轮车的渐近稳定,结合被动性、逆向设计和积分前馈开发反馈律,并提供严格CLFs以实现特征值分配和收敛估计。

Comments arXiv admin note: text overlap with arXiv:2509.25575

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03907 2026-01-08 cs.RO 57%

An Event-Based Opto-Tactile Skin

基于事件的光触觉皮肤

Mohammadreza Koolani, Simeon Bamford, Petr Trunin, Simon F. Müller-Cleve, Matteo Lo Preti, Fulvio Mastrogiovanni, Lucia Beccai, Chiara Bartolozzi

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种基于事件的光触觉皮肤传感系统,通过动态视觉传感器和柔性硅光学波导结合,实现大范围柔性触觉感知,具有低功耗和高响应的特点。

Comments Accepted for publication in Frontiers in Neuromorphic Engineering. 23 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03807 2026-01-08 cs.RO 57%

Generational Replacement and Learning for High-Performing and Diverse Populations in Evolvable Robots

代际替换与学习在可进化机器人中高表现和多样化种群中的应用

K. Ege de Bruin, Kyrre Glette, Kai Olav Ellefsen

机构 * Department of Informatics University of Oslo(信息学院奥斯陆大学) RITMO, Department of Informatics University of Oslo(RITMO信息学院奥斯陆大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本研究通过结合代际替换与intra-life学习,在可进化机器人中提升多样性的同时保持性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13961 2026-01-07 cs.RO 57%

FICO: Finite-Horizon Closed-Loop Factorization for Unified Multi-Agent Path Finding

FICO:有限时间闭环因子分解用于统一多智能体路径寻找

Jiarui Li, Alessandro Zanardi, Federico Pecora, Runyu Zhang, Gioele Zardini

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 FICO通过系统级建模和闭环设计,实现了多智能体路径寻找问题的高效解决,显著提升了计算效率和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08219 2026-01-07 cs.CV 57%

SAGOnline: Segment Any Gaussians Online

SAGOnline: 在线分割任意高斯

Wentao Sun, Quanyun Wu, Hanqing Xu, Kyle Gao, Zhengsen Xu, Yiping Chen, Dedong Zhang, Lingfei Ma, John S. Zelek, Jonathan Li

机构 * University of Waterloo(滑铁卢大学) East China Normal University(东华大学) University of Calgary(卡尔加里大学) Sun Yat-Sen University(中山大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 SAGOnline提出一种实时、零样本的3D分割框架,通过光栅化感知的几何共识机制实现跨视角一致的分割,提升AR/VR和机器人中的交互式3D理解能力。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02102 2026-01-06 cs.CV 57%

360-GeoGS: Geometrically Consistent Feed-Forward 3D Gaussian Splatting Reconstruction for 360 Images

360-GeoGS:用于360图像的几何一致前馈3D高斯点溅重建

Jiaqi Yao, Zhongmiao Yan, Jingyi Xu, Songpengcheng Xia, Yan Xiang, Ling Pei

机构 * Shanghai Key Laboratory of Navigation and Location Based Services(上海导航与基于位置的服务关键实验室) Shanghai Jiao Tong University(上海交通大学) State Key Laboratory of Submarine Geoscience(海底地球科学国家重点实验室) School of Automation and Intelligent Sensing(自动化与智能感知学院)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 本文提出了一种用于360图像的前馈3DGS框架,通过深度-法线几何正则化提升几何一致性,实现高质量的3D重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18159 2026-01-05 cs.CV 57%

EndoStreamDepth: Temporally Consistent Monocular Depth Estimation for Endoscopic Video Streams

EndoStreamDepth:用于内窥镜视频流的时序一致单目深度估计

Hao Li, Daiwei Lu, Jiacheng Wang, Robert J. Webster, Ipek Oguz

机构 * Vanderbilt University(范德比大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.CV

AI总结 EndoStreamDepth通过时间模块和多尺度监督提升内窥镜视频流中单目深度估计的准确性和一致性。

Comments fixed typo in appendix table 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24243 2026-01-01 cs.CV 57%

MambaSeg: Harnessing Mamba for Accurate and Efficient Image-Event Semantic Segmentation

MambaSeg: 利用Mamba实现准确且高效的图像事件语义分割

Fuqiang Gu, Yuanke Li, Xianlei Long, Kangping Ji, Chao Chen, Qingyi Gu, Zhenliang Ni

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 MambaSeg通过双分支框架和双维交互模块,实现高效准确的多模态语义分割,适用于快速运动和低光条件下的图像事件分割任务。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23140 2026-01-01 cs.RO 57%

A New Software Tool for Generating and Visualizing Robot Self-Collision Matrices

一种生成和可视化机器人自碰撞矩阵的新软件工具

Roshan Klein-Seetharama, Daniel Rakita

机构 * Roshan Klein-Seetharaman and Daniel Rakita(独立研究者)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种交互式工具,用于生成和可视化自碰撞矩阵,支持多种形状表示,提升机器人自碰撞检测的效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22688 2025-12-30 cs.CV 57%

Autoregressive Flow Matching for Motion Prediction

自回归流匹配用于运动预测

Johnathan Xie, Stefan Stojanov, Cristobal Eyzaguirre, Daniel L. K. Yamins, Jiajun Wu

机构 * Stanford University(斯坦福大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 ARFM通过自回归流匹配方法,利用多样化视频数据集预测复杂运动,提升机器人和人类动作预测的下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21573 2025-12-29 cs.RO 57%

World-Coordinate Human Motion Retargeting via SAM 3D Body

通过SAM 3D Body进行世界坐标人体动作重定向

Zhangzheng Tu, Kailun Su, Shaolong Zhu, Yukun Zheng

机构 * Dalian University of Technology(大连理工大学) Shenzhen University(深圳大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出通过SAM 3D Body进行世界坐标人体动作重定向,利用轻量级物理约束实现机器人可用动作生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21219 2025-12-25 cs.RO cs.SY eess.SY 57%

Wireless Center of Pressure Feedback System for Humanoid Robot Balance Control using ESP32-C3

基于ESP32-C3的无线足部压力反馈系统用于人形机器人平衡控制

Muhtadin, Faris Rafi Pramana, Dion Hayu Fandiantoro, Moh Ismarintan Zazuli, Atar Fuady Babgei

机构 * Department of Computer Engineering, Institut Teknologi Sepuluh Nopember, Surabaya, Indonesia(印度尼西亚十月份十日理工大学计算机工程系) Graduate School of Science and Technology, Kumamoto University, Japan(日本熊本大学研究生院) The Science and Technology Center of Artificial Intelligence for Healthcare and Society (PUI AIHeS), Indonesia(印度尼西亚人工智能医疗与社会科技中心) Department of Electrical Automation Engineering, Institut Teknologi Sepuluh Nopember, Surabaya, Indonesia(印度尼西亚十月份十日理工大学电气自动化工程系) Department of Computing, Imperial College London, United Kingdom(英国伦敦帝国学院计算系)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本研究提出了一种基于ESP32-C3的无线足部压力反馈系统,通过实时估计压力中心提升人形机器人在不平表面的平衡稳定性,实验表明其具有高精度和100%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20888 2025-12-25 cs.RO 57%

Stretchable and High-Precision Optical Tactile Sensor for Trajectory Tracking of Parallel Mechanisms

可拉伸且高精度的光学触觉传感器用于平行机构轨迹跟踪

Yiding Nie, Dongliang Fan, Jiatai Huang, Chunyu Liu, Jian S. Dai

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出了一种可拉伸触觉传感器,用于实现高精度轨迹跟踪,具有高空间和力分辨率及良好的鲁棒性。

Comments Accepted by 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20342 2025-12-24 physics.ins-det cs.RO 57%

Design and Modeling of a Simple-Structured Continuously Variable Transmission Utilizing Shape Memory Alloy Superelasticity for Twisted String Actuator

连续变量变速器的设计与建模:利用形状记忆合金超弹性用于扭曲字符串执行器

Chanchan Xu, Shuai Dong, Xiaojie Wang

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出利用形状记忆合金超弹性设计的轻量连续变量变速器,用于提升扭曲字符串执行器在变化负载下的效率和传动比调节能力。

Comments 15pages,Fig14

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19084 2025-12-23 cs.AI 57%

$γ(3,4)$ `Attention' in Cognitive Agents: Ontology-Free Knowledge Representations With Promise Theoretic Semantics

$γ(3,4)$ 注意力在认知代理中的应用:基于承诺理论语义的知识表示

Mark Burgess

机构 * Oslo University College Chitek-i AS(奥斯陆大学学院奇特克-艾公司)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI

AI总结 本文提出基于承诺理论语义的$γ(3,4)$图表示方法,通过特征角色分类替代复杂本体,提升不确定性条件下的推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19058 2025-12-23 cs.CV 57%

6DAttack: Backdoor Attacks in the 6DoF Pose Estimation

6DAttack: 6DoF位姿估计中的后门攻击

Jihui Guo, Zongmin Zhang, Zhen Sun, Yuhao Yang, Jinlin Wu, Fu Zhang, Xinlei He

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 6DAttack提出了一种针对6DoF位姿估计的后门攻击框架,通过3D物体触发器诱导可控错误位姿,验证了其在多个数据集上的高攻击成功率及对现有防御的无效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18429 2025-12-23 cs.CV eess.IV 57%

E-RGB-D: Real-Time Event-Based Perception with Structured Light

E-RGB-D:基于事件的实时感知与结构光

Seyed Ehsan Marjani Bajestani, Giovanni Beltrame

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 E-RGB-D通过结合结构光和事件相机技术,实现高帧率颜色和深度感知,推动计算机视觉在多个领域的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏