arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-05 至 2026-01-05 共收录 38 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 9 篇

2509.14984 2026-01-05 cs.RO cs.AI cs.LG cs.SY eess.SY 85%

The Role of Touch: Towards Optimal Tactile Sensing Distribution in Anthropomorphic Hands for Dexterous In-Hand Manipulation

触觉的作用:在拟人手部中实现灵巧在手操作的触觉传感分布优化

João Damião Almeida, Egidio Falotico, Cecilia Laschi, José Santos-Victor

机构 * VisLab, Institute for Systems Soft Robotics Lab National University of Singapore, Singapore BRAIR Lab, BioRobotics Institute Scuola Superiore Sant'Anna, Pisa, Italia

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文研究了在拟人手部中触觉传感分布对在手操作任务的影响,通过分析不同区域的触觉反馈对深度强化学习控制策略的影响,提出了优化触觉传感配置以提高操作效率和准确性的方法。

Journal ref Proc. IEEE Int. Conf. on Networking, Sensing and Control (ICNSC), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12176 2026-01-05 cs.LG 79%

From Autoencoders to CycleGAN: Robust Unpaired Face Manipulation via Adversarial Learning

从自编码器到CycleGAN:通过对抗学习实现鲁棒的无配对人脸操控

Collin Guo, Yi Qian

机构 * College of Information University of Maryland - College Park(信息学院 乌尔里希大学-科尔切斯特分校) Department of Computer Science The University of Tulsa(计算机科学系 陶斯大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.LG

AI总结 本文提出一种基于对抗学习的改进CycleGAN框架,通过频谱归一化和引导损失提升无配对人脸操控的现实感和身份保持能力,优于自编码器并接近pix2pix效果。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00577 2026-01-05 cs.LG 57%

Adversarial Samples Are Not Created Equal

对抗样本并非皆相同

Jennifer Crawford, Amol Khanna, Fred Lu, Amy R. Wagoner, Stella Biderman, Andre T. Nguyen, Edward Raff

机构 * Scale AI CrowdStrike EleutherAI

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 本文提出对抗样本分为两种类型,通过集成度量方法分析其构成,重新审视对抗鲁棒性相关现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00542 2026-01-05 cs.CV 57%

DynaDrag: Dynamic Drag-Style Image Editing by Motion Prediction

DynaDrag: 通过运动预测实现动态拖拽式图像编辑

Jiacheng Sui, Yujie Zhou, Li Niu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 DynaDrag通过运动预测和动态调整手柄点,实现了更高效的拖拽式图像编辑方法,优于现有技术。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14960 2026-01-05 cs.CV 57%

Body-Hand Modality Expertized Networks with Cross-attention for Fine-grained Skeleton Action Recognition

具有交叉注意力的体-手模态专家化网络用于细粒度骨骼动作识别

Seungyeon Cho, Tae-Kyun Kim

机构 * School of Computing, KAIST(韩国成均馆大学计算机学院)

专题命中 机器人操作 :robotics(abstract);分类 cs.CV

AI总结 本文提出BHaRNet,通过体-手专家化网络和交叉注意力机制,提升细粒度骨骼动作识别的准确率,同时降低计算成本。

Comments 7 figures, 8 pages. Accepted to IROS 2025, project page: https://github.com/VinnyCSY/BHaRNet

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Hangzhou, China, 2025, pp. 11614-11621

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00043 2026-01-05 physics.flu-dyn 50%

Finite-Inertia Corrections and Breakdown of Gor'kov Theory in Acoustic Levitation of Droplets

有限惯性修正与声学滴悬浮中Gor'kov理论的失效

Hollis Williams

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文推导了Gor'kov理论的有限惯性修正,揭示了声学悬浮中时间平均辐射力模型的失效条件,并提供了实验可测量的判据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24110 2026-01-05 cs.IT math.IT 50%

When Wires Can't Keep Up: Reconfigurable AI Data Centers Empowered by Terahertz Wireless Communications

当电缆无法跟上:由太赫兹无线通信赋能的可重构AI数据中心

Chong Han, Mingjie Zhu, Wenqi Zhao, Ziming Yu, Guolong Huang, Guangjian Wang, Wen Tong, Wenjun Zhang

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出利用太赫兹无线通信构建可重构AI数据中心,通过超宽带容量、低延迟和高能效,解决传统有线互连在AI数据中心中的瓶颈问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01963 2026-01-05 q-fin.TR cs.CY q-fin.ST 50%

A Midsummer Meme's Dream: Investigating Market Manipulations in the Meme Coin Ecosystem

仲夏幻想的梦:探究迷因币生态中的市场操纵

Alberto Maria Mongardini, Alessandro Mei

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过跨链分析揭示迷因币生态中高回报代币的操纵现象,发现82.8%的高回报代币存在人为制造市场兴趣的策略,如洗盘和流动性池价格通胀,导致大量投资者损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14306 2026-01-05 physics.optics cond-mat.other 50%

Twisted nonlinear optics in monolayer van der Waals crystals

单层范德华晶体中的扭曲非线性光学

Tenzin Norden, Luis M. Martinez, Nehan Tarefder, Kevin W. C. Kwock, Luke M. McClintock, Nicholas Olsen, Luke N. Holtzman, Xiaoyang Zhu, James C. Hone, Jinkyoung Yoo, Jian-Xin Zhu, P. James Schuck, Antoinette J. Taylor, Rohit P. Prasankumar, Wilton J. M. Kort-Kamp, Prashant Padmanabhan

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过单层范德华晶体中的二次和三次频率混合过程,实现了对涡旋光场波长、轨道角动量和空间分布的独立操控,展示了超紧凑且可扩展的混合纳米技术新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 12 篇

2601.00555 2026-01-05 cs.RO 86%

LLM-Based Agentic Exploration for Robot Navigation & Manipulation with Skill Orchestration

基于大语言模型的代理探索用于机器人导航与操作的技能编排

Abu Hanif Muhammad Syarubany, Farhan Zaki Rahmani, Trio Widianto

专题命中 具身导航 :navigation(title,abstract);manipulation(title);分类 cs.RO

AI总结 本文提出基于大语言模型的代理探索系统,用于机器人导航与操作,通过技能编排实现端到端任务执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00116 2026-01-05 cs.LG cs.RO 81%

GRL-SNAM: Geometric Reinforcement Learning with Path Differential Hamiltonians for Simultaneous Navigation and Mapping in Unknown Environments

GRL-SNAM:基于路径微分哈密顿量的几何强化学习用于未知环境中的同时导航与建图

Aditya Sai Ellendula, Yi Wang, Minh Nguyen, Chandrajit Bajaj

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 GRL-SNAM通过局部能量优化实现未知环境中的同时导航与建图,利用受控哈密顿优化提升导航质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05022 2026-01-05 cs.RO 80%

Dynamic Gap: Safe Gap-based Navigation in Dynamic Environments

动态间隙:动态环境中的安全间隙导航

Max Asselmeier, Dhruv Ahuja, Abdel Zaro, Ahmad Abuaish, Ye Zhao, Patricio A. Vela

机构 * Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机器研究所,佐治亚理工学院) School of Electrical and Computer Engineering, Georgia Institute of Technology(电气与计算机工程学院,佐治亚理工学院) Department of Mechanical Engineering, University of California, Berkeley(机械工程系,加州大学伯克利分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出动态间隙规划器,通过生成可证明的无碰撞属性,提升动态环境中基于间隙的导航安全性与效率。

Comments Accepted to 2025 International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03958 2026-01-05 cs.RO 79%

MDE-AgriVLN: Agricultural Vision-and-Language Navigation with Monocular Depth Estimation

MDE-AgriVLN: 农业视觉与语言导航与单目深度估计

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 MDE-AgriVLN通过单目深度估计提升农业机器人视觉与语言导航性能,提高成功率并降低导航误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00001 2026-01-05 cs.HC 78%

Augmented Reality Indoor Wayfinding in Hospital Environments An Empirical Study on Navigation Efficiency, User Experience, and Cognitive Load

增强现实室内寻路在医院环境中的应用:导航效率、用户体验和认知负荷的实证研究

Kai Liu, Michelle L. Aebersold, Mark Lindquist, Haoting Gao

专题命中 具身导航 :navigation(title,abstract)

AI总结 本研究通过实证分析比较了增强现实导航系统与传统纸质地图在医院环境中的导航效率、用户体验和认知负荷,发现AR在实时导航性能上更优,但纸质地图在长期空间记忆方面表现更佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00163 2026-01-05 cs.RO 70%

SLEI3D: Simultaneous Exploration and Inspection via Heterogeneous Fleets under Limited Communication

SLEI3D: 基于异构舰队的同步探索与勘察及有限通信下的实时通信

Junfeng Chen, Yuxiao Zhu, Xintong Zhang, Bing Luo, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Division of Natural and Applied Sciences, Duke Kunshan University(杜克昆山大学自然科学与应用科学系)

专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 SLEI3D通过异构舰队实现同步探索与勘察,并在有限通信条件下进行实时通信。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17117 2026-01-05 cond-mat.soft 67%

Digitization Can Stall Swarm Transport: Commensurability Locking in Quantized-Sensing Chains

数字化可能阻碍群体运输:量化感知链中的公约数锁定

Caroline N. Cappetto, Penelope Messinger, Kaitlyn S. Yasumura, Miro Rothman, Tuan K. Do, Gao Wang, Liyu Liu, Robert H. Austin, Shengkai Li, Trung V. Phan

专题命中 具身导航 :robotics(abstract);robotic(abstract)

AI总结 研究发现机器人群体在均匀梯度下因传感器分离与间距比例满足数论条件而出现集体运输停滞现象,揭示了数论与群体机器人运输之间的联系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00359 2026-01-05 cs.CV cs.RO 62%

Efficient Prediction of Dense Visual Embeddings via Distillation and RGB-D Transformers

通过蒸馏和RGB-D变换器高效预测密集视觉嵌入

Söhnke Benedikt Fischedick, Daniel Seichter, Benedict Stephan, Robin Schmidt, Horst-Michael Gross

机构 * Neuroinformatics and Cognitive Robotics Lab(神经信息学与认知机器人实验室) Technische Universität Ilmenau(技术大学伊门豪森)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 本文提出DVEFormer,通过知识蒸馏和RGB-D变换器高效预测密集视觉嵌入,实现灵活的文本查询和3D地图构建。

Comments Published in Proc. IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025)

Journal ref Proc. IEEE/RSJ Int. Conf. on Intelligent Robots and Systems (IROS), 2025, pp. 2400-2407

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05242 2026-01-05 cs.CV cs.RO 62%

Efficient Multi-Task Scene Analysis with RGB-D Transformers

高效的多任务场景分析与RGB-D变换器

Söhnke Benedikt Fischedick, Daniel Seichter, Robin Schmidt, Leonard Rabes, Horst-Michael Gross

机构 * Ilmenau University of Technology, Neuroinformatics(伊门瑙技术大学,神经信息学) Cognitive Robotics Lab(认知机器人实验室)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出EMSAFormer,一种基于RGB-D变换器的高效多任务场景分析方法,通过单编码器整合RGB和深度数据,实现全景分割、实例方向估计和场景分类,达到最先进的性能并支持高速推理。

Comments Published in Proc. International Joint Conference on Neural Networks (IJCNN 2023)

Journal ref Published in Proc. International Joint Conference on Neural Networks (IJCNN 2023), pp. 1-10

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00271 2026-01-05 cs.RO cs.NE 57%

Vehicle Painting Robot Path Planning Using Hierarchical Optimization

使用分层优化的车辆喷漆机器人路径规划

Yuya Nagai, Hiromitsu Nakamura, Narito Shinmachi, Yuta Higashizono, Satoshi Ono

机构 * Department of Information Science Biomedical Engineering, Graduate School of Science Engineering, Kagoshima University 1-21-40, Korimoto, Kagoshima, 890-0065 Japan TOYOTA Body Research \& Development Co., Ltd, 395-1, Uenodan, Kokubu, Kirishima, 899-4461 Japan

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种分层优化方法,用于自动设计车辆喷漆机器人路径,以减少人工设计时间和提高效率。

Journal ref IEEE Access, vol. 13, pp. 56682-56698, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00592 2026-01-05 cs.HC 50%

Evaluating Web Accessibility and Usability in Bangladesh: A Comparative Analysis of Government and Non-Government Websites

评估孟加拉国网页的可访问性与可用性:政府与非政府网站的比较分析

Sanjida Islam Era, Ishika Tarin Ime, A. B. M. Alim Al Islam

专题命中 具身导航 :navigation(abstract)

AI总结 本研究通过比较孟加拉国政府与非政府网站,发现两者在可访问性和可用性方面存在显著差异,需加强政策与设计实践以提升数字包容性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00110 2026-01-05 cs.NI 50%

CTMap: LLM-Enabled Connectivity-Aware Path Planning in Millimeter-Wave Digital Twin Networks

CTMap: 基于大语言模型的毫米波数字孪生网络中连接感知的路径规划

Md Salik Parwez, Sai Teja Srivillibhutturu, Sai Venkat Reddy Kopparthi, Asfiya Misba, Debashri Roy, Habeeb Olufowobi, Charles Kim

专题命中 具身导航 :navigation(abstract)

AI总结 CTMAP通过结合数字孪生与大语言模型,实现毫米波网络中连接感知的路径规划,显著提升信号强度并提高导航的可解释性与适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 3 篇

2601.00755 2026-01-05 eess.SY cs.SY 82%

A formal theory on problem space as a semantic world model in systems engineering

系统工程中作为语义世界模型的问题空间形式理论

Mayuranath SureshKumar, Hanumanthrao Kannan

专题命中 具身推理 :world model(title,abstract);navigation(abstract)

AI总结 本文提出了一种形式理论,将问题空间作为语义世界模型,以严格定义问题领域与解决方案之间的区分,并提供情境依赖的交互可追溯性和无歧义的边界语义。

Comments Submitted to Wiley Systems Engineering Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00051 2026-01-05 cs.CV 79%

TeleWorld: Towards Dynamic Multimodal Synthesis with a 4D World Model

TeleWorld:面向动态多模态合成的4D世界模型

Yabo Chen, Yuanzhi Liang, Jiepeng Wang, Tingxi Chen, Junfei Cheng, Zixiao Gu, Yuyang Huang, Zicheng Jiang, Wei Li, Tian Li, Weichen Li, Zuoxin Li, Guangce Liu, Jialun Liu, Junqi Liu, Haoyuan Wang, Qizhen Weng, Xuan'er Wu, Xunzhi Xiang, Xiaoyan Yang, Xin Zhang, Shiwen Zhang, Junyu Zhou, Chengcheng Zhou, Haibin Huang, Chi Zhang, Xuelong Li

机构 * TeleWorld Team(TeleWorld团队)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 TeleWorld提出了一种实时多模态4D世界建模框架,通过生成-重建-引导范式实现动态场景重建与长期记忆,提升世界模型的交互性和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22973 2026-01-05 cs.CV 57%

YOLO-IOD: Towards Real Time Incremental Object Detection

YOLO-IOD:朝向实时增量物体检测

Shizhou Zhang, Xueqiang Lv, Yinghui Xing, Qirui Wu, Di Xu, Chen Zhao, Yanning Zhang

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 YOLO-IOD通过解决增量学习中的知识冲突问题,提出了一种基于预训练YOLO-World模型的实时增量物体检测框架,有效减少遗忘并提升检测性能。

Comments AAAI 2026 accepted. Code & models are available at: https://github.com/qiangzai-lv/YOLO-IOD

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 3 篇

2601.00087 2026-01-05 cs.RO cs.LG 81%

Reinforcement learning with timed constraints for robotics motion planning

具有时间约束的强化学习用于机器人运动规划

Zhaoan Wang, Junchao Li, Mahdi Mohammad, Shaoping Xiao

机构 * Department of Mechanical Engineering, Iowa Technology Institute, University of Iowa(机械工程系,Iowa技术研究所,爱荷华大学) Talus Renewables, Inc.(Talus Renewables公司) Department of Industrial, Electronic, and Mechanical Engineering, Roma Tre University(工业、电子和机械工程系,罗马三大学)

专题命中 模仿学习与强化学习 :robotics(title);robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出了一种基于自动机的强化学习框架,用于在满足MITL时间约束的MDP和POMDP中合成策略,通过时间限制确定性广义巴克斯自动机实现时间正确性和性能优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14975 2026-01-05 cs.LG cs.AI cs.RO 67%

Flattening Hierarchies with Policy Bootstrapping

通过策略自举 flattening 层次结构

John L. Zhou, Jonathan C. Kao

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出一种通过自举子目标策略训练平坦目标条件策略的方法,解决长horizon任务中GCRL扩展难题,实现高维控制性能提升。

Comments NeurIPS 2025 (Spotlight, top 3.2%)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00309 2026-01-05 cs.LG cs.SY eess.SY 57%

Can Optimal Transport Improve Federated Inverse Reinforcement Learning?

最优传输能否改进联邦逆强化学习?

David Millard, Ali Baheri

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

AI总结 本文提出基于最优传输的联邦逆强化学习方法,通过Wasserstein均值融合提升跨异构环境的奖励估计一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2405.09569 2026-01-05 eess.SP cs.LG 74%

Real-Time Forecasting of Pathological Gait via IMU Navigation: A Few-Shot and Generative Learning Framework for Wearable Devices

通过IMU导航实现病理步态的实时预测:一种为可穿戴设备设计的少样本和生成学习框架

Wenwen Zhang, Hao Zhang, Zenan Jiang, Amir Servati, Peyman Servati

专题命中 人机交互与遥操作 :navigation(title);分类 cs.LG

AI总结 GaitMotion通过少样本学习和生成增强技术,提升可穿戴设备对病理步态的实时预测精度,实现更高效的生物力学模式识别。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 9 篇

2511.00094 2026-01-05 cs.RO cs.AI cs.SY eess.SY 84%

Digital Twin based Automatic Reconfiguration of Robotic Systems in Smart Environments

基于数字孪生的智能环境机器人系统自动重构

Angelos Alexopoulos, Agorakis Bompotas, Nikitas Rigas Kalogeropoulos, Panagiotis Kechagias, Athanasios P. Kalogeras, Christos Alexakos

机构 * Physics Department University of Patras(帕特拉斯大学物理系)

专题命中 机器人数据与评测 :robotic(title,abstract);robotics(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出基于数字孪生技术的机器人系统自动重构框架,通过虚拟环境模拟和优化路径,实现对动态环境变化的快速适应,提升智能环境中的自主性。

Comments Accepted for presentation to 11th IEEE International Smart Cities Conference (ISC2 2025)

Journal ref 2025 IEEE International Smart Cities Conference (ISC2)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13170 2026-01-05 cs.RO cs.LG cs.SY eess.SY math.OC 81%

Iterative Tuning of Nonlinear Model Predictive Control for Robotic Manufacturing Tasks

非线性模型预测控制在机器人制造任务中的迭代调优

Deepak Ingole, Valentin Bhend, Shiva Ganesh Murali, Oliver Dobrich, Alisa Rupenyan

机构 * ZHAW Institute of Materials and Process Engineering(ZHAW材料与加工工程学院) Zürich University of Applied Sciences(苏黎世应用科学大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出一种基于任务级反馈的迭代学习框架,用于在机器人重复制造任务中自适应调优非线性模型预测控制的权重矩阵,实现高效且精确的控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏