arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8699 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8699 篇

2412.13176 2026-01-26 cs.CV 70%

NFL-BA: Near-Field Light Bundle Adjustment for SLAM in Dynamic Lighting

NFL-BA:近场光束调整用于动态光照下的SLAM

Andrea Dunn Beltran, Daniel Rho, Marc Niethammer, Roni Sengupta

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of California San Diego(加州大学圣地亚哥分校)

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 NFL-BA通过显式建模近场照明提升动态光照下SLAM性能,显著提高相机跟踪和建图效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13801 2026-01-21 cs.RO 70%

HoverAI: An Embodied Aerial Agent for Natural Human-Drone Interaction

HoverAI: 一种用于自然人-无人机交互的具身空中代理

Yuhua Jin, Nikita Kuzmin, Georgii Demianchuk, Mariya Lezina, Fawad Mehboob, Issatay Tokmurziyev, Miguel Altamirano Cabrera, Muhammad Ahsan Mustafa, Dzmitry Tsetserukou

机构 * Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Skolkovo Institute of Science and Technology(斯克尔科沃信息科技研究所)

专题命中 机器人数据与评测 :robotics(abstract);embodied agent(abstract);分类 cs.RO

AI总结 HoverAI通过结合无人机移动、视觉投影和对话式AI,实现了人-无人机自然交互的具身代理,提升了空间感知与社交响应能力。

Comments This paper has been accepted for publication at LBR HRI 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12560 2026-01-21 cs.AI cs.MA 70%

Agentic Artificial Intelligence (AI): Architectures, Taxonomies, and Evaluation of Large Language Model Agents

代理型人工智能(AI):架构、分类及大语言模型代理的评估

Arunkumar V, Gangadharan G. R., Rajkumar Buyya

机构 * University College of Engineering, Anna University(安娜大学工程学院) National Institute of Technology Tiruchirappalli(Tiruchirappalli 国家理工学院) School of Computing and Information Systems University of Melbourne(墨尔本大学计算机与信息系统学院)

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.AI

AI总结 本文探讨了代理型人工智能的架构、分类及评估,提出统一分类框架,分析从线性推理到原生推理模型的转变,并指出未来研究方向以提升自主系统的可靠性。

Comments 28 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18793 2026-01-21 cs.RO 70%

Genie Centurion: Accelerating Scalable Real-World Robot Training with Human Rewind-and-Refine Guidance

Genie Centurion:通过人类 rewind-and-refine 指导加速可扩展的现实世界机器人训练

Wenhao Wang, Jianheng Song, Chiming Liu, Jiayao Ma, Siyuan Feng, Jingyuan Wang, Yuxin Jiang, Kylin Chen, Sikang Zhan, Yi Wang, Tong Meng, Modi Shi, Xindong He, Guanghui Ren, Yang Yang, Maoqing Yao

专题命中 机器人数据与评测 :robot policy(abstract);robotic(abstract);分类 cs.RO

AI总结 Genie Centurion 通过人类 rewind-and-refine 指导提升现实世界机器人训练效率,实现高任务成功率和低成本数据收集

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10268 2026-01-16 cs.RO 70%

The impact of tactile sensor configurations on grasp learning efficiency -- a comparative evaluation in simulation

触觉传感器配置对抓取学习效率的影响——一种在仿真中的比较评估

Eszter Birtalan, Miklós Koller

机构 * Faculty of Information Technology and Bionics, Pázmány Péter Catholic University(信息科技与生物学院,帕兹曼·彼得天主教大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本研究通过仿真评估了不同触觉传感器配置对抓取学习效率的影响,发现一种配置在两个设置中均表现最佳,为机器人手设计提供了参考。

Comments 13 pages, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09163 2026-01-15 cs.RO 70%

CEI: A Unified Interface for Cross-Embodiment Visuomotor Policy Learning in 3D Space

CEI:一种用于3D空间跨身体视觉运动策略学习的统一接口

Tong Wu, Shoujie Li, Junhao Gong, Changqing Guo, Xingting Li, Shilong Mu, Wenbo Ding

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 CEI提出了一种跨身体视觉运动策略学习框架,通过功能相似性量化和梯度优化实现不同机械臂和末端执行器间的演示转移,实验显示在模拟和现实任务中均取得高转移效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05215 2026-01-12 cs.AI 70%

MineNPC-Task: Task Suite for Memory-Aware Minecraft Agents

MineNPC-Task: 用于记忆感知Minecraft代理的任务套件

Tamil Sudaravan Mohan Doss, Michael Xu, Sudha Rao, Andrew D. Wilson, Balasaravanan Thoravi Kumaravel

机构 * Microsoft(微软) Microsoft Research(微软研究院) Microsoft Research United States(微软研究院美国)

专题命中 机器人数据与评测 :embodied agent(abstract);navigation(abstract);分类 cs.AI

AI总结 MineNPC-Task通过与专家玩家共同游戏生成任务,评估记忆感知Minecraft代理在开放世界中的表现,发现代码执行等任务中的崩溃模式,并提出改进内存持久性的需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08627 2026-01-07 cs.RO 70%

Augmented Reality for RObots (ARRO): Pointing Visuomotor Policies Towards Visual Robustness

增强现实用于机器人(ARRO):通过视觉鲁棒性指向视觉策略

Reihaneh Mirjalili, Tobias Jülg, Florian Walter, Wolfram Burgard

机构 * Department of Computer Science and Artificial Intelligence, University of Technology Nuremberg(计算机科学与人工智能系,图恩堡技术大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 ARRO通过实时视觉屏蔽和虚拟引导提升机器人操作的视觉鲁棒性,减少对额外数据的依赖,适用于多种桌面任务和真实环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02761 2026-01-01 cs.AI 70%

Plan Verification for LLM-Based Embodied Task Completion Agents

基于大语言模型的体感任务完成代理的计划验证

Ananth Hariharan, Vardhan Dongre, Dilek Hakkani-Tür, Gokhan Tur

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人数据与评测 :embodied AI(abstract);navigation(abstract);分类 cs.AI

AI总结 本文提出基于自然语言提示的体感任务代理计划验证框架,通过迭代修正提升动作序列质量,实现高召回率和精确度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21710 2025-12-30 cs.CV 70%

RAPTOR: Real-Time High-Resolution UAV Video Prediction with Efficient Video Attention

RAPTOR: 用于高效视频注意的实时高分辨率无人机视频预测

Zhan Chen, Zile Guo, Enze Zhu, Peirong Zhang, Xiaoxuan Liu, Lei Wang, Yidan Zhang

专题命中 机器人数据与评测 :embodied agent(abstract);navigation(abstract);分类 cs.CV

AI总结 RAPTOR通过高效视频注意机制实现了实时高分辨率视频预测,首次在Jetson AGX Orin上达到30 FPS以上,提升了无人机任务成功率18%。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09911 2025-12-23 cs.RO physics.comp-ph 70%

Py-DiSMech: A Scalable and Efficient Framework for Discrete Differential Geometry-Based Modeling and Control of Soft Robots

Py-DiSMech:一种用于软机器人离散微分几何建模与控制的可扩展高效框架

Radha Lahoti, Ryan Chaiyakul, M. Khalid Jawed

机构 * Department of Mechanical and Aerospace Engineering, University of California, Los Angeles (UCLA)(机械与航空航天工程系,加州大学洛杉矶分校)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 Py-DiSMech通过离散微分几何原理,提供高效且可扩展的软机器人建模与控制框架,结合高保真模拟与快速计算,适用于仿真驱动的设计与控制验证。

Comments Software: https://github.com/structuresComp/dismech-python Supplementary Video: https://youtu.be/AfFcoAZR0Go

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01194 2025-12-19 cs.RO 70%

RoboLoc: A Benchmark Dataset for Point Place Recognition and Localization in Indoor-Outdoor Integrated Environments

RoboLoc:用于室内-室外集成环境中的点位识别和定位的基准数据集

Jaejin Jeon, Seonghoon Ryoo, Sang-Duck Lee, Soomok Lee, Seungwoo Jeong

机构 * Department of Data, Network and AI, Ajou University(数据、网络与人工智能系,亚运会大学) Korea Railroad Research Institute(韩国铁路研究院) Department of Mobility Engineering, Ajou University(移动工程系,亚运会大学)

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 RoboLoc是一个用于室内外集成环境的点位识别和定位基准数据集,通过真实机器人轨迹和多领域转换,评估多种先进模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16295 2025-12-19 cs.AI 70%

OS-Oracle: A Comprehensive Framework for Cross-Platform GUI Critic Models

OS-Oracle: 一个跨平台GUI批评模型的综合框架

Zhenyu Wu, Jingjing Xie, Zehao Li, Bowen Yang, Qiushi Sun, Zhaoyang Liu, Zhoumianze Liu, Yu Qiao, Xiangyu Yue, Zun Wang, Zichen Ding

机构 * Shanghai Jiaotong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港大学MMLab) The University of Hong Kong(香港大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 机器人数据与评测 :manipulation(abstract);navigation(abstract);分类 cs.AI

AI总结 OS-Oracle提出了一种跨平台GUI批评模型框架,通过合成数据和两阶段训练方法,实现了在移动、网页和桌面平台上的高效批评评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14691 2025-12-18 cs.CL cs.CV 70%

MMGR: Multi-Modal Generative Reasoning

MMGR:多模态生成推理

Zefan Cai, Haoyi Qiu, Tianyi Ma, Haozhe Zhao, Gengze Zhou, Kung-Hsiang Huang, Parisa Kordjamshidi, Minjia Zhang, Wen Xiao, Jiuxiang Gu, Nanyun Peng, Junjie Hu

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of California, Los Angeles(加州大学洛杉矶分校) Michigan State University(密歇根州立大学) University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Adelaide(阿德莱德大学) Salesforce AI Research(Salesforce人工智能研究) Microsoft(微软) Adobe Research(Adobe研究)

专题命中 机器人数据与评测 :navigation(abstract);world model(abstract);分类 cs.CV

AI总结 MMGR提出一个多模态生成推理评估框架,通过物理、逻辑、空间和时间五个能力评估视频和图像生成模型,揭示其在抽象推理和具身导航中的性能不足。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18929 2025-12-18 cs.CV 70%

Human-Centric Open-Future Task Discovery: Formulation, Benchmark, and Scalable Tree-Based Search

以人为中心的开放未来任务发现: formulation、基准和可扩展的树基搜索

Zijian Song, Xiaoxin Lin, Tao Pu, Zhenlong Yuan, Guangrun Wang, Liang Lin

机构 * Zijian Song 1(Song 研究所) Xiaoxin Lin 1(Lin 研究所) Tao Pu 1(Pu 研究所) Zhenlong Yuan 4(Yuan 研究所) Guangrun Wang 1,2,3(Wang 研究所) Liang Lin 1,2,3(Lin 研究所)

专题命中 机器人数据与评测 :robotics(abstract);embodied AI(abstract);分类 cs.CV

AI总结 本研究提出HOTD问题,通过CMAST框架在开放未来任务发现中实现最佳性能,显著超越现有LMMs。

Comments accepted to AAAI 2026, 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13053 2025-12-18 cs.CV 70%

Uncertainty-Aware Knowledge Distillation for Compact and Efficient 6DoF Pose Estimation

具有不确定性的知识蒸馏用于紧凑且高效的6自由度姿态估计

Nassim Ali Ousalah, Anis Kacem, Enjie Ghorbel, Emmanuel Koumandakis, Djamila Aouada

机构 * SnT, University of Luxembourg(卢森堡大学SnT分校) Cristal Lab, ENSI, University of Manouba(曼努巴大学ENSI的Cristal实验室) Infinite Orbits, Toulouse(图卢兹的Infinite Orbits)

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 本文提出了一种不确定性强的知识蒸馏方法,用于提升紧凑型6自由度姿态估计模型的精度和效率。

Comments Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2025

Journal ref Proc. 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 15398-15405, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13007 2025-12-16 cs.CV 70%

Light Field Based 6DoF Tracking of Previously Unobserved Objects

基于光场的先前未观察到物体的6自由度跟踪

Nikolai Goncharov, James L. Gray, Donald G. Dansereau

机构 * University of Sydney(悉尼大学) Australian Centre For Robotics (ACFR)(澳大利亚机器人中心) School of Aerospace, Mechanical and Mechatronic Engineering(航空航天、机械与机电工程学院)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.CV

AI总结 本文提出了一种基于光场的物体跟踪方法,无需预训练模型,能有效处理复杂视觉行为,如反射,通过统一的物体表示提升跟踪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10674 2025-12-12 cs.CV 70%

Geo6DPose: Fast Zero-Shot 6D Object Pose Estimation via Geometry-Filtered Feature Matching

Geo6DPose:通过几何过滤特征匹配实现快速零样本6D物体姿态估计

Javier Villena Toro, Mehdi Tarkian

机构 * Linköping University(利乌普斯大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.CV

AI总结 Geo6DPose通过几何过滤特征匹配实现快速零样本6D姿态估计,无需训练或网络访问,具备高效推理与高鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15129 2025-12-10 cs.RO cs.AI cs.CV cs.LG 70%

Towards Task-Oriented Flying: Framework, Infrastructure, and Principles

面向任务的飞行:框架、基础设施与原则

Kangyao Huang, Hao Wang, Jingyu Chen, Jintao Chen, Yu Luo, Di Guo, Xiangkui Zhang, Xiangyang Ji, Huaping Liu

机构 * Tsinghua University(清华大学) Dalian University of Technology(大连理工大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 机器人数据与评测 :robot learning(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出面向任务的四旋翼端到端DRL框架,整合复杂任务规范的设计原则,揭示模拟任务定义、训练设计原则和物理部署间的相互依赖关系,为动态无结构环境下的自主飞行提供实用基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04686 2025-12-09 cs.CV 70%

Towards Cross-View Point Correspondence in Vision-Language Models

面向视觉-语言模型的跨视图点对应研究

Yipu Wang, Yuheng Ji, Yuyang Liu, Enshen Zhou, Ziqiang Yang, Yuxuan Tian, Ziheng Qin, Yue Liu, Huajie Tan, Cheng Chi, Zhiyuan Ma, Daniel Dajun Zeng, Xiaolong Zheng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beihang University(北航大学) Jilin University(吉林大学) National University of Singapore(新加坡国立大学) Peking University(北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Huazhong University of Science And Technology(华中科技大学)

专题命中 机器人数据与评测 :embodied AI(abstract);manipulation(abstract);分类 cs.CV

AI总结 本文提出跨视图点对应任务和 CrossPoint-Bench 基准,通过 CroPond 模型在 CrossPoint-Bench 上取得超越 Gemini-2.5-Pro 的准确率,推动跨视图对应研究发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04731 2025-12-05 cs.RO 70%

Bridging Simulation and Reality: Cross-Domain Transfer with Semantic 2D Gaussian Splatting

弥合仿真与现实:基于语义2D高斯点云的跨领域迁移

Jian Tang, Pu Pang, Haowen Sun, Chengzhong Ma, Xingyu Chen, Hua Huang, Xuguang Lan

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本研究提出语义2D高斯点云方法,通过提取领域不变特征提升机器人操作的仿真到现实迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04404 2025-12-05 cs.RO 70%

Bridging Probabilistic Inference and Behavior Trees: An Interactive Framework for Adaptive Multi-Robot Cooperation

弥合概率推断与行为树:一种交互框架用于自适应多机器人协作

Chaoran Wang, Jingyuan Sun, Yanhui Zhang, Changju Wu

机构 * School of Aeronautic and Astronautics, Zhejiang University(航空航天学院,浙江大学) Shanghai Huawei Technologies Co., Ltd(上海华为技术有限公司)

专题命中 机器人数据与评测 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出IIBT框架,结合概率推断与行为树,实现多机器人自适应协作,实验表明其能显著降低复杂度并保持鲁棒性。

Comments 34 pages, is submitted RAS Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04597 2025-12-05 cs.CV cs.AI cs.LG cs.RO 70%

When Robots Should Say "I Don't Know": Benchmarking Abstention in Embodied Question Answering

机器人何时应说'我不知道':身体化问答中退避的基准测试

Tao Wu, Chuhao Zhou, Guangyu Zhao, Haozhi Cao, Yewen Pu, Jianfei Yang

机构 * Nanyang Technological University(南洋理工大学) Peking University(北京大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文研究了身体化问答中退避机制的重要性,通过构建AbstainEQA数据集,发现人类在退避任务中表现优异,而模型退避能力有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04018 2025-12-04 cs.RO 70%

FPC-VLA: A Vision-Language-Action Framework with a Supervisor for Failure Prediction and Correction

FPC-VLA:一个带有监督器的视觉-语言-动作框架,用于故障预测和纠正

Yifan Yang, Zhixiang Duan, Tianshi Xie, Fuyu Cao, Pinxi Shen, Peili Song, Piaopiao Jin, Guokang Sun, Shaoqing Xu, Yangwei You, Jingtai Liu

机构 * The Institute of Robotics and Automatic Information System(机器人与自动信息系统研究所) Tianjin Key Laboratory of Intelligent Robotics(智能机器人天津重点实验室) TBI Center, Nankai University, Tianjin 300350, China(南开大学天津中心) Faculty of Robot Science and Engineering, Northeastern University, Shenyang 110819, China(机器人科学与工程学院) The State Key Laboratory of Internet of Things for Smart City(智能城市物联网国家重点实验室) Centre for Artificial Intelligence(人工智能中心) Department of Electromechanical Engineering, University of Macau, Macau SAR, China(机电工程系,澳门大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 FPC-VLA 提出了一种双模型框架,结合视觉-语言-动作模块与监督器,用于预测和纠正机器人操作中的故障,提升了自主系统的可靠性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21460 2025-11-27 cs.AI 70%

MADRA: Multi-Agent Debate for Risk-Aware Embodied Planning

MADRA:多智能体辩论用于风险感知的具身规划

Junjian Wang, Lidan Zhao, Xi Sheryl Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) University of Chinese Academy of Sciences, Nanjing(中国科学院大学南京校区)

专题命中 机器人数据与评测 :embodied AI(abstract);embodied agent(abstract);分类 cs.AI

AI总结 MADRA通过多智能体辩论和分层认知框架,在安全性和效率上超越现有方法,实现高安全任务拒绝率和低误拒率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00392 2025-11-25 cs.CV 70%

RefDrone: A Challenging Benchmark for Referring Expression Comprehension in Drone Scenes

RefDrone:一种针对无人机场景中指称表达理解的挑战性基准

Zhichao Sun, Yepeng Liu, Zhiling Su, Huachao Zhu, Yuliang Gu, Yuda Zou, Zelong Liu, Gui-Song Xia, Bo Du, Yongchao Xu

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 机器人数据与评测 :embodied AI(abstract);robotic(abstract);分类 cs.CV

AI总结 RefDrone提出了一种针对无人机场景中指称表达理解的挑战性基准,通过RDAgent和NGDINO方法提升了多目标和无目标情况下的识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16166 2025-11-21 cs.CV 70%

EvoVLA: Self-Evolving Vision-Language-Action Model

EvoVLA:自进化视觉-语言-动作模型

Zeting Liu, Zida Yang, Zeyu Zhang, Hao Tang

机构 * Peking University(北京大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 EvoVLA通过自监督框架解决VLA模型的阶段幻觉问题,提升任务成功率和样本效率,实现有效的仿真到现实转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08334 2025-11-18 cs.GR cs.CV 70%

iTACO: Interactable Digital Twins of Articulated Objects from Casually Captured RGBD Videos

Weikun Peng, Jun Lv, Cewu Lu, Manolis Savva

机构 * Simon Fraser University(西蒙弗雷泽大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :robotics(abstract);embodied AI(abstract);分类 cs.CV

Comments 3DV 2026 camera-ready version. Project website can be found at https://3dlg-hcvc.github.io/video2articulation/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13120 2025-11-18 cs.RO 70%

Monolithic Units: Actuation, Sensing, and Simulation for Integrated Soft Robot Design

Trevor Exley, Anderson Brazil Nardin, Petr Trunin, Diana Cafiso, Lucia Beccai

机构 * Soft BioRobotics Perception Lab of the Istituto Italiano di Tecnologia (IIT)(意大利技术研究院(IIT)软生物机器人感知实验室)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

Comments 8 pages, 6 figures, 1 algorithm, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12368 2025-11-18 cs.CV 70%

Fast Reasoning Segmentation for Images and Videos

Yiqing Shen, Mathias Unberath

机构 * Department of Computer Science, Johns Hopkins University(计算机科学系,约翰·霍普金斯大学)

专题命中 机器人数据与评测 :embodied AI(abstract);embodied agent(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏