arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8699 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8699 篇

2603.13785 2026-03-17 cs.RO 70%

Robust Sim-to-Real Cloth Untangling through Reduced-Resolution Observations via Adaptive Force-Difference Quantization

通过自适应力差量化实现鲁棒的仿真到现实布料解缠

Yoshihisa Tsurumine, Yuki Kadokawa, Kohei Hayashi, Christian Diehm, Takamitsu Matsubara

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出自适应力差量化方法,通过降低观测分辨率和学习自适应量化阈值,提升仿真到现实布料解缠的鲁棒性。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10565 2026-03-12 cs.RO 70%

TacLoc: Global Tactile Localization on Objects from a Registration Perspective

TacLoc: 从配准角度实现物体的全局触觉定位

Zirui Zhang, Boyang Zhang, Fumin Zhang, Huan Yin

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 TacLoc通过单次点云配准方法实现物体的高效触觉定位,无需预训练模型或渲染数据,提升了姿态估计的准确性和效率。

Comments 8 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07480 2026-03-10 cs.RO 70%

GSAT: Geometric Traversability Estimation using Self-supervised Learning with Anomaly Detection for Diverse Terrains

基于自监督学习与异常检测的几何可 traversability 估计:GSAT

Dongjin Cho, Miryeong Park, Juhui Lee, Geonmo Yang, Younggun Cho

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 GSAT通过自监督学习与异常检测,在潜在空间中构建正超球体,实现对不同地形的可通行性估计,提升自主导航的可靠性。

Comments 8 pages, 8 figures, accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26558 2026-03-10 cs.RO 70%

Radio-based Multi-Robot Odometry and Relative Localization

基于无线电的多机器人里程计与相对定位

Andrés Martínez-Silva, David Alejo, Luis Merino, Fernando Caballero

机构 * Service Robotics Laboratory. University Pablo de Olavide(服务机器人实验室。 Pablo de Olavide 大学) Department of System Engineering and Automation(系统工程与自动化系)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于UWB和雷达的多机器人相对定位系统,利用低成本传感器和优化框架实现鲁棒的相对位置估计,并通过SITL模拟和真实数据验证,优于现有闭式方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24099 2026-03-10 cs.CV 70%

Unified Multi-Modal Interactive & Reactive 3D Motion Generation via Rectified Flow

通过修正流实现统一的多模态交互与反应3D运动生成

Prerit Gupta, Shourya Verma, Ananth Grama, Aniket Bera

机构 * Department of Computer Science Purdue University(计算机科学系 哈佛大学)

专题命中 机器人数据与评测 :robotics(abstract);embodied AI(abstract);分类 cs.CV

AI总结 DualFlow通过修正流实现多模态双人运动生成,提升运动质量与节奏同步性。

Comments Under review at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05807 2026-03-09 cs.CV 70%

EventGeM: Global-to-Local Feature Matching for Event-Based Visual Place Recognition

EventGeM:基于事件的视觉位置识别的全局到局部特征匹配

Adam D. Hines, Gokul B. Nair, Nicolás Marticorena, Michael Milford, Tobias Fischer

机构 * Queensland University of Technology(昆士兰理工大学)

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.CV

AI总结 EventGeM通过全局到局部特征融合提升基于事件的视觉位置识别性能,实现高精度实时定位。

Comments 10 pages, 4 figures, 5 tables, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19074 2026-03-09 cs.RO 70%

Sample-Based Hybrid Mode Control: Asymptotically Optimal Switching of Algorithmic and Non-Differentiable Control Modes

基于样本的混合模式控制:算法与非可微控制模式的渐近最优切换

Yilang Liu, Haoxiang You, Ian Abraham

机构 * Department of Mechanical Engineering and Material Science, Yale University(机械工程与材料科学系,耶鲁大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于样本的混合模式控制方法,通过整数优化实现算法与非可微控制模式的渐近最优切换,适用于机器人任务中的复杂行为合成与高效控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04208 2026-03-05 cs.RO 70%

GSeg3D: A High-Precision Grid-Based Algorithm for Safety-Critical Ground Segmentation in LiDAR Point Clouds

GSeg3D:一种高精度基于网格的算法,用于激光雷达点云中的安全关键地面分割

Muhammad Haider Khan Lodhi, Christoph Hertzberg

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 GSeg3D提出了一种高精度基于网格的地面分割算法,以满足自动驾驶和机器人在安全关键场景中的高精度需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01178 2026-03-03 cs.RO 70%

riMESA: Consensus ADMM for Real-World Collaborative SLAM

riMESA: 基于共识ADMM的现实世界协作SLAM

Daniel McGann, Michael Kaess

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 riMESA是一种基于共识ADMM的鲁棒增量分布式C-SLAM后端,能实时处理多机器人团队的定位与建图任务,准确度提升超过7倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21157 2026-03-02 cs.RO 70%

HALO: A Unified Vision-Language-Action Model for Embodied Multimodal Chain-of-Thought Reasoning

HALO:一种用于具身多模态推理的统一视觉-语言-动作模型

Quanxin Shou, Fangqi Zhu, Shawn Chen, Puxin Yan, Zhengyang Yan, Yikun Miao, Xiaoyi Pang, Zicong Hong, Ruikai Shi, Hao Huang, Jie Zhang, Song Guo

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 HALO提出了一种统一的视觉-语言-动作模型,通过结合文本推理、视觉子目标预测和增强的动作预测,实现具身多模态链式推理,提升了机器人在复杂环境中的表现和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23283 2026-02-27 cs.RO 70%

Simple Models, Real Swimming: Digital Twins for Tendon-Driven Underwater Robots

简单模型,真实游泳:用于腱驱动水下机器人的数字孪生

Mike Y. Michelis, Nana Obayashi, Josie Hughes, Robert K. Katzschmann

机构 * Soft Robotics Lab and ETH AI Center, ETH Zurich(ETH苏黎世人工智能中心) Prema Lab, New York University(纽约大学Prema实验室) CREATE Lab, EPFL(EPFL CREATE实验室)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于简化流体力学模型的腱驱动水下机器人,通过高效模拟环境实现快速泛化,展示了其在强化学习中的有效性及作为数字孪生的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23253 2026-02-27 cs.RO 70%

SPARR: Simulation-based Policies with Asymmetric Real-world Residuals for Assembly

SPARR: 基于模拟的策略与不对称现实残差的装配

Yijie Guo, Iretiayo Akinola, Lars Johannsmeier, Hugo Hadfield, Abhishek Gupta, Yashraj Narang

机构 * Nvidia University of Washington(华盛顿大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 SPARR通过结合模拟训练的基础策略和现实残差策略,有效解决现实世界装配任务中的性能下降问题,提升成功率并减少循环时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00062 2026-02-26 cs.CV cs.AI cs.LG cs.RO 70%

World Simulation with Video Foundation Models for Physical AI

基于视频基础模型的世界模拟用于物理AI

NVIDIA, :, Arslan Ali, Junjie Bai, Maciej Bala, Yogesh Balaji, Aaron Blakeman, Tiffany Cai, Jiaxin Cao, Tianshi Cao, Elizabeth Cha, Yu-Wei Chao, Prithvijit Chattopadhyay, Mike Chen, Yongxin Chen, Yu Chen, Shuai Cheng, Yin Cui, Jenna Diamond, Yifan Ding, Jiaojiao Fan, Linxi Fan, Liang Feng, Francesco Ferroni, Sanja Fidler, Xiao Fu, Ruiyuan Gao, Yunhao Ge, Jinwei Gu, Aryaman Gupta, Siddharth Gururani, Imad El Hanafi, Ali Hassani, Zekun Hao, Jacob Huffman, Joel Jang, Pooya Jannaty, Jan Kautz, Grace Lam, Xuan Li, Zhaoshuo Li, Maosheng Liao, Chen-Hsuan Lin, Tsung-Yi Lin, Yen-Chen Lin, Huan Ling, Ming-Yu Liu, Xian Liu, Yifan Lu, Alice Luo, Qianli Ma, Hanzi Mao, Kaichun Mo, Seungjun Nah, Yashraj Narang, Abhijeet Panaskar, Lindsey Pavao, Trung Pham, Morteza Ramezanali, Fitsum Reda, Scott Reed, Xuanchi Ren, Haonan Shao, Yue Shen, Stella Shi, Shuran Song, Bartosz Stefaniak, Shangkun Sun, Shitao Tang, Sameena Tasmeen, Lyne Tchapmi, Wei-Cheng Tseng, Jibin Varghese, Andrew Z. Wang, Hao Wang, Haoxiang Wang, Heng Wang, Ting-Chun Wang, Fangyin Wei, Jiashu Xu, Dinghao Yang, Xiaodong Yang, Haotian Ye, Seonghyeon Ye, Xiaohui Zeng, Jing Zhang, Qinsheng Zhang, Kaiwen Zheng, Andrew Zhu, Yuke Zhu

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 Cosmos-Predict2.5和Cosmos-Transfer2.5通过统一生成和增强的模拟能力,推动物理AI领域的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21015 2026-02-25 cs.CV 70%

From Perception to Action: An Interactive Benchmark for Vision Reasoning

从感知到行动:一个交互式基准测试用于视觉推理

Yuhao Wu, Maojia Song, Yihuai Lan, Lei Wang, Zhiqiang Hu, Yao Xiao, Heng Zhou, Weihua Zheng, Dylan Raharja, Soujanya Poria, Roy Ka-Wei Lee

机构 * Singapore University of Technology(新加坡科技设计大学) Singapore Management University (SMU), Singapore(新加坡管理学院) Nanyang Technological University (NTU), Singapore(南洋理工大学) University of Science(科学大学)

专题命中 机器人数据与评测 :embodied agent(abstract);manipulation(abstract);分类 cs.CV

AI总结 CHAIN基准测试通过交互式3D物理驱动环境,评估模型在动态环境中理解、规划和执行基于物理约束的结构化动作序列的能力。

Comments Work in processing. Website: https://social-ai-studio.github.io/CHAIN/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17195 2026-02-24 cs.RO 70%

Depth-PC: A Visual Servo Framework Integrated with Cross-Modality Fusion for Sim2Real Transfer

Depth-PC: 一种集成跨模态融合的视觉伺服框架用于仿真到现实迁移

Haoyu Zhang, Yang Liu, Yimu Jiang, Weiyang Lin, Chao Ye

机构 * Research Institute of Intelligent Control and Systems, Harbin Institute of Technology(智能控制与系统研究所,哈尔滨工业大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 Depth-PC通过跨模态融合和图神经网络实现零样本仿真到现实迁移的视觉伺服框架

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13309 2026-02-23 cs.CV 70%

eStonefish-Scenes: A Sim-to-Real Validated and Robot-Centric Event-based Optical Flow Dataset for Underwater Vehicles

eStonefish-Scenes: 一种经过仿真到现实验证且以机器人为中心的基于事件的光学流数据集用于水下车辆

Jad Mansour, Sebastian Realpe, Hayat Rajani, Michele Grimaldi, Rafael Garcia, Nuno Gracias

机构 * Robotics Research Institute (ViCOROB), Universitat de Girona (UdG), Spain 2 School of Engineering \& Physical Sciences, Heriot-Watt University, Edinburgh, UK

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 eStonefish-Scenes是首个针对水下应用的基于事件的光学流合成数据集,结合了仿真生成和现实验证,提升了水下机器人视觉导航的可靠性。

Comments This revised version extends the original, which lacked real-world validation. We added a real-world data acquisition study using a DAVIS346 camera on a BlueROV2, a homography-based ground-truth optical flow method with per-pixel uncertainty estimation, and a sim-to-real evaluation using a ConvGRU network trained on synthetic data and tested on real underwater sequences. arXiv admin note: text overlap with arXiv:2412.09209

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18014 2026-02-23 cs.RO cs.SY eess.SY stat.ML 70%

Quasi-Periodic Gaussian Process Predictive Iterative Learning Control

准周期高斯过程预测迭代学习控制

Unnati Nigam, Radhendushka Srivastava, Faezeh Marzbanrad, Michael Burke

机构 * IITB-Monash Research Academy, IIT Bombay(IITB-蒙纳士研究学院,IIT博伊斯瓦尔) Department of Mathematics, IIT Bombay(数学系,IIT博伊斯瓦尔) Department of Electrical and Computer Systems Engineering, Monash University(电气与计算机系统工程系,蒙纳士大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种基于准周期高斯过程的预测迭代学习控制方法,通过高效建模和预测扰动,提升重复性任务的收敛速度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12062 2026-02-13 cs.RO 70%

HoloBrain-0 Technical Report

HoloBrain-0 技术报告

Xuewu Lin, Tianwei Lin, Yun Du, Hongyu Xie, Yiwei Jin, Jiawei Li, Shijie Wu, Qingze Wang, Mengdi Li, Mengao Zhao, Ziang Li, Chaodong Huang, Hongzhe Bi, Lichao Huang, Zhizhong Su

机构 * Horizon Robotics

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 HoloBrain-0 提出了一种融合视觉、语言和动作的框架,通过预训练和后训练范式,在模拟和现实任务中取得领先性能,并开源完整生态系统促进机器人研究。

Comments 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10102 2026-02-11 cs.CV 70%

VideoWorld 2: Learning Transferable Knowledge from Real-world Videos

VideoWorld 2: 从真实世界视频中学习可迁移的知识

Zhongwei Ren, Yunchao Wei, Xiao Yu, Guixun Luo, Yao Zhao, Bingyi Kang, Jiashi Feng, Xiaojie Jin

机构 * Beijing Jiaotong University(北京交通大学)

专题命中 机器人数据与评测 :robotics(abstract);manipulation(abstract);分类 cs.CV

AI总结 VideoWorld 2通过动态增强的潜在动态模型从真实世界视频中学习可迁移知识,显著提升了任务成功率和长周期推理能力。

Comments Code and models are released at: https://maverickren.github.io/VideoWorld2.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01100 2026-02-10 cs.RO 70%

StreamVLA: Breaking the Reason-Act Cycle via Completion-State Gating

StreamVLA: 通过完成状态门控打破原因-行动循环

Tongqing Chen, Hang Wu, Jiasen Wang, Xiaotao Li, Lu Fang

机构 * Tsinghua University(清华大学) Technical University of Munich(慕尼黑技术大学) Shanghai University(上海大学) Wuhan University(武汉大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 StreamVLA通过完成状态门控机制,实现高效机器人操作,减少推理延迟并提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04441 2026-02-05 cs.CV 70%

SynthVerse: A Large-Scale Diverse Synthetic Dataset for Point Tracking

SynthVerse:一个大规模多样化合成数据集用于点跟踪

Weiguang Zhao, Haoran Xu, Xingyu Miao, Qin Zhao, Rui Zhang, Kaizhu Huang, Ning Gao, Peizhou Cao, Mingze Sun, Mulin Yu, Tao Lu, Linning Xu, Junting Dong, Jiangmiao Pang

机构 * University of Liverpool(利物浦大学) Zhejiang University(浙江大学) Durham University(杜伦大学) Beihang University(北京航空航天大学) Duke Kunshan University(杜克昆山大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Xi’an Jiaotong University(西安交通大学) Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 机器人数据与评测 :manipulation(abstract);navigation(abstract);分类 cs.CV

AI总结 SynthVerse通过提供大规模多样化合成数据集,提升点跟踪任务的泛化能力和评估效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04228 2026-02-05 cs.RO 70%

Reshaping Action Error Distributions for Reliable Vision-Language-Action Models

重塑动作误差分布以实现可靠的视觉-语言-动作模型

Shuanghao Bai, Dakai Wang, Cheng Chi, Wanqi Zhou, Jing Lyu, Xiaoguang Zhao, Pengwei Wang, Zhongyuan Wang, Lei Xing, Shanghang Zhang, Badong Chen

机构 * Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Institute of Automation(自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) School of Artificial Intelligence(人工智能学院) Peking University(北京大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本研究通过重塑动作误差分布,提出基于最小误差熵的VLA模型训练方法,提升模型在不同任务中的成功率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00611 2026-02-04 cs.AI 70%

Structured Self-Consistency:A Multi-Task Evaluation of LLMs on VirtualHome

结构自一致性:基于虚拟家庭的多任务评估

Jiaqi Xu, Tao Huang, Kai Zhang

专题命中 机器人数据与评测 :embodied AI(abstract);embodied agent(abstract);分类 cs.AI

AI总结 本文提出结构自一致性方法,评估两种大型语言模型在虚拟家庭任务中的表现,发现不同模型在不同任务中各有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00686 2026-02-03 cs.RO 70%

Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching

通过自适应视觉令牌缓存学习加速视觉-语言-动作模型

Yujie Wei, Jiahan Fan, Jiyu Guo, Ruichen Zhen, Rui Shao, Xiu Su, Zeke Xie, Shuo Yang

机构 * Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院) Central South University(中南大学) HKUST(GZ)(香港科技大学(广州))

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出通过自适应视觉令牌缓存学习加速VLA模型,提升推理效率并提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22018 2026-02-02 cs.RO 70%

PocketDP3: Efficient Pocket-Scale 3D Visuomotor Policy

PocketDP3: 高效的微型3D视觉-运动政策

Jinhao Zhang, Zhexuan Zhou, Huizhe Li, Yichen Lai, Wenlong Xia, Haoming Song, Youmin Gong, Jie Mei

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 PocketDP3通过轻量级扩散混合器替代传统解码器,实现高效3D视觉-运动策略,减少参数消耗并提升实时部署性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10961 2026-02-02 cs.RO 70%

EquiContact: A Hierarchical SE(3) Vision-to-Force Equivariant Policy for Spatially Generalizable Contact-rich Tasks

EquiContact: 一种用于空间通用接触密集任务的层次SE(3)视觉到力等价策略

Joohwan Seo, Arvind Kruthiventy, Soomi Lee, Megan Teng, Seoyeon Choi, Xiang Zhang, Jongeun Choi, Roberto Horowitz

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 EquiContact通过分层策略和等价性设计,实现空间通用的接触密集任务视觉到力控制。

Comments Submitted to RSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19484 2026-01-28 cs.CV 70%

Dynamic Worlds, Dynamic Humans: Generating Virtual Human-Scene Interaction Motion in Dynamic Scenes

动态世界,动态人类:生成动态场景中的虚拟人类-场景交互动作

Yin Wang, Zhiying Leng, Haitian Liu, Frederick W. B. Li, Mu Li, Xiaohui Liang

机构 * Beihang University(北航大学) University of Durham(达勒姆大学) State Key Laboratory of Virtual Reality Technology and Systems(虚拟现实技术与系统国家重点实验室) Zhongguancun Laboratory(中关村实验室)

专题命中 机器人数据与评测 :navigation(abstract);world model(abstract);分类 cs.CV

AI总结 本文提出Dyn-HSI架构,通过动态视觉导航、分层经验记忆和人-场景交互扩散模型,生成高质量的动态场景中人-场景交互动作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11908 2026-01-27 cs.RO 70%

Safe Learning for Contact-Rich Robot Tasks: A Survey from Classical Learning-Based Methods to Safe Foundation Models

接触丰富机器人任务的安全学习:从经典学习方法到安全基础模型的综述

Heng Zhang, Rui Dai, Gokhan Solak, Pokuang Zhou, Yu She, Arash Ajoudani

机构 * Human-Robot Interfaces and Interaction Lab, Istituto Italiano di Tecnologia, Genova, Italy(人类-机器人接口与交互实验室,意大利技术研究院,热那亚,意大利) Ph.D. program of national interest in Robotics and Intelligent Machines (DRIM) and Università di Genova, Genoa, Italy(机器人与智能机器国家利益博士项目(DRIM)和热那亚大学,热那亚,意大利) Edwardson School of Industrial Engineering, Purdue University, West Lafayette, IN, USA(工业工程埃德华森学校,普渡大学,西拉法伊斯,美国)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文综述了接触丰富机器人任务的安全学习方法,探讨了从经典学习方法到安全基础模型的发展,分析了安全探索与执行的关键技术及未来方向。

Comments version 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11480 2026-01-27 cs.AI cs.CV cs.ET cs.LG cs.RO 70%

Cross-Platform Scaling of Vision-Language-Action Models from Edge to Cloud GPUs

从边缘到云GPU的视觉-语言-动作模型跨平台扩展

Amir Taherin, Juyi Lin, Arash Akbari, Arman Akbari, Pu Zhao, Weiwei Chen, David Kaeli, Yanzhi Wang

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文研究了视觉-语言-动作模型在边缘到云GPU平台上的跨平台扩展,揭示了架构选择和电力限制对性能的影响,并挑战了数据中心硬件的优越性假设。

Comments To appear in the Asilomar Conference on Signals, Systems, and Computers 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17251 2026-01-27 cs.RO 70%

EMPM: Embodied MPM for Modeling and Simulation of Deformable Objects

EMPM:基于具身的MPM用于变形物体建模与仿真

Yunuo Chen, Yafei Hu, Lingfeng Sun, Tushar Kusnur, Laura Herlant, Chenfanfu Jiang

机构 * Robotics and AI Institute(机器人与人工智能研究院) UCLA(加州大学洛杉矶分校)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 EMPM通过基于可微MPM的框架,结合多视角视频重建与在线参数优化,实现对复杂变形物体的高效仿真与操控。

详情

展开后加载摘要…

URL PDF HTML 收藏