arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8699 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8699 篇

2410.14686 2025-07-08 eess.SP cs.AI cs.LG 68%

Achieving Generalization in Orchestrating GNSS Interference Monitoring Stations Through Pseudo-Labeling

Lucas Heublein, Tobias Feigl, Alexander Rügamer, Felix Ott

专题命中 机器人数据与评测 :navigation(abstract,comments);分类 cs.AI、cs.LG

Comments DGON Positioning and Navigation for Intelligent Transport Systems (POSNAV)

Journal ref DGON Positioning and Navigation for Intelligent Transport Systems (POSNAV), October 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.07690 2025-02-26 cs.RO cs.AI 68%

CaRE: Finding Root Causes of Configuration Issues in Highly-Configurable Robots

Md Abir Hossen, Sonam Kharade, Bradley Schmerl, Javier Cámara, Jason M. O'Kane, Ellen C. Czaplinski, Katherine A. Dzurilla, David Garlan, Pooyan Jamshidi

专题命中 机器人数据与评测 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.AI

Comments IEEE Robotics and Automation Letters, 2023 (Accepted)

Journal ref IEEE Robotics and Automation Letters 8.7 (2023): 4115-4122

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02989 2024-12-30 cs.RO cs.AI 68%

Learning Semantic Traversability with Egocentric Video and Automated Annotation Strategy

Yunho Kim, Jeong Hyun Lee, Choongin Lee, Juhyeok Mun, Donghoon Youm, Jeongsoo Park, Jemin Hwangbo

专题命中 机器人数据与评测 :navigation(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.AI

Comments Accepted to IEEE Robotics and Automation Letters (RA-L) 2024, First two authors contributed equally

Journal ref IEEE Robotics and Automation Letters (Volume: 9, Issue: 11, November 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10726 2024-09-12 cs.CV cs.RO 68%

Few-Shot Panoptic Segmentation With Foundation Models

Markus Käppeler, Kürsat Petek, Niclas Vödisch, Wolfram Burgard, Abhinav Valada

专题命中 机器人数据与评测 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.CV

Comments Accepted for "IEEE International Conference on Robotics and Automation (ICRA) 2024"

Journal ref IEEE International Conference on Robotics and Automation, 2024, pp. 7718-7724

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.10147 2024-09-12 cs.RO cs.CV 68%

CoDEPS: Online Continual Learning for Depth Estimation and Panoptic Segmentation

Niclas Vödisch, Kürsat Petek, Wolfram Burgard, Abhinav Valada

专题命中 机器人数据与评测 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.CV

Comments Accepted for "Robotics: Science and Systems (RSS) 2023"

Journal ref Robotics: Science and Systems, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18240 2024-07-26 cs.RO cs.CV 68%

CodedVO: Coded Visual Odometry

Sachin Shah, Naitri Rajyaguru, Chahat Deep Singh, Christopher Metzler, Yiannis Aloimonos

专题命中 机器人数据与评测 :navigation(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.CV

Comments 7 pages, 4 figures, IEEE ROBOTICS AND AUTOMATION LETTERS

Journal ref IEEE ROBOTICS AND AUTOMATION LETTERS, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.11543 2024-03-05 cs.CV cs.RO 68%

KVN: Keypoints Voting Network with Differentiable RANSAC for Stereo Pose Estimation

Ivano Donadi, Alberto Pretto

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.RO、cs.CV

Comments Published in IEEE Robotics and Automation Letters

Journal ref IEEE Robotics and Automation Letters, vol. 9, no. 4, pp. 3498-3505, April 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16378 2023-11-29 cs.RO cs.AI 68%

Sim-Suction: Learning a Suction Grasp Policy for Cluttered Environments Using a Synthetic Benchmark

Juncheng Li, David J. Cappelleri

专题命中 机器人数据与评测 :manipulation(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.AI

Comments IEEE Transactions on Robotics

Journal ref IEEE Transactions on Robotics (2023) 1-16

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.13629 2023-09-28 cs.RO cs.AI cs.MA 68%

Estimation of continuous environments by robot swarms: Correlated networks and decision-making

Mohsen Raoufi, Pawel Romanczuk, Heiko Hamann

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.RO、cs.AI

Comments \c{opyright} Accepted at IEEE/International Conference on Robotics and Automation (ICRA) 2023, 7 pages, 7 figures

Journal ref 2023 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.08054 2023-02-28 cs.RO cs.CV 68%

Pose Estimation for Robot Manipulators via Keypoint Optimization and Sim-to-Real Transfer

Jingpei Lu, Florian Richter, Michael Yip

专题命中 机器人数据与评测 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.CV

Comments 8 pages, 9 figures. Accepted to IEEE Robotics and Automation Letters January, 2022

Journal ref in IEEE Robotics and Automation Letters, vol. 7, no. 2, pp. 4622-4629, April 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10542 2025-12-29 cs.RO 68%

AORRTC: Almost-Surely Asymptotically Optimal Planning with RRT-Connect

AORRTC: 几乎确定性渐进最优规划与RRT-Connect

Tyler Wilson, Wil Thomason, Zachary Kingston, Jonathan Gammell

专题命中 机器人数据与评测 :robotic(abstract,comments);robotics(comments,journal_ref);分类 cs.RO

AI总结 AORRTC通过扩展RRT-Connect实现几乎确定性渐进最优规划,以高效且可靠的方式解决高自由度机器人运动规划问题。

Comments IEEE Robotics and Automation Letters (RA-L). 8 pages, 4 figures, 1 table. A video of AORRTC can be found at https://www.youtube.com/watch?v=j1itxP3KuiM . Information on the implementation of AORRTC is available at https://robotic-esp.com/code/aorrtc/

Journal ref IEEE Robotics and Automation Letters, vol. 10 num. 12, (2025). Pages 13375-13382

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24042 2026-08-26 cs.RO cs.AI cs.LG 新提交 67%

Hierarchical Skill Retrieval for Data-Efficient Adaptation of Vision-Language-Action Models

用于视觉-语言-动作模型数据高效适配的分层技能检索

Haoran Hao, Shahram Najam Syed, Jeff Schneider, Jeffrey Ichnowski

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 针对视觉-语言-动作模型在有限演示下适配性能下降的问题,提出分层技能检索框架,结合子任务语言检索与行为特征重排序,在LIBERO基准及真实机器人任务上提升平均成功率10.3%和21.3%。

Comments Project Page: https://hoar012.github.io/HSR-Project

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15410 2026-08-18 cs.DC cs.AI cs.CV cs.RO cs.SY eess.SY 新提交 67%

FloodReasonBench: Benchmarking VLM Reasoning Segmentation for Embodied Flood Response at the Edge

FloodReasonBench:面向边缘端具身洪水响应的VLM推理分割基准

Rajat Bhattacharjya, Yoomee Jung, Minwoo Kim, Sing-Yao Wu, Eli Bozorgzadeh, Nalini Venkatasubramanian, Nikil Dutt

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 FloodReasonBench针对边缘端具身洪水响应,构建专用数据集并刻画推理分割流水线的性能权衡,为资源受限场景提供任务与系统层面的基准支持。

Comments Paper is currently under review. The code and dataset will be made public upon acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12407 2026-08-18 cs.RO cs.CV cs.LG 版本更新 67%

MiDAS: A Multimodal Data Acquisition System and Dataset for Robot-Assisted Minimally Invasive Surgery

MiDAS:一种用于机器人辅助微创手术的多模态数据采集系统和数据集

Keshara Weerasinghe, Seyed Hamid Reza Roodabeh, Andrew Hawkins, Zhaomeng Zhang, Zachary Schrader, Homa Alemzadeh

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 MiDAS是一种开源多模态数据采集系统,能够实现机器人辅助微创手术的非侵入式数据采集,并发布首个高保真仿真模型的缝合任务数据集。

Comments 29 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12358 2026-08-13 cs.CV cs.AI cs.RO 67%

From Prompts to Pavement: LMMs-based Agentic Behavior-Tree Generation Framework for Autonomous Vehicles

从提示到道路:基于大语言模型的代理行为树生成框架用于自动驾驶车辆

Omar Y. Goba, Ahmed Y. Gado, Catherine M. Elias, Ahmed Hussein

机构 * Computer Science & Engineering Department, German University in Cairo (GUC), Egypt(德国亚历山大·冯·洪堡大学(开罗分校)计算机科学与工程系,埃及) C-DRiVeS Lab: Cognitive Driving Research in Vehicular Systems, Cairo, Egypt(认知驾驶系统实验室(车辆系统中的认知驾驶研究),开罗,埃及) IAV GmbH, Berlin, Germany(IAV GmbH,柏林,德国)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出了一种基于大语言模型和多模态视觉模型的代理行为树生成框架,用于自动驾驶车辆在复杂环境中自适应导航。该框架通过链式符号提示评估场景关键性,通过上下文学习构建高层子目标,并通过生成器合成可执行的BT子树,实现了在CARLA+Nav2模拟中对突发障碍物(如道路堵塞)的成功绕行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06191 2026-08-12 cs.RO cs.CV cs.LG 版本更新 67%

Learning in ImaginationLand: Omnidirectional Policies through 3D Generative Models (OP-Gen)

在ImaginationLand中学习:通过3D生成模型(OP-Gen)实现全向策略

Yifei Ren, Edward Johns

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 该研究提出用3D生成模型(OP-Gen)从单个真实演示扩充数据集,学习全向策略,可减少所需演示数,在多任务上性能优于基线方法。

Comments Project webpage with robot videos: https://www.robot-learning.uk/op-gen

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10168 2026-08-11 cs.CV cs.AI cs.RO 版本更新 67%

RAG-3DSG: Enhancing 3D Scene Graphs with Re-Shot Guided Retrieval-Augmented Generation

RAG-3DSG: 通过重拍引导的检索增强生成增强3D场景图

Yue Chang, Rufeng Chen, Zhaofan Zhang, Yi Chen, Yifan Tian, Sihong Xie

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 RAG-3DSG通过重拍引导的不确定性估计缓解3D场景图中的语义不一致问题,利用对象级检索增强生成方法提升机器人任务中的场景表示可靠性。

Comments Accepted by ECCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04765 2026-08-06 cs.RO cs.AI cs.CV 新提交 67%

Explicit Language Memory for Long-Horizon Planning in Vision-Language-Action Models

用于视觉-语言-动作模型长程规划的显式语言记忆

Houze Xu, Jizhong Li, Ziyi Ye

机构 * Fudan University(复旦大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究针对视觉-语言-动作模型长程规划的挑战,提出带显式语言记忆模块的分层架构,经仿真与实机实验验证,可提升复杂长程任务的成功率、鲁棒性与决策可解释性。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04121 2026-08-06 cs.RO cs.AI cs.CV 新提交 67%

Interpretable Fuzzy Inference for UAV Target Tracking Using Bounding-Box Geometry

基于边界框几何的无人机目标跟踪可解释模糊推理

Reza Ahmari, Ahmad Mohammadi, Vahid Hemmati, Nicholas Edmond, Hossein Z. Saghazadeh, Olusola Odeyomi, Parham Kebria, Abdollah Homaifar

机构 * North Carolina A&T State University(北卡罗来纳农工州立大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究针对无人机视觉制导的偏航角估计难题,提出基于YOLO边界框特征的可解释模糊推理框架,经实验验证其精度高、数据效率高且计算轻量,适用于实时无人机制导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20853 2026-08-06 cs.CV cs.AI cs.LG eess.IV 版本更新 67%

MODEST: Multi-Optics Depth-of-Field Stereo Dataset

MODEST:多光学深度景深立体数据集

Nisarg K. Trivedi, Vinayaka A. Belludi, Li-Yun Wang

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出首个高分辨率立体DSLR数据集,涵盖18000张图像,系统变化焦距和光圈,用于研究单目和立体深度估计及景深渲染等任务。

Comments Website, dataset and software tools now available for purely non-commercial, academic research purposes. Significant new contributions. Project page: https://modest-dataset.netlify.app/ Huggingface: https://huggingface.co/datasets/independent-vision-lab/MODEST

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14833 2026-08-06 cs.RO cs.AI cs.LG 版本更新 67%

Curiosity-Diffuser: Curiosity Guide Diffusion Models for Reliability

Curiosity-Diffuser:引导扩散模型提升可靠性的好奇心机制

Zihao Liu, Xing Liu, Yuhang Dong, Haitao Chang, Zhengxiong Liu, Panfeng Huang

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 针对机器人神经网络模型不稳定的问题,提出Curiosity-Diffuser方法,结合RND好奇心模块与分类器引导扩散提升策略可靠性,经仿真与真实实验验证有效

Comments Accepted for publication in Machine Intelligence Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03496 2026-08-05 cs.RO cs.AI cs.CV cs.SY eess.SY 新提交 67%

Principles of Robot Autonomy

机器人自主原则

Daniele Gammelli, Joseph Lorenzetti, Katie Luo, Gioele Zardini, Marco Pavone

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本书基于斯坦福数十年教学经验,构建现代自主栈核心要素,衔接经典机器人学与物理AI,配套Jupyter笔记本与练习,为自主系统相关人员提供实用基础资源。

Comments 531 pages. Pre-publication version of a book forthcoming from Cambridge University Press, posted with the permission of the publisher

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01049 2026-08-04 cs.AI cs.CV cs.LG 新提交 67%

FactorJEPA: Factorizing Monolithic Futures into Layout-Agent-Interaction Channels for Crowded and Chaotic Global South Urban Worlds

FactorJEPA:将整体未来分解为布局-智能体-交互通道以应对拥挤混乱的全球南方城市场景

Kapil Wanaskar, Gaytri Jena, Aman Chadha, Vinija Jain, Vasu Sharma, Amitava Das

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 针对全球南方拥挤混乱的城市场景,该研究构建了首个大规模数据集DENSEWORLD-115k,并提出FactorJEPA模型,通过分解结构提升JEPA性能,相关结果在不同主干网络上具有一致性。

Comments 42 pages. Independent preprint. Dataset: https://huggingface.co/datasets/anonymousML123/denseworld-115k ; checkpoints: https://huggingface.co/datasets/anonymousML123/factorjepa-outputs

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26055 2026-07-29 cs.RO cs.AI cs.LG 新提交 67%

$π\mathbf{R}^2$: Reactive Real-time Flow Policies

$π\mathbf{R}^2$:反应式实时流策略

Sungjae Park, Shubham Tulsiani

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究通用操作策略反应性和实时性问题,提出$\pi\mathbf{R}^2$方法,将条件分快速和慢速通道,采用延迟自适应流调度,能在保留大型主干等的同时,让策略实时反应并提高成功率。

Comments Preprint(20 pages). Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21522 2026-07-24 cs.RO cs.AI cs.CL cs.CV 新提交 67%

GS-Agent: Creating 4D Physical Worlds With Generative Simulation

GS-Agent:通过生成式模拟创建4D物理世界

Hongxin Zhang, Chunru Lin, Junyan Li, Zhou Xian, Tsun-Hsuan Wang, Chuang Gan

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Genesis AI(创世纪人工智能公司)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 研究旨在从自然语言描述创建4D物理世界。核心方法是提出GS-Agent这一端到端多智能体框架,分解任务并让多智能体与物理引擎协作。主要贡献是能有效转换自然语言为物理合理的4D世界,实现相机和灯光控制,为新范式奠基。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21488 2026-07-24 cs.LG cs.AI cs.MA cs.RO 新提交 67%

Compact Latent Coordination for Autonomous Vehicles at Unsignalized Intersections

无信号交叉口自动驾驶车辆的紧凑潜在协调

Gil Lifshits, Igal Bilik, Gilad Katz

机构 * Ben-Gurion University of the Negev(内盖夫本古里安大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 针对无信号交叉口自动驾驶车辆协调难题提出MAPS分层DRL架构,主智能体生成编码全局策略的原型计划,工作智能体结合局部观测执行控制。实验表明MAPS能实现无碰撞导航、减少行驶时间,且原型计划泛化能力强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20932 2026-07-22 cs.CR cs.AI cs.CV cs.RO 67%

An Experimental Study of Trojan Vulnerabilities in UAV Autonomous Landing

无人机自主降落中木马漏洞的实验研究

Reza Ahmari, Ahmad Mohammadi, Vahid Hemmati, Mohammed Mynuddin, Mahmoud Nabil Mahmoud, Parham Kebria, Abdollah Homaifar, Mehrdad Saif

机构 * Department of Electrical and Computer Engineering at North Carolina A&T State University(北卡罗来纳A&T州立大学电气与计算机工程系) University of Alabama(阿拉巴马大学) Department of Electrical and Computer Engineering, Windsor University(温莎大学电气与计算机工程系)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本研究通过实验揭示了无人机自主降落系统中木马攻击的漏洞,展示了攻击对模型准确性的严重影响,并提出了评估框架以识别受感染模型。

Comments 6 pages

Journal ref 2025 IEEE International Conference on Systems, Man, and Cybernetics (SMC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15868 2026-07-20 cs.CV cs.AI cs.GR cs.HC cs.RO 新提交 67%

EgoExoMoCap: Distributed Ego-Exo Human Motion Capture

EgoExoMoCap:分布式自我-外部人体运动捕捉

Jiaxi Jiang, Bharat Lal Bhatnagar, Nan Yang, Lingni Ma, Sebastian Starke, Robin Kips, Nadine Bertsch, Christian Holz, Federica Bogo

机构 * Meta Reality Labs(元现实实验室) ETH Zürich(苏黎世联邦理工学院)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 针对头戴式设备人体运动捕捉,提出EgoExoMoCap分布式框架,联合自我与外部中心多模态信号,利用头部等跟踪信号及DINOv3特征,能在复杂场景中稳健重建运动,突破了两种范式孤立的局限。

Comments Accepted by ECCV 2026, Project page and code: https://siplab.org/projects/EgoExoMoCap

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11734 2026-07-20 cs.RO cs.CV cs.GR cs.LG 版本更新 67%

NeuralActuator: Neural Actuation Modeling for Robot Dynamics and External Force Perception

神经执行器:用于机器人动力学和外力感知的神经驱动建模

Zhiyang Dou, John U. Onyemelukwe, Hangxing Zhang, Heng Zhang, Minghao Guo, Yunsheng Tian, Michal Piotr Lipiec, Joshua Jacob, Chao Liu, Peter Yichen Chen, Yuri Ivanov, Wojciech Matusik

机构 * MIT(麻省理工学院) Amazon(亚马逊)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究针对低成本平台执行器动力学致模拟到现实误差问题,提出NeuralActuator模型,能联合预测多种内容,引入NAD数据集,通过可微模拟训练,经多平台实验验证其在电机状态估计等方面有应用价值。

Comments RSS 2026. Outstanding Systems Paper Award. Project Page: https://people.csail.mit.edu/frankzydou/projects/NeuralActuator/index.html Code: https://github.com/Frank-ZY-Dou/Dynamics-Modeling/tree/main/NeuralActuator

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08741 2026-07-10 cs.GR cs.CV cs.LG cs.RO 新提交 67%

ARDY: Autoregressive Diffusion with Hybrid Representation for Interactive Human Motion Generation

ARDY:用于交互式人体运动生成的具有混合表示的自回归扩散

Kaifeng Zhao, Mathis Petrovich, Haotian Zhang, Tingwu Wang, Siyu Tang, Davis Rempe

机构 * NVIDIA(英伟达) ETH Zürich(苏黎世联邦理工学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究旨在解决交互式应用中人体运动生成问题,提出ARDY框架,采用混合表示和两阶段自回归变压器去噪器,能通过在线文本提示和运动学约束实现高保真运动生成,经评估验证了有效性和实用性。

Comments ACM Transactions on Graphics (SIGGRAPH 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏