arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-08 至 2026-01-08 共收录 42 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 13 篇

2601.03782 2026-01-08 cs.RO cs.AI cs.CV 92%

PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation

PointWorld: 为真实世界机器人操作扩展3D世界模型

Wenlong Huang, Yu-Wei Chao, Arsalan Mousavian, Ming-Yu Liu, Dieter Fox, Kaichun Mo, Li Fei-Fei

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 PointWorld通过统一状态和动作的3D点流模型,实现了在真实世界中机器人操作的高效预测与控制,无需额外演示或训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20382 2026-01-08 cs.RO cs.AI cs.LG cs.SY eess.SY 85%

Physics-Driven Data Generation for Contact-Rich Manipulation via Trajectory Optimization

通过轨迹优化实现接触密集操作的物理驱动数据生成

Lujie Yang, H. J. Terry Suh, Tong Zhao, Bernhard Paus Graesdal, Tarik Kelestemur, Jiuguang Wang, Tao Pang, Russ Tedrake

机构 * Computer Science and Artificial Intelligence Laboratory (CSAIL), Massachusetts Institute of Technology(计算机科学与人工智能实验室(CSAIL),麻省理工学院) Robotics and AI Institute(机器人与人工智能研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本研究提出了一种结合物理仿真和轨迹优化的方法,通过生成多样化高质量数据集,提升接触密集操作任务的机器人性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04194 2026-01-08 cs.CV cs.GR cs.RO 73%

Choreographing a World of Dynamic Objects

编排动态物体的纷繁世界

Yanzhe Lyu, Chen Geng, Karthik Dharmarajan, Yunzhi Zhang, Hadi Alzayer, Shangzhe Wu, Jiajun Wu

机构 * Stanford University(斯坦福大学) University of Cambridge(剑桥大学) University of Maryland(马里兰大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出CHORD方法,通过蒸馏技术提取视频中隐藏的拉格朗日运动信息,实现通用动态物体生成,适用于多体4D动态生成和机器人操作策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03494 2026-01-08 quant-ph cond-mat.quant-gas 71%

Tailoring Dynamical Quantum Phase Transitions via Double-Mode Squeezing Manipulation

通过双模压缩操控定制动态量子相变

Kaiyuan Cao, Haodong Wang, Xiang-Ping Jiang, Shu chen, Jian Wang

专题命中 机器人操作 :manipulation(title)

AI总结 通过双模压缩操控初始态,实现对动态量子相变的定制,揭示纠缠饱和与普遍非解析动态的直接联系。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20411 2026-01-08 quant-ph 71%

Extensive manipulation of transition rates and substantial population inversion of rotating atoms inside a cavity

广泛操控跃迁率和旋转原子在腔体内的显著人口倒置

Yan Peng, Yuebing Zhou, Jiawei Hu, Hongwei Yu

专题命中 机器人操作 :manipulation(title)

AI总结 通过调节腔体共振和旋转频率,研究展示了旋转原子在腔体内的跃迁率操控及人口倒置,为量子应用提供了新方法。

Comments Main text: 6 pages, supplemental material: 5 pages, matching the published version

Journal ref Phys. Rev. Lett. 136, 013202 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22351 2026-01-08 cs.CV cs.AI 62%

VULCAN: Tool-Augmented Multi Agents for Iterative 3D Object Arrangement

VULCAN:工具增强的多智能体用于迭代3D物体排列

Zhengfei Kuang, Rui Lin, Long Zhao, Gordon Wetzstein, Saining Xie, Sanghyun Woo

机构 * Stanford University(斯坦福大学) Google(谷歌) New York University(纽约大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 VULCAN通过引入MCP API、视觉工具和多智能体框架,提升了3D物体排列任务中MLLMs的视觉接地能力与迭代处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09632 2026-01-08 cs.RO cs.CV 62%

Adaptive Anomaly Recovery for Telemanipulation: A Diffusion Model Approach to Vision-Based Tracking

适应性异常恢复用于远程操控:一种基于扩散模型的视觉跟踪方法

Haoyang Wang, Haoran Guo, Lingfeng Tao, Zhengxiong Li

机构 * Oklahoma State University(俄克拉荷马州立大学) University of Colorado Denver(科罗拉多大学丹佛分校) Kennesaw State University(凯斯威克州立大学)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于扩散模型的DET框架,通过帧差检测技术识别和分割视频流中的异常,利用扩散模型重建异常片段以提升远程操控在复杂视觉条件下的鲁棒性。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03392 2026-01-08 cs.CV cs.NE 57%

Better, But Not Sufficient: Testing Video ANNs Against Macaque IT Dynamics

更强大,但不足够:测试视频ANNs against Macaque IT动态

Matteo Dunnhofer, Christian Micheloni, Kohitij Kar

机构 * York University(约克大学) University of Udine(乌迪内大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本文通过比较自然视频与静态、递归和视频基于的ANN模型,发现视频模型在神经预测性上有所改进,但无法捕捉IT中表达的外观不变的时间计算,表明需要新的目标来编码生物时间统计和不变性。

Comments Extended Abstract at the 2nd Human-inspired Computer Vision workshop at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02110 2026-01-08 cs.AI 57%

Attractive Metadata Attack: Inducing LLM Agents to Invoke Malicious Tools

吸引性元数据攻击:诱导LLM代理调用恶意工具

Kanghua Mo, Li Hu, Yucheng Long, Zhihao Li

机构 * Cyberspace Institute of Advanced Technology, Guangzhou University(广州大学网络空间研究院) Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(香港理工大学电子与电气工程系)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究提出AMA攻击,通过操纵工具元数据诱导LLM代理调用恶意工具,揭示了系统性安全漏洞。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19655 2026-01-08 quant-ph 50%

Quantum Internet Architecture: unlocking Quantum-Native Routing via Quantum Addressing

量子互联网架构:通过量子寻址解锁量子原生路由

Marcello Caleffi, Angela Sara Cacciapuoti

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种基于量子寻址和纠缠定义控制器的量子互联网架构,实现了量子原生路由协议,通过紧凑路由表和纠缠拓扑结构实现可扩展的量子网络控制。

Comments This work has been funded by the European Union under the ERC grant QNattyNet, n.101169850 (https://qnattynet.quantuminternet.it)

Journal ref IEEE Transactions on Communications, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03588 2026-01-08 cs.HC 50%

AR Object Layout Method Using Miniature Room Generated from Depth Data

使用从深度数据生成的微型房间的AR布局方法

Keiichi Ihara, Ikkaku Kawaguchi

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出一种利用深度数据生成微型房间的AR布局方法,通过操控微型对象减少用户负担,提升AR布局效率。

Comments ICAT-EGVE 2022, 9 pages

Journal ref Proceedings of ICAT-EGVE 2022, pp. 35-43

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03524 2026-01-08 cond-mat.mtrl-sci 50%

Ir3Ge20: A 3n-Connected Cloverleaf-Shaped Supercluster

Ir3Ge20:一种3n连接的叶形超簇

Xue Wu, Wen-Shuai Dai, Lulu Li, Fangying Hao, Hong-Guang Xu, Wei-Jun Zheng, Jijun Zhao

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过实验和计算发现Ir3Ge20超簇,其叶形结构由三个IrGe12单元连接,具有D3h对称性和5n规则,展示出新的原子操控方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10180 2026-01-08 cs.HC 50%

ChartOptimiser: Task-driven Optimisation of Chart Designs

ChartOptimiser: 任务驱动的图表设计优化

Yao Wang, Jiarong Pan, Danqing Shi, Zhiming Hu, Antti Oulasvirta, Andreas Bulling

专题命中 机器人操作 :manipulation(abstract)

AI总结 ChartOptimiser通过贝叶斯优化提升图表设计的保真度、效率和有效性,为非专家用户生成优于LLM的高质量图表。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 9 篇

2601.03520 2026-01-08 cs.NE cs.AI cs.RO 84%

A Reinforcement Learning-Based Model for Mapping and Goal-Directed Navigation Using Multiscale Place Fields

基于强化学习的多尺度场所场映射与目标导向导航模型

Bekarys Dukenbaev, Andrew Gerstenslager, Alexander Johnson, Ali A. Minai

机构 * Department of Computer Science, University of Cincinnati(计算机科学系,辛辛那提大学) Department of Electrical and Computer Engineering, University of Cincinnati(电气与计算机工程系,辛辛那提大学)

专题命中 具身导航 :navigation(title,abstract);robotics(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于强化学习的多尺度场所场模型,通过多尺度空间表示提升机器人在复杂环境中的导航效率与学习速度。

Comments 11 pages, 8 figures. Submitted to IEEE Transactions on Cognitive and Developmental Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03956 2026-01-08 cs.RO 83%

CoINS: Counterfactual Interactive Navigation via Skill-Aware VLM

基于技能感知的反事实交互导航:通过技能感知视觉语言模型

Kangjie Zhou, Zhejia Wen, Zhiyong Zhuo, Zike Yan, Pengying Wu, Ieng Hou U, Shuaiyang Li, Han Gao, Kang Ding, Wenhan Cao, Wei Pan, Chang Liu

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) College of Design and Engineering, National University Of Singapore(新加坡国立大学设计与工程学院) Department of Computer Science, The University of Manchester(曼彻斯特大学计算机科学系)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 CoINS通过整合技能感知推理与稳健执行,提升机器人在复杂环境中的交互导航能力。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25687 2026-01-08 cs.RO 83%

OmniNav: A Unified Framework for Prospective Exploration and Visual-Language Navigation

OmniNav:一个统一的框架,用于前瞻性探索和视觉-语言导航

Xinda Xue, Junjun Hu, Minghua Luo, Shichao Xie, Jintao Chen, Zixun Xie, Kuichen Quan, Wei Guo, Mu Xu, Zedong Chu

机构 * Alibaba Group(阿里巴巴集团) Peking University(北京大学)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 OmniNav通过统一框架实现多导航任务和前沿探索,提升机器人自主导航的精度与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03813 2026-01-08 cs.RO 79%

Integrating Sample Inheritance into Bayesian Optimization for Evolutionary Robotics

将样本继承整合到贝叶斯优化中用于进化机器人

K. Ege de Bruin, Kyrre Glette, Kai Olav Ellefsen

机构 * Department of Informatics, University of Oslo(信息学院,奥斯陆大学)

专题命中 具身导航 :robotics(title,abstract);分类 cs.RO

AI总结 本文提出利用样本继承提升贝叶斯优化在进化机器人中的性能,通过两种继承方式验证了其有效性,展示了低预算下的高效优化策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03579 2026-01-08 cs.CV 57%

SpatiaLoc: Leveraging Multi-Level Spatial Enhanced Descriptors for Cross-Modal Localization

SpatiaLoc: 借助多级空间增强描述符进行跨模态定位

Tianyi Shang, Pengjie Xu, Zhaojun Deng, Zhenyu Li, Zhicong Chen, Lijun Wu

机构 * Fuzhou University(福州大学) Shandong Academy of Sciences(山东省科学院) Qingdao University(青岛大学) Tongji University(同济大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 SpatiaLoc通过多级空间增强描述符提升跨模态定位性能,采用粗到细策略结合贝塞尔曲线和频率域建模,实现更精确的机器人定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05128 2026-01-08 eess.SP cs.AI 57%

GNSS Jammer Direction Finding in Dynamic Scenarios Using an Inertial-based Multi-Antenna System

利用惯性多天线系统在动态场景中实现GNSS干扰源定位

Lucas Heublein, Thorsten Nowak, Tobias Feigl, Jaspar Pahl, Felix Ott

机构 * 1 Fraunhofer Institute for Integrated Circuits IIS, 90411 Nürnberg, Germany 2 Diehl Defence GmbH \& Co. KG, 90552 Röthenbach an der Pegnitz, Germany

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文提出利用惯性多天线系统在动态场景中实现GNSS干扰源定位,通过融合IQ数据、FFT频谱图和22个AoA特征提升定位精度。

Comments 9 pages, 26 figures, 2 tables

Journal ref IEEE DGON Inertial Sensors and Applications (ISA), October 21-22 2025, Braunschweig, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04298 2026-01-08 cs.RO 57%

Real-time Sampling-based Model Predictive Control based on Reverse Kullback-Leibler Divergence and Its Adaptive Acceleration

基于反Kullback-Leibler散度的实时采样式模型预测控制及其自适应加速

Taisuke Kobayashi, Kota Fukumoto

机构 * Principles of Informatics Research Division(信息学原理研究部) National Institute of Informatics (NII)(国家信息研究所) Informatics Program(信息学项目) The Graduate University for Advanced Studies (SOKENDAI)(高级研究大学(SOKENDAI)) Division of Information Science(信息科学部)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本研究提出基于反Kullback-Leibler散度的实时采样式MPC方法,结合自适应加速技术,提升机器人系统任务解决能力与实时性能。

Comments 18 pages, 16 figures

Journal ref Advanced Intelligent Systems, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04111 2026-01-08 q-bio.NC cs.SY eess.SY nlin.AO 50%

Stigmergic optimal transport

群体最优运输的协同机制

Vishaal Krishnan, L. Mahadevan

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出了一种基于随机最优控制的协同运输理论框架,通过局部交互在异质环境中生成测地线轨迹,无需集中协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13000 2026-01-08 cs.HC 50%

Legitimizing, Developing, and Sustaining Feminist HCI in East Asia: Challenges and Opportunities

正当化、发展与维持东亚的女性主义人机交互:挑战与机遇

Runhua Zhang, Ruyuan Wan, Jiaqi Li, Daye Kang, Yigang Qin, Yijia Wang, Ziqi Pan, Tiffany Knearem, Huamin Qu, Xiaojuan Ma

专题命中 具身导航 :navigation(abstract)

AI总结 本文探讨东亚女性主义人机交互面临的挑战与机遇,提出通过聚会促进社区建设和方法论讨论,以正当化、发展和维持该领域。

Comments The proposal was accepted by CHI2026 meet-up track; and will be published in Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems (CHI EA '26)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 2 篇

2601.04035 2026-01-08 cs.AI 79%

MobileDreamer: Generative Sketch World Model for GUI Agent

MobileDreamer: 用于GUI代理的生成式草图世界模型

Yilin Cao, Yufeng Zhong, Zhixiong Zeng, Liming Zheng, Jing Huang, Haibo Qiu, Peng Shi, Wenji Mao, Wan Guanglu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Meituan(美团)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 MobileDreamer通过生成式草图世界模型和rollout想象策略,提升GUI代理在长周期任务中的决策能力,任务成功率提升5.25%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03517 2026-01-08 cs.CV 79%

Semantic Belief-State World Model for 3D Human Motion Prediction

语义信念状态世界模型用于3D人体运动预测

Sarim Chaudhry

机构 * Department of Computer Science, Purdue University(计算机科学系,普渡大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本文提出语义信念状态世界模型,通过将人体视为世界模型状态空间的一部分,实现更稳定的长期运动预测与模拟。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 2 篇

2601.03449 2026-01-08 cs.RO 70%

FIRE-VLM: A Vision-Language-Driven Reinforcement Learning Framework for UAV Wildfire Tracking in a Physics-Grounded Fire Digital Twin

FIRE-VLM:一种基于视觉-语言驱动的强化学习框架,用于在物理基础火灾数字孪生中无人机火灾跟踪

Chris Webb, Mobin Habibpour, Mayamin Hamid Raha, Ali Reza Tavakkoli, Janice Coen, Fatemeh Afghah

机构 * Clemson University(克莱姆森大学) University of Nevada, Reno(内华达大学拉斯维加斯分校) NSF NCAR(国家科学基金会NCAR)

专题命中 模仿学习与强化学习 :embodied agent(abstract);navigation(abstract);分类 cs.RO

AI总结 FIRE-VLM是一种基于视觉-语言模型的强化学习框架,用于在物理基础火灾数字孪生中实现无人机火灾跟踪,通过结合物理术语与VLM语义的奖励设计,提升了火灾检测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01206 2026-01-08 cs.RO 57%

Action Tokenizer Matters in In-Context Imitation Learning

动作分词器在上下文模仿学习中的重要性

An Dinh Vuong, Minh Nhat Vu, Dong An, Ian Reid

机构 * Department of Computer Vision, Mohammed bin Zayed University of Artificial Intelligence(计算机视觉系,穆罕默德·本·扎耶德人工智能大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

AI总结 本文提出LipVQ-VAE,通过强制潜在动作空间的Lipschitz条件,提升上下文模仿学习中动作的稳定性和平滑性。

Comments IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2509.19486 2026-01-08 cs.RO cs.DC 70%

Supercomputing for High-speed Avoidance and Reactive Planning in Robots

为机器人提供高速避障与反应规划的超级计算

Kieran S. Lachmansingh, José R. González-Estrada, Jacob Chisholm, Ryan E. Grant, Matthew K. X. J. Pan

机构 * Ingenuity Labs Research Institute(创新实验室研究机构) Queen’s University(女王大学)

专题命中 人机交互与遥操作 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 SHARP通过HPC实现机器人毫秒级避障与反应规划,展示高并发计算在实时机器人中的可行性及混合控制架构的应用。

Comments Error in the graph size calculation, recalculated and resubmitted

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 11 篇

2601.04137 2026-01-08 cs.RO cs.AI cs.CV 88%

Wow, wo, val! A Comprehensive Embodied World Model Evaluation Turing Test

哇,哇,val!一个综合的具身世界模型评估图灵测试

Chun-Kai Fan, Xiaowei Chi, Xiaozhu Ju, Hao Li, Yong Bao, Yu-Kai Wang, Lizhang Chen, Zhiyuan Jiang, Kuangzhi Ge, Ying Li, Weishi Mi, Qingpo Wuwu, Peidong Jia, Yulin Luo, Kevin Zhang, Zhiyuan Qin, Yong Dai, Sirui Han, Yike Guo, Shanghang Zhang, Jian Tang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) Beijing Innovation Center of Humanoid Robotics(人形机器人创新中心) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 机器人数据与评测 :world model(title,abstract);embodied AI(abstract);embodied agent(abstract);manipulation(abstract)

AI总结 本文提出Wow-wo-val基准测试,评估视频基础模型在具身人工智能中的生成能力,发现其在长期规划和物理一致性上表现有限,揭示了现实世界与生成视频之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03590 2026-01-08 cs.CV cs.AI 82%

Can LLMs See Without Pixels? Benchmarking Spatial Intelligence from Textual Descriptions

大语言模型能否通过像素感知空间智能?基于文本描述的空间智能基准测试

Zhongbin Guo, Zhen Yang, Yushan Li, Xinyue Zhang, Wenyu Gao, Jiacheng Wang, Chengzhi Li, Xiangrui Liu, Ping Jian

机构 * School of Computer Science & Technology, Beijing Institute of Technology(计算机科学与技术学院,北京理工大学)

专题命中 机器人数据与评测 :embodied agent(abstract);manipulation(abstract);navigation(abstract);robotic(abstract)

AI总结 SiT-Bench通过文本描述评估大语言模型的空间智能,揭示其在全局一致性方面的不足,并表明显式空间推理可提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03562 2026-01-08 cs.RO 79%

From Score to Sound: An End-to-End MIDI-to-Motion Pipeline for Robotic Cello Performance

从音符到声音:一种端到端的MIDI到机器人动作管道用于机器人大提琴表演

Samantha Sudhoff, Pranesh Velmurugan, Jiashu Liu, Vincent Zhao, Yung-Hsiang Lu, Kristen Yeon-Ji Yun

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种端到端的MIDI到机器人动作管道,使机器人能够无需运动捕捉实现人类般的音乐表演,并通过音乐图灵测试验证其效果。

详情

展开后加载摘要…

URL PDF HTML 收藏