arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-21 至 2026-01-21 共收录 126 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 44 篇

2601.12798 2026-01-21 cs.CV 57%

PhyG-MoE: A Physics-Guided Mixture-of-Experts Framework for Energy-Efficient GNSS Interference Recognition

PhyG-MoE:一种基于物理指导的专家混合框架用于高效GNSS干扰识别

Zhihan Zeng, Yang Zhao, Kaihe Wang, Dusit Niyato, Yue Xiu, Lu Chen, Zhongpei Zhang, Ning Wei

机构 * National Key Laboratory of Wireless Communications, University of Electronic Science and Technology of China(中国电子科学与技术大学无线通信国家重点实验室) University of Electronic Science and Technology of China(中国电子科学与技术大学) Nanyang Technological University(南洋理工大学) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) Anhui Science and Technology University(安徽科学技术大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 PhyG-MoE通过动态对齐模型容量与信号复杂性,提升GNSS干扰识别的能效与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12791 2026-01-21 cs.CV 57%

SKANet: A Cognitive Dual-Stream Framework with Adaptive Modality Fusion for Robust Compound GNSS Interference Classification

SKANet:一种具有自适应模态融合的认知双流框架,用于鲁棒的复合GNSS干扰分类

Zhihan Zeng, Yang Zhao, Kaihe Wang, Dusit Niyato, Hongyuan Shu, Junchu Zhao, Yanjun Huang, Yue Xiu, Zhongpei Zhang, Ning Wei

机构 * National Key Laboratory of Wireless Communications, University of Electronic Science and Technology of China(国家无线通信重点实验室,电子科技大学) Nanyang Technological University(南洋理工大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) University of Electronic Science and Technology of China(电子科技大学) Shanghai Aerospace Electronic Technology Institute(上海航天电子技术研究所) Shanghai Key Laboratory of Collaborative Computing in Spacial Heterogeneous Networks (CCSN)(上海空间异构网络协同计算重点实验室(CCSN)) Shanghai Xiaoyuan Innovation center(上海小元创新中心)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 SKANet通过双流架构和自适应模态融合,实现对复合GNSS干扰的高效鲁棒分类。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12479 2026-01-21 cs.RO 57%

Language-Based Swarm Perception: Decentralized Person Re-Identification via Natural Language Descriptions

基于语言的群体感知:通过自然语言描述实现去中心化的人员重识别

Miquel Kegeleirs, Lorenzo Garattoni, Gianpiero Francesca, Mauro Birattari

机构 * IRIDIA, Université libre de Bruxelles(IRIDIA,布鲁塞尔自由大学) Toyota Motor Europe(丰田欧洲 motors)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种基于自然语言的去中心化人员重识别方法,通过视觉-语言模型生成文本描述,实现群体协作识别与可解释性提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12169 2026-01-21 cs.RO 57%

Learning Legged MPC with Smooth Neural Surrogates

学习具有平滑神经代理的腿式MPC

Samuel A. Moore, Easop Lee, Boyuan Chen

机构 * Department of Mechanical Engineering and Materials Science, Duke University(机械工程与材料科学系,杜克大学) Department of Electrical and Computer Engineering, Duke University(电气与计算机工程系,杜克大学) Department of Computer Science, Duke University(计算机科学系,杜克大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出平滑神经代理以提升腿式MPC的可靠性与鲁棒性,通过引入可调平滑度的神经网络,有效解决动态学习中的非光滑性和误差问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12143 2026-01-21 cs.RO 57%

Neural Process-Based Reactive Controller for Autonomous Racing

基于神经过程的反应式控制器用于自动驾驶赛车

Devin Hunter, Chinwendu Enyioha

机构 * Department of Electrical Engineering University of Central Florida(电气工程系 佛罗里达中央大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出基于神经过程的反应式控制器,结合物理指导模型和控制屏障函数,实现自动驾驶赛车中的安全高效控制。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12141 2026-01-21 cs.AI 57%

TIDE: A Trace-Informed Depth-First Exploration for Planning with Temporally Extended Goals

TIDE: 一种基于轨迹的深度优先探索用于具有时间扩展目标的规划

Yuliia Suprun, Khen Elimelech, Lydia E. Kavraki, Moshe Y. Vardi

专题命中 具身导航 :robotics(abstract);分类 cs.AI

AI总结 TIDE通过分解时间问题为可达-避免子问题,结合成本驱动启发式方法,提升时间扩展目标规划的效率和完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11983 2026-01-21 cs.CV 57%

An AI-IoT Based Smart Wheelchair with Gesture-Controlled Mobility, Deep Learning-Based Obstacle Detection, Multi-Sensor Health Monitoring, and Emergency Alert System

基于AI-IoT的智能轮椅:具有手势控制移动、深度学习障碍检测、多传感器健康监测和紧急警报系统

Md. Asiful Islam, Abdul Hasib, Tousif Mahmud Emon, Khandaker Tabin Hasan, A. S. M. Ahsanul Sarkar Akib

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Military Institute of Science and Technology(军事科学与技术学院) University of Frontier Technology(前沿技术大学) American International University-Bangladesh(美国国际大学-孟加拉国) Robo Tech Valley(机器人技术谷)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文提出了一种基于AI-IoT的智能轮椅系统,结合手势控制、深度学习障碍检测、多传感器健康监测和紧急警报,实现安全导航与健康监测的集成解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11775 2026-01-21 cond-mat.mtrl-sci cs.LG quant-ph 57%

Quantum Kernel Machine Learning for Autonomous Materials Science

量子核机学习在自主材料科学中的应用

Felix Adams, Daiwei Zhu, David W. Steuerman, A. Gilad Kusne, Ichiro Takeuchi

机构 * Department of Materials Science and Engineering, University of Maryland, College Park, Maryland, 20742, USA(材料科学与工程系,马里兰大学,学院 park,马里兰,20742,美国) IonQ, 4505 Campus Dr, College Park, Maryland, 20740, USA(IonQ,4505校园大道,学院 park,马里兰,20740,美国) Materials Measurement Science Division, National Institute of Standards and Technology, Gaithersburg, Maryland, 20899, USA(材料测量科学 division,国家标准与技术研究院,盖瑟斯堡,马里兰,20899,美国) Quantum Materials Center, University of Maryland, College Park, Maryland, 20742, USA(量子材料中心,马里兰大学,学院 park,马里兰,20742,美国)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本研究比较了量子和经典核在自主材料科学中用于连续相空间导航的实用性,验证了量子核模型在材料发现中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11662 2026-01-21 cs.CV 57%

LTV-YOLO: A Lightweight Thermal Object Detector for Young Pedestrians in Adverse Conditions

LTV-YOLO:一种轻量级热成像行人检测器,用于恶劣条件下的年轻行人

Abdullah Jirjees, Ryan Myers, Muhammad Haris Ikram, Mohamed H. Zaki

机构 * Automotive and Surface Transportation National Research Council Canada(交通运输国家研究院加拿大) Department of Civil and Environmental Engineering University of Western Ontario(土木与环境工程系温哥华大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 LTV-YOLO通过热成像和轻量级设计,提升恶劣条件下年轻行人检测的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13918 2026-01-21 cs.CL 50%

AgentEHR: Advancing Autonomous Clinical Decision-Making via Retrospective Summarization

AgentEHR: 通过回顾性总结推进自主临床决策制定

Yusheng Liao, Chuan Xuan, Yutong Cai, Lina Yang, Zhe Chen, Yanfeng Wang, Yu Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 具身导航 :navigation(abstract)

AI总结 AgentEHR通过RetroSum框架提升自主临床决策制定,减少交互错误并提升性能

Comments 37 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13858 2026-01-21 cs.HC 50%

Designing Drone Interfaces to Assist Pedestrians Crossing Non-Signalised Roads

设计无人机界面以协助行人穿越无信号灯道路

Guixiang Zhang, Yiyuan Wang, Marius Hoggenmueller

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出利用无人机界面协助行人安全穿越无信号灯道路,通过实时交通数据监测和安全提示系统提升行人安全与效率。

Journal ref OZCHI '25: Proceedings of the 37th Australian Conference on Human-Computer Interaction (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13680 2026-01-21 eess.SP 50%

TSN-IoT: A Two-Stage NOMA-Enabled Framework for Prioritized Traffic Handling in Dense IoT Networks

TSN-IoT: 一种基于NOMA的两级框架,用于密集物联网网络中优先级流量处理

Shama Siddiqui, Anwar Ahmed Khan, Nicola Marchetti

专题命中 具身导航 :navigation(abstract)

AI总结 TSN-IoT是一种基于NOMA的两级框架,用于解决密集物联网网络中优先级流量处理问题,通过高效同步和并行传输提升通信性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13336 2026-01-21 physics.optics 50%

Holographic Mapping of Orbital Angular Momentum Using a Terahertz Diffractive Optical Neural Network

使用太赫兹衍射光学神经网络进行轨道角动量的全息映射

Wei Jia, Miguel Gomez, Steve Blair, Berardi Sensale-Rodriguez

专题命中 具身导航 :manipulation(abstract)

AI总结 本研究提出了一种基于太赫兹衍射光学神经网络的OAM识别方法,通过空间分离实现对多个OAM模式的高效识别与映射。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13066 2026-01-21 eess.SY cs.SY 50%

Stability of Information-Based Routing in Dynamic Transportation Networks

动态交通网络中基于信息的路由稳定性

Shaya Garjani, Ashish Cherukuri, Bayu Jayawardhana, Nima Monshizadeh

专题命中 具身导航 :navigation(abstract)

AI总结 本文研究动态交通网络中基于信息的路由稳定性,提出一种能保证均衡存在并保持稳定性的信息信号设计方法,通过数值案例验证该方法在减少旅行时间的同时维持信息可信度的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13216 2026-01-21 math.OC 50%

Integrating ethical, societal and environmental issues into algorithm design courses

将伦理、社会和环境问题融入算法设计课程中

Odile Bellenguez, Nadia Brauner, Christine Solnon, Alexis Tsoukias

专题命中 具身导航 :navigation(abstract)

AI总结 本文探讨如何在算法设计课程中整合伦理、社会和环境问题,通过道路导航软件案例,结合技术考虑与广泛的社会影响,提供教学资源和讨论结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24195 2026-01-21 cs.HC cs.CL 50%

WikiGap: Promoting Epistemic Equity by Surfacing Knowledge Gaps Between English Wikipedia and other Language Editions

WikiGap: 通过揭示英语维基百科与其他语言版本之间的知识空白促进知识公平

Zining Wang, Yuxuan Zhang, Dongwook Yoon, Nicholas Vincent, Farhan Samir, Vered Shwartz

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能向量研究所) Simon Fraser University(西蒙弗雷泽大学) University of Toronto(多伦多大学)

专题命中 具身导航 :navigation(abstract)

AI总结 WikiGap通过揭示英语维基百科与其他语言版本之间的知识空白,提升不同语言版本之间的知识公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00297 2026-01-21 eess.SY cs.SY 50%

Directional excitability in Hilbert spaces

希尔伯特空间中的方向可激发性

Gustave Bainier, Alessio Franci

专题命中 具身导航 :navigation(abstract)

AI总结 该研究提出了一种在希尔伯特空间中具有方向可激发性的广义模型,通过状态依赖的尖峰方向增强了动态表达和控制能力,适用于高维和无限维空间的可激发控制任务。

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 7 篇

2504.12636 2026-01-21 cs.RO 88%

A0: An Affordance-Aware Hierarchical Model for General Robotic Manipulation

A0:一种面向通用机器人操作的感知意识分层模型

Rongtao Xu, Jian Zhang, Minghao Guo, Youpeng Wen, Haoting Yang, Min Lin, Jianzheng Huang, Zhe Li, Kaidong Zhang, Liqiong Wang, Yuxuan Kuang, Meng Cao, Feng Zheng, Xiaodan Liang

机构 * MBZUAI SYSU(南方科技大学) SUSTech(华南理工大学) Spatialtemporal AI(时空人工智能) CMU(卡内基梅隆大学)

专题命中 具身推理 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 A0提出了一种分层的可及性感知扩散模型,通过分解操作任务为高层空间可及性理解和低层动作执行,提升机器人操作的效率和灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05230 2026-01-21 cs.AI cs.CV 86%

Learning Latent Action World Models In The Wild

在真实世界中学习潜在动作世界模型

Quentin Garrido, Tushar Nagarajan, Basile Terver, Nicolas Ballas, Yann LeCun, Michael Rabbat

机构 * FAIR at Meta(Meta旗下的FAIR) Inria(法国国家信息与自动化研究所)

专题命中 具身推理 :world model(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本研究提出在真实世界视频中学习潜在动作世界模型,通过连续受限的潜在动作捕捉复杂动作,解决了环境噪声和缺乏共同具象的挑战,实现了与动作条件基线相似的规划任务性能。

Comments 37 pages, 25 figures; updated references and experimental details

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12939 2026-01-21 cs.RO cs.AI eess.SP 84%

Active Inference-Driven World Modeling for Adaptive UAV Swarm Trajectory Design

基于主动推断的世界建模用于自适应无人机蜂群轨迹设计

Kaleem Arshid, Ali Krayani, Lucio Marcenaro, David Martin Gomez, Carlo Regazzoni

机构 * University of Genoa(热那亚大学) Carlos III University Madrid(马德里卡洛斯三世大学)

专题命中 具身推理 :world model(title,abstract);navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出基于主动推断的世界建模框架,用于自适应无人机蜂群轨迹设计,通过整合概率推理和自我学习实现动态环境下的适应性响应。

Comments This paper has been accepted for presentation at the 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (IEEE ICASSP 2026) Workshop: 'Multi-Modal Signal Processing and AI for Communications and Sensing in 6G and Beyond (MuSiC-6GB)'

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13247 2026-01-21 cs.CL cs.AI cs.CV cs.LG cs.MM 82%

Aligning Agentic World Models via Knowledgeable Experience Learning

通过知识性经验学习对齐代理世界模型

Baochang Ren, Yunzhi Yao, Rui Sun, Shuofei Qiao, Ningyu Zhang, Huajun Chen

机构 * Zhejiang University(浙江大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 WorldMind通过知识性经验学习对齐代理世界模型,解决物理模拟中的幻觉问题,实现跨环境的高效迁移。

Comments Ongoing work

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12538 2026-01-21 cs.AI cs.CL 70%

Agentic Reasoning for Large Language Models

大语言模型的代理推理

Tianxin Wei, Ting-Wei Li, Zhining Liu, Xuying Ning, Ze Yang, Jiaru Zou, Zhichen Zeng, Ruizhong Qiu, Xiao Lin, Dongqi Fu, Zihao Li, Mengting Ai, Duo Zhou, Wenxuan Bao, Yunzhe Li, Gaotang Li, Cheng Qian, Yu Wang, Xiangru Tang, Yin Xiao, Liri Fang, Hui Liu, Xianfeng Tang, Yuji Zhang, Chi Wang, Jiaxuan You, Heng Ji, Hanghang Tong, Jingrui He

专题命中 具身推理 :robotics(abstract);world model(abstract);分类 cs.AI

AI总结 本文探讨了大语言模型在开放和动态环境中的代理推理方法,通过三个层次的框架提升单体、自我进化和集体多代理推理能力,并提出了未来研究方向。

Comments Project: https://github.com/weitianxin/Awesome-Agentic-Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18028 2026-01-21 cs.LG cs.AI cs.CV cs.RO 70%

Knot So Simple: A Minimalistic Environment for Spatial Reasoning

结非简单:一种用于空间推理的极简环境

Zizhao Chen, Yoav Artzi

专题命中 具身推理 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 KnotGym是一种用于空间推理的极简交互环境,通过不同复杂度的绳子操作任务测试感知、推理与操作整合的挑战。

Comments Fix camera ready footer

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11644 2026-01-21 cs.CV cs.AI 62%

Predicting When to Trust Vision-Language Models for Spatial Reasoning

预测何时信任视觉-语言模型进行空间推理

Muhammad Imran, Yugyung Lee

机构 * University of Missouri Kansas City(密苏里大学堪萨斯城分校)

专题命中 具身推理 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 本研究提出一种基于视觉的置信度估计框架,通过几何验证提升VLM空间推理的可靠性,实验显示其在BLIP-2和CLIP上的AUROC显著优于文本方法基线。

Comments 9 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 模仿学习与强化学习 6 篇

2601.12428 2026-01-21 cs.RO cs.CV 86%

ReWorld: Multi-Dimensional Reward Modeling for Embodied World Models

ReWorld:面向具身世界模型的多维奖励建模

Baorui Peng, Wenyao Zhang, Liang Xu, Zekun Qi, Jiazhao Zhang, Hongsi Liu, Wenjun Zeng, Xin Jin

机构 * Eastern Institute of Technology(东部技术研究所) Georgia Institute of Technology(佐治亚理工学院) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学)

专题命中 模仿学习与强化学习 :world model(title,abstract);robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 ReWorld通过多维奖励建模提升具身世界模型的物理真实性和任务完成能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14140 2026-01-21 cs.AR 82%

CREATE: Cross-Layer Resilience Characterization and Optimization for Efficient yet Reliable Embodied AI Systems

CREATE: 跨层韧性表征与优化以实现高效且可靠的具身AI系统

Tong Xie, Yijiahao Qi, Jinqi Wen, Zishen Wan, Yanchi Dong, Zihao Wang, Shaofei Cai, Yitao Liang, Tianyu Jia, Yuan Wang, Runsheng Wang, Meng Li

专题命中 模仿学习与强化学习 :embodied AI(title,abstract);embodied agent(abstract)

AI总结 CREATE提出了一种跨层韧性优化方法,通过电路、模型和应用层面的协同设计,实现高效且可靠的具身AI系统。

Comments 18 pages, 21 figures. Accepted by ASPLOS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00540 2026-01-21 cs.MA cs.LG cs.RO cs.SY eess.SY 76%

Emergence of Roles in Robotic Teams with Model Sharing and Limited Communication

机器人团队中角色涌现:模型共享与有限通信

Ian O'Flynn, Harun Šiljak

机构 * EEE Department(电子工程系) Trinity College Dublin(都柏林信任学院)

专题命中 模仿学习与强化学习 :robotic(title);分类 cs.RO、cs.LG

AI总结 通过集中学习和模型共享,该方法在机器人团队中促进角色分化,减少计算能耗并应用于现实场景。

Comments Accepted for 2025 8th International Balkan Conference on Communications and Networking (Balkancom)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09680 2026-01-21 cs.CV cs.AI 62%

Object-Centric Latent Action Learning

基于对象的潜在动作学习

Albina Klepach, Alexander Nikulin, Ilya Zisman, Denis Tarasov, Alexander Derevyagin, Andrei Polubarov, Nikita Lyubaykin, Igor Kiselev, Vladislav Kurenkov

专题命中 模仿学习与强化学习 :embodied AI(abstract);分类 cs.AI、cs.CV

AI总结 本文提出了一种基于对象的潜在动作学习框架,通过自监督对象中心预训练解耦代理与干扰背景动态,提升动作标签的鲁棒性,从而改善模仿学习和代理适应效率。

Comments Accepted by AAAI 2026 (Oral). Source code: https://github.com/dunnolab/object-centric-lapo

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13794 2026-01-21 cs.GR cs.LG cs.RO 62%

MimicKit: A Reinforcement Learning Framework for Motion Imitation and Control

MimicKit:一种用于运动模仿与控制的强化学习框架

Xue Bin Peng

机构 * Simon Fraser University(西蒙弗雷泽大学) NVIDIA(英伟达)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

AI总结 MimicKit 通过运动模仿和强化学习结合,提供统一的运动控制训练框架,支持计算机图形学和机器人学的研究与应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01147 2026-01-21 cs.RO 57%

Astra: Efficient Transformer Architecture and Contrastive Dynamics Learning for Embodied Instruction Following

Astra:面向具身指令跟随的高效Transformer架构与对比动态学习

Yueen Ma, Dafeng Chi, Shiguang Wu, Yuecheng Liu, Yuzheng Zhuang, Irwin King

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程系,香港中文大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

AI总结 Astra通过引入轨迹注意力和对比动态学习目标,提升了具身指令跟随任务中多模态序列处理的效率与准确性。

Comments Accepted to EMNLP 2025 (main). Published version: https://aclanthology.org/2025.emnlp-main.688/ Code available at: https://github.com/yueen-ma/Astra

详情

展开后加载摘要…

URL PDF HTML 收藏