Mind to Hand: Purposeful Robotic Control via Embodied Reasoning
Mind to Hand: 通过具身推理实现目的性机器人控制
专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO、cs.AI
AI总结 Lumo-1通过具身推理实现目的性机器人控制,结合视觉语言动作模型提升机器人推理与动作协调能力。
Comments 49 pages, 25 figures
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
Mind to Hand: 通过具身推理实现目的性机器人控制
专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO、cs.AI
AI总结 Lumo-1通过具身推理实现目的性机器人控制,结合视觉语言动作模型提升机器人推理与动作协调能力。
Comments 49 pages, 25 figures
OpenSubject: 利用视频衍生的身份和多样性先验进行主体驱动的图像生成与操纵
机构 * HKUST(香港科技大学) ; Meituan(美团) ; HKUST(GZ)(香港科技大学(广州))
专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV
AI总结 OpenSubject通过视频衍生的大规模数据集提升主体驱动图像生成与操纵的性能,尤其在复杂场景中表现更优。
可变刚度抓取器的开发:用于安全的机器人辅助裤子穿脱
机构 * Taylor & Francis(泰勒弗朗西斯集团)
专题命中 机器人操作 :robotics(abstract,journal_ref);manipulation(abstract);robotic(abstract);分类 cs.RO
AI总结 本文提出一种可变刚度抓取器,用于安全协助老年人和半身瘫痪者完成裤子穿脱任务,通过机器人系统实现高成功率的穿脱操作。
Journal ref Unde, J., Inden, T., Wakayama, Y., Colan, J., Zhu, Y., Aoyama, T., and Hasegawa, Y. (2024). Development of a compliant gripper for safe robot-assisted trouser dressing--undressing. \textit{Advanced Robotics}, 38(19--20), 1424--1440
场景无关的双臂任务规划 via 视觉可及性推理
机构 * Graduate School of Culture Technology, Korea Advanced Institute of Science and Technology (KAIST)(文化科技研究生院,韩国科学技术院)
专题命中 机器人操作 :embodied agent(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO
AI总结 本文提出了一种场景无关的双臂任务规划框架,通过视觉可及性推理实现双臂操作的高效规划与执行。
Comments 8 pages, 4 figures
H2R-Grounder:一种无需配对数据的视频到物理 grounded 机器人视频翻译范式
机构 * Show Lab, National University of Singapore(新加坡国立大学显示实验室)
专题命中 机器人操作 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 H2R-Grounder通过无需配对数据的方法,将人类交互视频转换为物理 grounded 的机器人视频,提升机器人学习的现实感和扩展性。
Comments 13 pages, 6 figures
UPETrack:用于跟踪遮挡变形线性物体的单向位置估计
机构 * Huazhong University of Science and Technology(华中科技大学) ; Foshan Institute of Intelligent Equipment Technology(佛山智能装备技术研究所) ; School of Artificial Intelligence and Robotics(人工智能与机器人学院)
专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO
AI总结 UPETrack通过几何驱动的单向位置估计方法,实现了对遮挡变形线性物体的高效跟踪,提升了定位精度和计算效率。
MPC用于动量平衡和零冲量接触的自由旋转卫星
机构 * Theofania Karampela(未知) ; Rishie Seshadri(未知) ; Florian Dörfler(未知) ; Sarah H.Q. Li(未知)
专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO
AI总结 本文提出了一种非线性MPC框架,用于实现服务卫星与自由旋转目标卫星的零冲量接触,通过显式建模交叉耦合动态以满足约束条件。
Comments 21 pages, 4 figures, 5 tables, submission for AIAA SciTech 2026 conference
FROMAT: 通过少样本自注意力适应实现多视图材料外观迁移
机构 * Trinity College Dublin(都柏林三一学院) ; Arcade AI ; AMD
专题命中 机器人操作 :manipulation(abstract);分类 cs.CV
AI总结 FROMAT通过少样本自注意力适应实现多视图材料外观迁移,提供了一种简单有效的生成方法,提升多视图内容创作的外观多样性。
双无人机 tethered 杆的可观测性分析与复合扰动滤波
机构 * School of Cyber Science and Technology, Beihang University(信息科学与技术学院,北航) ; School of Automation Science and Electrical Engineering, Beihang University(自动化科学与电气工程学院,北航) ; Beijing Engineering Research Center of Industrial Spectrum Imaging(工业频谱成像北京工程研究中心) ; School of Automation and Electrical Engineering, University of Science and Technology Beijing(自动化与电气工程学院,北京科技大学) ; Hangzhou Innovation Institute, Beihang University(杭州创新研究院,北航)
专题命中 机器人操作 :manipulation(abstract);分类 cs.RO
AI总结 本文提出双无人机 tethered 杆系统的可观测性分析与复合扰动滤波方法,证明在多源扰动下系统可观测性,并通过滤波方案实现低成本高鲁棒性的状态估计。
DMP-TTS: 解耦多模态提示的可控文本到语音系统 with 链式引导
机构 * University of Science and Technology of China(科学技术大学)
专题命中 机器人操作 :manipulation(abstract)
AI总结 DMP-TTS通过解耦多模态提示和链式引导技术,实现了更强的文本到语音风格可控性,同时保持良好的可懂度和自然度。
光诱捕:基础、进展与未来方向
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文综述了光诱捕的基本原理、最新进展及未来方向,探讨了其在多个领域的应用及研究前景。
Comments 18 pages, 8 figures
电流控制的单个磁反拓扑结构的生成、删除及拓扑变换
专题命中 机器人操作 :manipulation(abstract)
AI总结 本研究通过电流控制实现了单个反拓扑结构在纳米结构单元中的生成、删除及拓扑变换,揭示了电流诱导效应在磁结构调控中的关键作用。
Comments Published in Nature Communications
新的合成金矿:基于手关节角度驱动的EMG数据生成框架用于微手势识别
专题命中 机器人操作 :robotic(abstract)
AI总结 本文提出SeqEMG-GAN框架,通过手关节角度驱动生成高保真EMG数据,提升微手势识别性能和数据集多样性。
Comments Accepted at AAAI 2026
利用光脉冲和磁场实现量子比特和量子拟态门动态合成的控制协议
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文提出利用光脉冲和磁场实现量子比特和量子拟态门的高保真度动态合成控制方法。
磁控各向异性黑体辐射与动态轴子绝缘体中慢热光凝结
专题命中 机器人操作 :manipulation(abstract)
AI总结 研究动态轴子绝缘体中磁控各向异性黑体辐射与慢热光凝结现象,揭示其热辐射调控机制及中子星类比。
Comments 10 pages, 5 figures
Journal ref Phys. Rev. Res. 7, 033297 (2025)
YOPO-Nav: 基于单次视频的3DGS图进行视觉导航
机构 * Rutgers University(罗格斯大学) ; Stony Brook University(石溪大学)
专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV
AI总结 YOPO-Nav通过单次视频生成3DGS图实现高效视觉导航,结合粗略定位与局部模型优化,适用于真实环境的机器人导航任务。
LISN: 基于VLM控制器的指令引导社交导航
机构 * RoboScience Co.(RoboScience公司) ; ShanghaiTech University(上海科技大学) ; Nanjing University(南京大学) ; University of Science and Technology of China(中国科学技术大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 LISN通过VLM控制器实现指令引导的社交导航,提出首个标准化基准并提升动态避障能力。
Comments 8 pages
REASAN:为四足机器人学习反应式安全导航
机构 * Bernoulli Institute for Mathematics, Computer Science and Artificial Intelligence, University of Groningen, The Netherlands(格罗宁根大学伯努利数学、计算机科学与人工智能研究所) ; Department of Electrical Engineering, Linköping University, Sweden(利厄普大学电气工程系) ; Engineering and Technology Institute Groningen, University of Groningen, The Netherlands(格罗宁根大学格罗宁根工程与技术研究所)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 REASAN通过模块化强化学习和变压器估计器实现四足机器人在复杂环境中的反应式安全导航。
Comments 8 pages
PUL-SLAM:路径不确定性联合优化与轻量停滞检测用于高效机器人探索
机构 * School of Systems Science and Engineering(系统科学与工程学院)
专题命中 具身导航 :robotic(title,abstract);分类 cs.RO
AI总结 PUL-SLAM通过路径不确定性联合优化和轻量停滞检测提升机器人探索效率,缩短探索时间并减少路径距离。
自主航空器的视觉航向预测
机构 * Department of Computer Science at North Carolina A&T State University(北卡罗来纳A&T州立大学计算机科学系) ; Department of Electrical and Computer Engineering at North Carolina A&T State University(北卡罗来纳A&T州立大学电气与计算机工程系)
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 本文提出基于视觉的数据驱动框架,实现无人机与无人地面车辆的实时整合,通过YOLOv5检测UGV并利用轻量级ANN预测航向角,实现高精度的导航与协调。
基于负高斯混合统计的视觉地点识别自适应阈值设定
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV
AI总结 本文提出利用负高斯混合统计自适应选择视觉地点识别的阈值,以提高不同场景下的识别性能。
Comments Accepted and presented at IEEE RoboticCC 2025. 4 pages short paper
通过太阳能供电的自主水面车辆实现高分辨率水样采集
机构 * School of Electronic Engineering and Computer Science Queen Mary University of London, UK(电子工程与计算机科学学院,伦敦女王玛丽大学,英国)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出了一种太阳能供电的自主水面车辆,通过模块化采样系统实现高分辨率水样采集,适用于远程环境的水体监测。
一种面向高性能人形足球的分层模型系统
机构 * Department of Mechanical and Aerospace Engineering, UCLA(加州大学洛杉矶分校机械与航空航天工程系)
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 本文提出了一种分层模型系统,通过硬件和软件创新实现了高性能人形足球机器人在RoboCup 2024比赛中的胜利。
多模态运动与行为切换的多稳态纤毛行者
专题命中 具身导航 :robotic(abstract)
AI总结 本研究通过多稳态纤毛设计实现机器人多模态运动与行为切换,展示了自主导航和环境交互的复杂行为。
Comments 10 pages, 6 figures, and supporting information
提示工程干预对本科生人工智能自我效能、人工智能知识和提示工程能力的影响:一项混合方法研究
专题命中 具身导航 :navigation(abstract)
AI总结 本研究通过混合方法探讨提示工程干预对本科生人工智能自我效能、知识及能力的影响,发现干预显著提升学生在AI相关领域的技能和理解。
Comments 34 pages, 6 figures
缩小世界模型在基于梯度规划中的训练-测试差距
机构 * Columbia University(哥伦比亚大学) ; New York University(纽约大学)
专题命中 具身推理 :world model(title,abstract);manipulation(abstract);navigation(abstract);分类 cs.RO、cs.LG
AI总结 本文提出改进世界模型训练方法,以提高基于梯度的规划效率,缩小训练与测试之间的性能差距。
理解世界还是预测未来?世界模型的全面综述
机构 * Department of Electronic Engineering, Beijing National Research Center for Information Science and Technology (BNRist), Tsinghua University(电子工程系,信息科学与技术国家研究中心(BNRist),清华大学)
专题命中 具身推理 :world model(title,abstract);robotics(abstract);分类 cs.AI、cs.LG
AI总结 本文综述了世界模型在理解与预测方面的功能,探讨了其在多个领域的应用及未来研究方向。
Comments Extended version of the original ACM CSUR paper, 49 pages, 6 figures, 8 tables
令牌扩展-合并:面向视觉-语言-动作模型的免训练 令牌压缩
机构 * College of Science and Engineering, Hamad Bin Khalifa University(1 科学与工程学院,哈马德·本·卡西姆大学) ; Mohamed bin Zayed University of Artificial Intelligence(2 摩萨·本·扎耶德人工智能大学) ; College of Computer Science and Technology, Zhejiang University(3 计算机科学与技术学院,浙江大学)
专题命中 机器人基础模型 :robotic(abstract);分类 cs.RO
AI总结 TEAM-VLA通过动态令牌扩展与合并机制,实现无需训练的视觉-语言-动作模型高效推理,提升速度并保持任务性能。
Comments 8 pages, 5 figures
在 cluttered 环境中通过路径引导的 MAPPO 和方向性前沿分配实现可泛化的协作搜索与捕获
机构 * Department of Automation, Central South University, Changsha, China(自动化系,中南大学,长沙,中国)
专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG
AI总结 本文提出 PGF-MAPPO 方法,通过路径引导的 MAPPO 和方向性前沿分配,在 cluttered 环境中实现高效的协作搜索与捕获,展示了出色的泛化能力和性能优势。
Comments 7 pages, 7 figures
具有预测意识和强化学习的利他性协作驾驶
专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI
AI总结 本文提出一种基于预测意识和强化学习的自动驾驶方法,通过混合预测网络和社交优化框架提升安全性和鲁棒性。