arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-26 至 2026-08-26 共收录 81 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 12 篇

2608.23383 2026-08-26 cs.CV 版本更新 57%

Long-Horizon Audio-Visual Generation for Persistent Stories and Interactive Worlds

面向持续故事与交互世界的长时序视听生成

Nan Duan, Haoyang Huang, Weiyang Jin, Haoran Li, Yaowei Li, Yuming Li, Yijun Liu, Xin Lu, Xiaoxiao Ma, Yanwen Ma, Yaofeng Su, Yilang Sun, Haoyu Wang, Zeyue Xue, Songchun Zhang, Junhao Zhuang

机构 * Joy Future Academy, JD(京东探索研究院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 研究针对长时序视听生成的需求,提出JoyAI-Echo-1.5系统,含长视频与世界模型变体,通过专用技术实现跨镜头一致性等性能,在相关基准上取得领先结果,为生成连贯内容提供基础。

Comments Project page: this https URL (https://echo-team-joy-future-academy-jd.github.io/Echo-1.5-Page/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06621 2026-08-26 cs.GL cs.LG stat.ML 版本更新 57%

The Theorems of Dr. David Blackwell and Their Contributions to Artificial Intelligence

大卫·布莱克韦尔定理及其对人工智能的贡献

Napoleon Paxton

机构 * School of Information, University of California, Berkeley(加州大学伯克利分校信息学院)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本文综述了布莱克韦尔的三个重要定理及其对现代人工智能和机器学习的影响,包括马尔可夫链蒙特卡罗推断、自主机器人导航、生成模型训练等领域的应用。

Comments Survey article, 20 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17226 2026-08-26 cs.RO 版本更新 57%

Topology-Aware Decision Making for Multi-Session Localization and Mapping

利用拓扑信息的多会话定位与建图

Lorenzo Montano-Olivan, Julio A. Placed, Luis Montano, Maria T. Lazaro

机构 * Instituto Tecnológico de Aragón (ITA)(阿拉贡技术学院) Instituto de Investigación en Ingeniería de Aragón (I3A)(阿拉贡工程研究院) Universidad de Zaragoza(萨拉戈塔大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本研究提出一种基于拓扑信息的多会话框架,通过分析姿态图结构优化建图与定位,减少误差并提升一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19509 2026-08-26 cs.RO 版本更新 57%

Analytical Covariance Propagation for DVL-Aided Loosely Coupled SINS Under Attitude Uncertainty

辅助惯性导航策略用于自主水下航行器的松散耦合系统:姿态误差建模与方差传播

Jin Huang, Zichen Liu, Haoda Li, Zhikun Wang, Yuan Zhao, Xianyu Peng, Yongqun Yu, Ying Chen

机构 * State Key Laboratory of Ocean Sensing, Ocean College of Zhejiang University(浙江大学海洋传感国家重点实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种结合姿态误差建模与方差传播的松散耦合惯性导航策略,有效抑制长期误差发散,提升自主水下航行器的导航精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15959 2026-08-26 cs.HC cs.AI cs.CY 版本更新 57%

Review of Explainable Decision Support and Adaptive Human-Machine Interfaces for Automation Transparency in Maritime Autonomous Surface Ships

面向海事自主船舶自动化透明度的可解释决策支持与自适应人机接口综述

Zhuoyue Zhang, Haitong Xu, Carlos Guedes Soares

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本综述针对海事自主船舶自动化透明度,整合100项研究,提出自适应透明度框架,明确透明度设计策略与关键近阶段改进手段,以降低认知负荷、提升接管及时性并保障安全运行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15741 2026-08-26 cs.NE cs.CL cs.MA 版本更新 50%

Explainable Information Processing in Particle Swarm Optimization through Landscape and Search Behavior Analysis

基于景观与搜索行为分析的粒子群优化可解释信息处理

Nitin Gupta, Bapi Dutta, Anupam Yadav

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电气与计算机工程系) Department of Computer Science, Universidad de Jaén(西班牙Jaén大学计算机科学系) School of Computer and Mathematical Sciences, University of Adelaide(阿德莱德大学计算机与数学科学学院) Leiden Institute of Advanced Computer Science, University Leiden(莱顿大学先进计算机科学研究所) Department of Mathematics and Computing, Dr. B. R. Ambedkar National Institute of Technology(德拉·B·R·阿姆贝卡尔国立理工学院数学与计算系)

专题命中 具身导航 :navigation(abstract)

AI总结 本研究针对粒子群优化(PSO),提出结合探索性景观分析与搜索轨迹网络的多维度可解释性框架,经24个基准函数实验确立拓扑与参数配置指南,提升了PSO的透明度与可解释性。

Comments 45 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 11 篇

2608.24885 2026-08-26 cs.RO cs.CV 新提交 87%

Do Robotic World Models Really Follow Actions? Diagnosing and Aligning Action-Conditioned Generation for Policy Learning

机器人世界模型真的会遵循动作吗?面向策略学习的动作条件生成诊断与对齐

Sixiang Chen, Jiaming Liu, Jixian Wu, Yichen Guo, Tinghao Wang, Siyuan Qian, Hao Chen, Jiajun Cao, Jian Tang, Shanghang Zhang

机构 * Peking University(北京大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) New York University(纽约大学) University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 具身推理 :world model(title,abstract);robotic(title);分类 cs.RO、cs.CV

AI总结 本文针对动作条件世界模型的动作遵循问题,提出WorldEcho诊断工具与WorldSync改进方法,经实验验证WorldSync可提升动作遵循性能,作为可靠模拟器助力策略改进并提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24680 2026-08-26 cs.CV 新提交 81%

Game2World Engine: Unlocking In-the-Wild Gameplay Videos for World Model Training

Game2World引擎:解锁野外游戏视频用于世界模型训练

Wenxuan Shen, Dongna Jin, Dongping Chen

专题命中 具身推理 :world model(title,abstract);分类 cs.CV;robotics(comments)

AI总结 针对游戏视频界面干扰世界模型训练的问题,提出GameUI-Taxonomy与G2WEngine框架构建Game2World数据集,研发无掩码UI去除模型GameCleaner,提升了世界模型训练效果与UI去除性能。

Comments We are currently building Gaming World Model and data engine that transfers game dynamics to robotics. Feel free to contact Dongping Chen (dongpingchen0612@gmail.com) if you are interested in research collaboration or financial support

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24855 2026-08-26 cs.CV 新提交 79%

LeFlow: Generative Latent Flow Planning for World Models

LeFlow:面向世界模型的生成式潜在流规划

Hsiang-Wei Huang, Jianxu Shangguan, Junbin Lu, Jenq-Neng Hwang

机构 * University of Washington(华盛顿大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本研究提出LeFlow,它从世界模型学习可复用潜在轨迹先验,将规划转为条件潜在轨迹生成,在四个目标条件像素控制基准中提升规划成功率并大幅减少规划时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23720 2026-08-26 cs.CV 新提交 79%

Platonic Representation Hypothesis on World Models

世界模型的柏拉图式表征假说

Wenhow Li (1), Chengwei MA (1), Hui Xiong (1), Ying-Cong Chen (1), Lei Zhang (1) ((1) The Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China)

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 该研究针对世界模型的表征性质,提出预测一致性假设,通过DINO-WM实验发现性能良好的世界模型会形成几何相似的内部结构,且模型特征可跨模型映射,证实预测一致性能促进共享潜在结构的形成。

Comments 18 pages, 10 figures, 2 tables. Wenhow Li and Chengwei MA contributed equally. Project page: this https URL (https://sellerbubble.github.io/platonic-representation-hypothesis-on-world-models/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09696 2026-08-26 cs.AI 版本更新 79%

Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models

模型发现智能体:用于数据高效发现机制世界模型的大语言模型辅助贝叶斯实验设计

Kevin Murphy

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 该研究提出模型发现智能体(MDA),结合LLM与贝叶斯机制,在少量干预下发现机制世界模型,在三类基准上实现数据高效模型学习与可靠干预预测的SOTA性能。

Comments v4: Major update! Fixed a leak in the prompts for physics and chemistry benchmarks and re-ran experiments (fortunately results did not change much), added Boxing Gym benchmark (requires generating NumPyro code), significantly simplified the figures and evaluation protocol, reframed the narrative around SMC^3, polished the presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07265 2026-08-26 math.OC cs.LG 交叉投稿 74%

Finite-Sample Metric Non-Collapse for Geometrically Supervised Latent World Models in Control

用于控制的学习型世界模型中的度量非崩溃:逼近理论、有限样本几何保证与确定性规划迁移

Alain Bensoussan, Minh-Nhat Phung, Minh-Binh Tran

专题命中 具身推理 :world model(title);分类 cs.LG

AI总结 该研究为非线性确定性控制系统的学习型世界模型构建三部分数学理论,含逼近理论、有限样本几何保证及确定性规划迁移方法,通过数值实验验证了相关方法的有效性。

Comments Revised version prepared in response to the editorial assessment. The main manuscript is 32 pages; detailed mathematical derivations have been moved to the accompanying Supplementary Material. The principal results and contributions are strengthened and clarified

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23486 2026-08-26 cs.CV cs.RO 版本更新 62%

GeoWAM: Visual Geometry World Action Models for Autonomous Driving

GeoWAM:面向自动驾驶的视觉几何世界动作模型

Yiren Lu, Xin Ye, Jiaming Liu, Philip Jacobson, Jin Yao, Yi-chung Chen, Liam Merino, Dhruva Dixith Kurra, Min Cai, Tom Lampo, Yu Yin, Danhua Guo, Burhan Yaman

机构 * Uber AV Labs(优步自动驾驶实验室) Case Western Reserve University(凯斯西储大学)

专题命中 具身推理 :world model(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出 GeoWAM,一种用于自动驾驶的视觉几何世界动作模型,通过预训练预测未来场景几何来学习动力学,经评估其生成的驾驶策略比图像基方案更强,确立未来几何预测为自动驾驶有效预训练目标。

Comments Project page: this https URL (https://yiren-lu.com/project_pages/geowam/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24044 2026-08-26 cs.LG 新提交 57%

XP-JEPA: Cross-Predictive Physics Grounding for Forecastable Latent Dynamics

XP-JEPA:用于可预测潜在动力学的交叉预测物理基础

Kehan Wen, Ziming Li, Siyuan Luo, Fan Shi

专题命中 具身推理 :world model(abstract);分类 cs.LG

AI总结 XP-JEPA通过将视觉与物理表征交叉预测,提升了潜在动力学的可预测性,在多任务套件上降低了展开漂移并提高了控制成功率,无需特权输入即可实现更优的基于展开的控制性能。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23790 2026-08-26 cs.CV q-bio.NC 新提交 57%

Primate vision reveals a missing principle for robust dynamic AI

灵长类视觉揭示了鲁棒动态人工智能缺失的原理

Matteo Dunnhofer, Christian Micheloni, Kohitij Kar

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 该研究对比人类与猕猴视觉及相关神经网络,发现预测世界模型兼具跨外观泛化与高神经保真度,提出将运动逐步整合到物体表征是鲁棒动态视觉的关键原理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23706 2026-08-26 cs.AI 新提交 57%

Do LLMs Understand Limit Order Book Dynamics?

大型语言模型(LLM)是否理解限价订单簿(LOB)动态?

Junxiao Chen, Paul Glasserman

机构 * Columbia Business School(哥伦比亚商学院)

专题命中 具身推理 :world model(abstract);分类 cs.AI

AI总结 本研究测试基于LOB数据训练的LLM,发现其隐式世界模型未掌握LOB状态,导致预测有偏且存在虚假可预测性,为此将相关测试扩展至LOB的随机动态环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13554 2026-08-26 cs.ET cs.IT cs.RO 版本更新 57%

Observability Engineering: From Measurement to Information Generation in Active Sensing Systems

从快照感知到持久电磁世界建模:一种面向ISAC的生成空间视角

Pin-Han Ho, Limei Peng

专题命中 具身推理 :world model(abstract);分类 cs.RO

AI总结 本文提出一种基于生成空间的毫米波感知框架,通过低维激励空间实现灵活、可扩展的持续电磁世界建模,避免了快照感知的局限性。

Comments 7 pages, 6 figures/tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 2 篇

2605.10426 2026-08-26 cs.CV cs.AI 版本更新 76%

CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving

CoWorld-VLA:面向自动驾驶的多专家世界模型中的思考

Minqing Huang, Yujiao Xiang, Zihan Liang, Jiajie Huang, Jingqi Wang, Yuheng Zhou, Zhi Xu, Feiyang Tan, Hangning Zhou, Mu Yang, Gong Che

机构 * Afari Intelligent Drive(Afari智能驾驶公司) University of Electronic Science and Technology of China(电子科技大学) Shanghai Jiao Tong University(上海交通大学) Beijing University Of Posts and Telecommunications(北京邮电大学) Tianjin University(天津大学)

专题命中 机器人基础模型 :world model(title);分类 cs.AI、cs.CV

AI总结 本文提出CoWorld-VLA,通过多专家世界推理框架,利用显式条件指导动作规划,提升自动驾驶的场景生成与路径规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23775 2026-08-26 cs.RO 版本更新 57%

Vision-Language-Action Safety: Threats, Challenges, Evaluations, and Mechanisms

视觉-语言-动作安全性:威胁、挑战、评估与机制

Qi Li, Bo Yin, Weiqi Huang, Ruhao Liu, Bojun Zou, Runpeng Yu, Jingwen Ye, Weihao Yu, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学) Monash University(墨尔本大学) Peking University(北京大学)

专题命中 机器人基础模型 :robotic(abstract);分类 cs.RO

AI总结 本文探讨了视觉-语言-动作模型的安全性问题,分析了其在训练和推理阶段的威胁与防御机制,总结了评估方法及六个部署领域的安全挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 7 篇

2605.02867 2026-08-26 cs.LG cs.AI cs.RO 版本更新 82%

Enhancing RL Generalizability in Robotics through SHAP Analysis of Algorithms and Hyperparameters

通过SHAP分析算法和超参数增强机器人学中强化学习的泛化能力

Lingxiao Kong, Cong Yang, Oya Deniz Beyan, Zeyd Boukhers

机构 * Fraunhofer Institute for Applied Information Technology(弗劳恩霍夫应用信息科技研究所) University of Cologne(科隆大学) University Hospital of Cologne(科隆大学医院)

专题命中 模仿学习与强化学习 :robotics(title);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出基于SHAP的可解释框架,量化算法和超参数对强化学习泛化差距的贡献,并用于配置选择以提升泛化能力。

Comments Accepted by International Conference on Pattern Recognition (ICPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22027 2026-08-26 cs.RO cs.AI 版本更新 81%

RARM: Confidence-Gated Progress Reward Modeling for RL in Manipulation

RARM:基于置信度门控的进展奖励建模用于操作中的强化学习

Pengzhi Yang, Xinyu Wang, Pengyu Jing, Kehan Wen, Yiduo Qu, Zhenhao Huang, Minghao Fu, Xin Liu, Yaheng Shen, Fan Shi

机构 * NUS Human-Centered Robotic Lab(新加坡国立大学人机共融机器人实验室) University of Cambridge(剑桥大学) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)

专题命中 模仿学习与强化学习 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出参考锚定奖励模型(RARM),通过对比时间目标从通用视频中学习,将单个成功演示转化为密集进展奖励,并在部署时通过置信度门控抑制虚假正奖励,在长时域操作任务中显著提升强化学习成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23831 2026-08-26 cs.RO cs.LG 新提交 62%

Learning to Act While Waiting: RL Finetuning of Generalist Robot Policies Under Inference Latency

等待时学习行动:考虑推理延迟的通用机器人策略的强化学习微调

Brian Zhu (1), Momen Khalil (1), E Harrison (2), Emanuele Poggi (1), Philipp Schmitt (1), Bernd Kast (1), Philine Meister (1), Pranav Atreya (2), Qiyang Li (2), Finn Ferchau (1), Cesar Colmenero (1), Yash Shahapurkar (1), Gokul Narayanan (1), Melih Erdogan (1), Kai Wurm (1), Georg von Wichert (1), Oier Mees (3 and 4 and 2), Eugen Solowjow (1), Andrew Wagenmaker (2), Sergey Levine (2) ((1) Siemens (2) UC Berkeley (3) Microsoft (4) ETH Zurich)

机构 * Siemens(西门子) UC Berkeley(加州大学伯克利分校) Microsoft(微软) ETH Zurich(苏黎世联邦理工学院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本研究针对通用机器人策略因推理延迟破坏马尔可夫假设导致标准RL失效的问题,提出ARLI框架,通过状态增强等设计实现延迟下的RL微调,在模拟及真实任务中表现优异。

Comments 25 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19969 2026-08-26 cs.RO cs.LG 版本更新 62%

E2HiL: Entropy-Guided Sample Selection for Efficient Real-World Human-in-the-Loop Reinforcement Learning

E2HiL: 基于熵引导的高效真实世界人机协同强化学习样本选择

Haoyuan Deng, Yudong Lin, Yuanjiang Xue, Haoyang Du, Qianzhun Wang, Boyang Zhou, Zhenyu Wu, Ziwei Wang

机构 * Nanyang Technological University, Singapore(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 E2HiL通过熵引导的样本选择方法,提高了真实世界人机协同强化学习的样本效率和成功率,减少了人工干预需求。

Comments Project page: this https URL (https://e2hil.github.io/) Updated to the final IEEE RA-L version. The author list has been revised to match the published version, adding Yudong Lin and Qianzhun Wang. Main results and conclusions remain unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00610 2026-08-26 cs.RO 版本更新 61%

Vision-based Goal-Reaching Control for Mobile Robots Using a Hierarchical Learning Framework

基于视觉的目标到达控制的移动机器人Hierarchical Learning框架

Mehdi Heydari Shahna, Pauli Mustalahti, Jouni Mattila

机构 * Faculty of Engineering and Natural Sciences, Tampere University(工程与自然科学学院,塔尔皮莱大学)

专题命中 模仿学习与强化学习 :robotics(abstract,comments);分类 cs.RO

AI总结 本文提出一种基于视觉的目标到达控制框架,通过分层学习方法提高移动机器人在复杂地形中的安全性和稳定性。

Comments Published in Robotics and Autonomous Systems, Volume 206, Article 105710

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24479 2026-08-26 cs.LG 新提交 57%

WarpSAC: Towards the Pinnacle of Scalable Off-policy RL by Rethinking Exploration and Exploitation

WarpSAC:通过重新思考探索与利用,迈向可拓展离线强化学习的顶峰

Zihao Wu, Hongyao Tang, Yi Ma, Huizhong Song, Pengyi Li, Yifu Yuan, Fei Ni, Jinyi Liu, Wei Wei, Jianrong Wang, Yan Zheng, Jianye Hao

机构 * Tianjin University(天津大学) Shanxi University(山西大学) Imperial College London(伦敦帝国学院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

AI总结 该研究针对大规模并行模拟下离线RL的数据 regime 变化问题,提出具 regime 感知的WarpSAC算法家族,适配不同数据规模场景,在多基准任务及现实部署上较FlashSAC实现显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23204 2026-08-26 cs.RO 版本更新 57%

Guided Riemannian Optimization (GuRO): Bridging Model Predictive Control and Decision Transformers

引导式黎曼优化(GuRO):连接模型预测控制与决策Transformer

Hossein Abdi, Satya Prakash Dash, Mingfei Sun

机构 * The University of Manchester(曼彻斯特大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO

AI总结 本研究提出GuRO框架,将MPC与RL整合到序列决策框架,利用黎曼优化解决非凸损失问题,在四足机器人控制任务上优于TRPO等基准方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 2 篇

2608.24043 2026-08-26 cs.CV 新提交 57%

ConsensusTAS: Self-Supervised Temporal Action Segmentation for Long-Horizon Construction Videos

ConsensusTAS:面向长时程施工视频的自监督时序动作分割

Xiaoshan Zhou, Yafei Sun

机构 * School of Project Management, University of Sydney(悉尼大学项目管理学院) School of Civil and Environmental Engineering, University of New South Wales(新南威尔士大学土木与环境工程学院)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.CV

AI总结 本研究提出自监督时序动作分割模型ConsensusTAS,无需标注且可在CPU运行,在公开数据集及真实施工视频上的性能优于现有最优方法,可用于人机协同与视频监控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22008 2026-08-26 cs.RO 版本更新 57%

Stakeholder Insights for Designing In-Home Social Robots for Dementia Disorientation Detection and Caregiver-Aware Intervention

面向痴呆定向障碍检测与护理者感知干预的家庭社交机器人设计的利益相关者见解

Emmanuel Akinrintoyo, Nicole Salomons

机构 * Imperial College London(帝国理工学院)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO

AI总结 该研究通过对14名痴呆护理相关人员访谈,明确了居家社交机器人设计需融入日常作息、提供情境化定向支持等关键方向,以辅助痴呆患者定向障碍检测与干预。

Comments 6

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 20 篇

2608.23839 2026-08-26 cs.RO cs.AI 新提交 84%

Resilience Matters for Embodied Agents System: New Metrics, Systematic Evaluation, and Optimization

弹性对具身智能体系统的重要性:新指标、系统评估与优化

Yapeng Liu, Yuanzhao Zhai, Xudong Gong, Dawei Feng, Bo Ding, Lin Wang, Huaimin Wang

机构 * National University of Defense Technology(国防科技大学) Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究针对具身智能体系统忽略弹性属性的问题,提出弹性评估框架与指标集,经400项家庭任务实验验证其诊断优化效果,揭示弹性特征间的权衡关系。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24199 2026-08-26 cs.RO 新提交 83%

NVIDIA Cosmos-H-Dreams: Real-Time Generative Physics Simulation for Surgical Robotics

NVIDIA Cosmos-H-Dreams:面向外科机器人的实时生成式物理仿真

Javier Gamazo Tejero, Lukas Zbinden, Keyur Sheth, Raghavendra K M, Nadim Daher, Diego Granero Maraña, Filip Binkiewicz, Patrick Thornycroft, Mahdi Azizian, Sean D. Huver

专题命中 机器人数据与评测 :robotics(title,abstract);world model(abstract);分类 cs.RO

AI总结 该研究提出Cosmos-H-Dreams系统,结合生成模型与蒸馏技术实现实时外科机器人仿真,支持多控制器驱动,为外科教育等提供开放基础。

详情

展开后加载摘要…

URL PDF HTML 收藏