arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-28 至 2026-08-28 共收录 16 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 16 篇

2608.24199 2026-08-28 cs.RO 版本更新 83%

NVIDIA Cosmos-H-Dreams: Real-Time Generative Physics Simulation for Surgical Robotics

NVIDIA Cosmos-H-Dreams:面向外科机器人的实时生成式物理仿真

Javier Gamazo Tejero, Lukas Zbinden, Keyur Sheth, Raghavendra K M, Nadim Daher, Diego Granero Maraña, Filip Binkiewicz, Patrick Thornycroft, Mahdi Azizian, Sean D. Huver

专题命中 机器人数据与评测 :robotics(title,abstract);world model(abstract);分类 cs.RO

AI总结 该研究提出Cosmos-H-Dreams系统,结合生成模型与蒸馏技术实现实时外科机器人仿真,支持多控制器驱动,为外科教育等提供开放基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27151 2026-08-28 cs.RO 新提交 79%

Planning a Shared Modular Fixture Layout Across Robotic Disassembly Stages

面向机器人拆卸阶段的共享模块化夹具布局规划

Haohui Pan, Takuya Kiyokawa, Kensuke Harada

机构 * The University of Osaka(大阪大学) The National Institute of Advanced Industrial Science and Technology (AIST)(日本国立先进工业科学技术研究所(AIST))

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 该研究针对机器人拆卸中支撑布局需适配阶段变化的问题,提出基于去噪扩散概率模型与贝叶斯优化的模块化真空夹具系统,实现螺丝刀、剃须刀拆卸的共享布局,稳定裕度达66.9%和81.6%,验证了方案的可行性与稳定性。

Comments 15 pages, 9 figures. Submitted to IEEE Transactions on Automation Science and Engineering (T-ASE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26888 2026-08-28 cs.RO 新提交 79%

Beyond Shallow-Water Photorealism: Physically and Sensor-Grounded Simulation for Deep-Sea Robotics

超越浅水级照片写实性:面向深海机器人的物理与传感器仿真

Michele Grimaldi, Enrico Di Maria, Ignacio Carlucho, Yvan R. Petillot

机构 * School of Engineering & Physical Sciences, Heriot-Watt University(赫瑞瓦特大学工程与物理科学学院) Engineering Department, Japan Agency for Marine-Earth Science and Technology(日本海洋研究开发机构工程系)

专题命中 机器人数据与评测 :robotics(title);navigation(abstract);分类 cs.RO

AI总结 该研究针对现有水下模拟器的不足,扩展Stonefish模拟器,加入多类物理与传感器模型,实现更贴合深海机器人需求的仿真,为相关研究提供实用基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26103 2026-08-28 cs.RO cs.CV 版本更新 79%

Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization

Zero-WAM:基于人类视频的上下文世界-动作建模用于开放式任务泛化

Jiaming Zhou, Qihang Zhang, Gangwei Xu, Cunxin Fan, Yujie Zhao, Ruilin Wang, Yiming Luo, Shuai Yang, Xing Zhu, Yujun Shen, Junwei Liang, Yinghao Xu

专题命中 机器人数据与评测 :robot learning(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 Zero-WAM是基于人类视频的因果视频-动作模型,通过提出自动流水线构建HumanGen数据集、引入IFP目标,在RoboTwin 2.0仿真7个未见任务上平均成功率达47.0%,实现机器人操作零样本跨任务泛化。

Comments this https URL (https://robbyant-research.github.io/Zero-WAM/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15917 2026-08-28 cs.RO cs.AI cs.CV 版本更新 75%

Pre-training Visual Dexterity in Simulation

在仿真环境中预训练视觉灵巧性

Sarthak Kamat, Adam Rashid, Satvik Sharma, Aseem Doriwala, Chelsea Finn, Phillip Isola, C. Karen Liu

机构 * Stanford University(斯坦福大学) MIT(麻省理工学院) Scale AI(Scale AI公司)

专题命中 机器人数据与评测 :manipulation(abstract);robot policy(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究提出SPD仿真预训练框架,采集75小时多任务灵巧操作数据预训练因果Transformer,经微调后在真实任务中优于从头训练的行为克隆策略,为真实世界灵巧操作提供可行预训练来源。

Comments Project page: this https URL (https://spd.bot)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26947 2026-08-28 cs.RO cs.CV 新提交 73%

4DSynth: Controllable Procedural World Synthesis for Dynamic Embodied Simulation

4DSynth:面向动态具身模拟的可控程序式世界合成

Zehao Qi, Haochen Luo, Jia-Wang Bian, Zeyu Ma, Shuyang Sun

机构 * Nanyang Technological University(南洋理工大学) University of Oxford(牛津大学) Princeton University(普林斯顿大学) Google DeepMind(谷歌DeepMind)

专题命中 机器人数据与评测 :embodied agent(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出可控程序式4D环境生成系统4DSynth,可将自然语言等输入转化为可编辑4D环境,并构建交互式导航基准4DSynth-Nav,为具身智能体开发评估提供实用基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27371 2026-08-28 cs.RO 新提交 72%

Embodied Scene Rearrangement Planning

具身场景重排规划

Canzhi Chen, Zan Wang, Siqi Zhu, Qi Wu, Yixuan Li, Wei Liang

机构 * School of Computer Science and Technology, Beijing Institute of Technology(北京理工大学计算机科学与技术学院)

专题命中 机器人数据与评测 :embodied agent(abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出具身场景重排规划(ESRP)新任务,构建含5400+场景对的ESRP-Bench基准,评估四类方法发现现有方法难高效完成,为智能体现实部署奠定基础。

Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L), 2026. Project page: this https URL (https://bit-pie.github.io/ESRP/) Code: this https URL (https://github.com/BIT-PIE/ESRP) Dataset: this https URL (https://huggingface.co/datasets/serendipity800/ESRP-PD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20781 2026-08-28 cs.RO cs.LG 版本更新 62%

STITCH-OPE: Trajectory Stitching with Guided Diffusion for Off-Policy Evaluation

STITCH-OPE:基于引导扩散的轨迹拼接用于离线策略评估

Hossein Goli, Michael Gimelfarb, Nathan Samuel de Lara, Haruki Nishimura, Masha Itkina, Florian Shkurti

机构 * Department of Computer Science, University of Toronto(多伦多大学计算机科学系) University of Toronto Robotics Institute(多伦多大学机器人研究所) Toyota Research Institute(丰田研究院) Vector Institute(向量研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.LG

AI总结 STITCH-OPE通过引导扩散生成长周期轨迹,有效降低OPE中的方差,提升在高维空间中的评估性能。

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26932 2026-08-28 cs.RO 新提交 57%

Contact-Aided Factor-Graph Localization for Underwater Sampling

接触辅助因子图定位用于水下采样

Michele Grimaldi, Yosaku Maeda, Hitoshi Kakami, Ignacio Carlucho, Yvan R. Petillot, Tomoya Inoue

机构 * School of Engineering & Physical Sciences, Heriot-Watt University(赫瑞瓦特大学工程与物理科学学院) Japan Agency for Marine-Earth Science and Technology(日本海洋研究开发机构)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 该研究针对水下采样的自主航行器定位难题,提出接触辅助因子图定位框架,融合机械臂接触事件等多源信息,实验显示其可减少轨迹漂移并提升目标重访精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26882 2026-08-28 cs.CR cs.AI 新提交 57%

PLCBench: Can Autonomous LLM Agents Turn PLC Access into Sustained Physical Impact?

PLCBench:自主大语言模型智能体能否将PLC访问转化为持续的物理影响?

Yitian Zhou, Jingyu Zheng, Qiliang Jiang, Linkang Du, Haoming Liu, Lichao Wu, Shiyi Zhao, Mengxiang Liu, Ruilong Deng

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 研究人员提出首个真实PLC硬件在环框架PLCBench,评估自主LLM智能体将PLC访问转化为持续物理影响的能力,发现31.3%实验达成物理目标,过程观测丰富可提升目标达成率,还发布了相关复现资源。

Comments 36 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26720 2026-08-28 cs.CV 新提交 57%

Parameter Efficient Continual Learning for Sparse Event-Based Transformers

面向稀疏事件驱动Transformer的参数高效持续学习

Vaishnavi Nagabhushana, Kartikay Agrawal, Ayon Borthakur

机构 * IIT Guwahati(古瓦哈蒂印度理工学院) SustainAI Lab, MFSDS&AI(SustainAI实验室、MFSDS&AI)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文针对稀疏事件驱动视觉Transformer提出参数高效持续学习框架sLoTh,仅更新不足1%参数即可实现无重放的类增量与在线持续学习,能耗约为传统密集Transformer的1/6.5。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26383 2026-08-28 cs.RO 新提交 57%

Cross-Platform Benchmark of Neural 3D Reconstruction for Autonomous Laboratory Robots

面向自主实验室机器人的神经三维重建跨平台基准测试

Yongho Kim, Mengjiao Han, Victor Mateevitsi, Silvio Rizzi, Michael E. Papka, Nicola Ferrier

机构 * Argonne National Laboratory(阿贡国家实验室) University of Illinois Chicago(芝加哥大学伊利诺伊分校) Northwestern University(西北大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 本研究针对自主实验室机器人的神经三维重建,开展跨平台基准测试,评估NeRF、3D Gaussian Splatting及SAM3D的性能,为构建分层重建流水线提供依据。

Comments This manuscript is peer-reviewed from the committees in the workshop "VAxAutoSci: Visual Analytics in the Age of Autonomous Scientific Discovery" in conjunction with 2026 IEEE Visualization & Visual Analytics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11637 2026-08-28 cs.AI 版本更新 57%

TouchThinker: Scaling Tactile Commonsense Reasoning to the Open World with Large-scale Data and Action-aware Representation

TouchThinker: 通过大规模数据和动作感知表示将触觉常识推理扩展到开放世界

Kailin Lyu, Di Wu, Pengwei Zhang, Yuhang Zheng, Yingxin Lai, Long Xiao, Kangyi Wu, Pengna Li, Chen Gao, Lianyu Hu, Xiaobin Hu, Jie Hao, Ce Hao, Weihao Yuan, Shuicheng Yan

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) National University of Singapore(新加坡国立大学) Zhongguancun Academy(中关村学院) Xiamen University(厦门大学) Xi’an Jiaotong University(西安交通大学) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 提出TouchThinker框架,通过构建百万级多源触觉数据集TouchThinker-1M和动作感知建模,将触觉常识推理扩展到开放世界,在多个数据集上取得竞争性表现。

Comments 18 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03345 2026-08-28 cs.AI cs.CL 版本更新 57%

Do Language Models Follow Occam's Razor? An Evaluation of Parsimony in Inductive and Abductive Reasoning

语言模型遵循奥卡姆剃刀吗?对归纳和反向推理中简约性的评估

Yunxin Sun, Abulhair Saparov

机构 * Purdue University(普渡大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 本文评估大型语言模型在归纳和反向推理中是否遵循奥卡姆剃刀原则,通过生成综合推理问题测试其在简单和复杂场景中的表现,发现模型在复杂世界模型中难以生成高质量假设。

Comments Accepted at EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04570 2026-08-28 cs.CR 版本更新 50%

PINsight: Systematic Threat Assessment of Cross-Domain Wi-Fi-based PIN Inference

PINsight:跨域Wi-Fi PIN推断的系统性威胁评估

Johannes Kortz, Christof Paar, Christian Zenger, Paul Staat

专题命中 机器人数据与评测 :robotic(abstract)

AI总结 PINsight通过构建首个Wi-Fi PIN推断跨域泛化基准,评估了WiKI-Eve等攻击的实际威胁,发现攻击在设备重定位时性能大幅下降,此前结果夸大了其现实威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26119 2026-08-28 cs.CL 新提交 50%

DeflectBench: A Benchmark for Evaluating Rhetorical Fallacy Generation in LLMs

DeflectBench:评估大语言模型中修辞谬误生成的基准

Art Kanke

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 DeflectBench评估四个前沿大语言模型在三种修辞谬误生成任务中的表现,发现拒绝率主要由提示框架和谬误类型决定,教育辩论教练提示可大幅降低拒绝率,且各模型的合规行为分布存在差异。

Comments 15 pages. Accepted at the CTB, FAGEN, and AI4GOOD workshops at ICML 2026 in Seoul, South Korea. Code and dataset: this https URL (https://github.com/ArtKanke/DeflectBench)

详情

展开后加载摘要…

URL PDF HTML 收藏