arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2025-12-30 至 2025-12-30 共收录 6 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身推理 6 篇

2512.23541 2025-12-30 cs.RO cs.AI 86%

Act2Goal: From World Model To General Goal-conditioned Policy

Act2Goal:从世界模型到通用目标条件政策

Pengfei Zhou, Liliang Chen, Shengcong Chen, Di Chen, Wenzhi Zhao, Rongjun Jin, Guanghui Ren, Jianlan Luo

机构 * Agibot Research(阿吉博特研究所)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 Act2Goal通过结合视觉世界模型与多尺度时间控制,实现目标条件政策的鲁棒长时间尺度操作,提升机器人在新环境中的自主适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.13461 2025-12-30 cs.LG cs.AI cs.CV cs.NE q-bio.NC 82%

Active Predictive Coding: A Unified Neural Framework for Learning Hierarchical World Models for Perception and Planning

主动预测编码:一种统一的神经框架,用于学习感知与规划的分层世界模型

Rajesh P. N. Rao, Dimitrios C. Gklezakos, Vishwas Sathish

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出主动预测编码框架,通过分层世界模型解决人工智能中感知与规划的两大核心问题。

Comments 15 pages, 10 figures, 2 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23676 2025-12-30 cs.AI cs.CL cs.CV 81%

Web World Models

Jichen Feng, Yifan Zhang, Chenggong Zhang, Yifu Lu, Shilong Liu, Mengdi Wang

机构 * Princeton University(普林斯顿大学) University of California(加州大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV

Comments Project Page: https://github.com/Princeton-AI2-Lab/Web-World-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06952 2025-12-30 cs.LG cs.AI 81%

What Has a Foundation Model Found? Using Inductive Bias to Probe for World Models

基础模型发现了什么?利用归纳偏置来探测世界模型

Keyon Vafa, Peter G. Chang, Ashesh Rambachan, Sendhil Mullainathan

机构 * Harvard University(哈佛大学) MIT(麻省理工学院)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究通过归纳偏置探测技术揭示基础模型在适应新任务时无法捕捉底层世界模型结构的问题。

Comments To appear in ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22336 2025-12-30 cs.AI cs.CL 79%

Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback

Agent2World: 通过自适应多智能体反馈学习生成符号世界模型

Mengkang Hu, Bowei Xia, Yuran Wu, Ailing Yu, Yude Zou, Qiguang Chen, Shijian Wang, Jiarui Jin, Kexin Li, Wenxiang Jiao, Yuan Lu, Ping Luo

机构 * The University of Hong Kong(香港大学) Xiaohongshu Inc.(小红书公司) UESTC(电子科技大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 Agent2World通过自适应多智能体反馈学习生成符号世界模型,提升推理和微调性能,实现30.95%的相对提升。

Comments 48 pages, 15 tables, 7 figures, Project page: https://agent2world.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22771 2025-12-30 cs.CV cs.AI 62%

Next Best View Selections for Semantic and Dynamic 3D Gaussian Splatting

语义与动态3D高斯散射的下一最佳视角选择

Yiqian Li, Wen Jiang, Kostas Daniilidis

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 具身推理 :embodied agent(abstract);分类 cs.AI、cs.CV

AI总结 本文提出基于Fisher信息的主动学习算法,用于语义与动态3D高斯散射的视角选择,提升渲染质量和语义分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏