arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

2026-01-01 至 2026-01-01 共收录 3 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 通用世界模型 2 篇

2505.20425 2026-01-01 cs.RO 90%

OSVI-WM: One-Shot Visual Imitation for Unseen Tasks using World-Model-Guided Trajectory Generation

OSVI-WM:通过世界模型引导轨迹生成实现单次视觉模仿

Raktim Gautam Goswami, Prashanth Krishnamurthy, Yann LeCun, Farshad Khorrami

机构 * New York University Tandon School of Engineering(纽约大学Tandon工程学院) New York University Courant Institute of Mathematical Sciences(纽约大学Courant数学科学研究所) Meta-FAIR

专题命中 通用世界模型 :world-model(title,abstract);world-model(title,abstract);world model(abstract);world model(abstract)

AI总结 OSVI-WM通过世界模型引导轨迹生成,实现对未见任务的单次视觉模仿学习,提升机器人执行复杂任务的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23722 2026-01-01 cs.CL 80%

Emergent World Beliefs: Exploring Transformers in Stochastic Games

涌现的世界信念:探索变换器在随机游戏中的应用

Adam Kamel, Tanish Rastogi, Michael Ma, Kailash Ranganathan, Kevin Zhu

机构 * University of Waterloo(多伦多大学) University of California, Berkeley(加州大学伯克利分校) Algoverse AI Research(Algoverse人工智能研究)

专题命中 通用世界模型 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)

AI总结 本文研究了LLMs在扑克等信息不完全领域中学习随机环境表示的能力,通过预训练和内部激活探测,展示了模型能自主学习确定性和随机性特征。

Comments Accepted at NeurIPS 2025 Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 模型式强化学习 1 篇

2512.24102 2026-01-01 cs.LG 50%

Autoregressivity in the Latent Space of a GP-VAE Language Model: An Empirical Ablation Study

在GP-VAE语言模型的潜在空间中的自回归性:一项经验消融研究

Yves Ruffenach

机构 * Conservatoire National des Arts et Métiers(法国国家艺术与工艺学院)

专题命中 模型式强化学习 :latent dynamics(abstract);分类 cs.LG

AI总结 本文通过实验验证了GP-VAE中潜在自回归在组织长距离结构中的有效性,并展示了其与令牌级自回归建模的互补性。

Comments A focused ablation study analyzing the role of latent autoregression in GP-VAE models

详情

展开后加载摘要…

URL PDF HTML 收藏