arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

2026-04-15 至 2026-04-15 共收录 4 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 通用世界模型 4 篇

2603.07083 2026-04-15 cs.LG 93%

Dreamer-CDP: Improving Reconstruction-free World Models Via Continuous Deterministic Representation Prediction

Dreamer-CDP: 通过连续确定性表示预测改进无重建世界模型

Michael Hauri, Friedemann Zenke

专题命中 通用世界模型 :world model(title,abstract);world models(title);world model(title,abstract);world models(title)

AI总结 本文提出Dreamer-CDP,通过连续确定性表示预测提升世界模型性能,在Crafter环境中达到与传统重建方法相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10226 2026-04-15 cs.CV cs.RO 88%

Latent Chain-of-Thought World Modeling for End-to-End Driving

潜在链式思维世界建模用于端到端驾驶

Shuhan Tan, Kashyap Chitta, Yuxiao Chen, Ran Tian, Yurong You, Yan Wang, Wenjie Luo, Yulong Cao, Philipp Krahenbuhl, Marco Pavone, Boris Ivanovic

机构 * UT Austin(得克萨斯大学奥斯汀分校) NVIDIA(英伟达) Stanford University(斯坦福大学)

专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);分类 cs.CV、cs.RO

AI总结 本文提出Latent-CoT-Drive模型,通过潜在语言整合链式思维推理与决策,提升驾驶性能与安全性,实现更快推理和更优轨迹质量。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22039 2026-04-15 cs.CV 84%

SparseWorld-TC: Trajectory-Conditioned Sparse Occupancy World Model

SparseWorld-TC: 基于轨迹的稀疏占用世界模型

Jiayuan Du, Yiming Zhao, Zhenglong Guo, Yong Pan, Wenbo Hou, Zhihui Hao, Kun Zhan, Qijun Chen

机构 * Tongji University(同济大学) Li Auto Inc(力汽车公司)

专题命中 通用世界模型 :world model(title);world model(title);分类 cs.CV

AI总结 本文提出了一种基于轨迹的未来3D场景占用预测新架构,通过端到端方式直接从原始图像特征预测多帧占用,避免了离散token化和BEV表示的限制,实现了nuScenes基准上的1-3秒占用预测最优性能。

Comments Accepted by CVPR2026 as an oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12765 2026-04-15 cs.CV cs.GR 56%

A Dataset and Evaluation for Complex 4D Markerless Human Motion Capture

一个用于复杂4D无标记人体运动捕捉的 数据集和评估

Yeeun Park, Miqdad Naduthodi, Suryansh Kumar

机构 * Visual and Spatial AI Lab(视觉与空间人工智能实验室) VCCM Section College of PVFA(VCCM学院物理与虚拟现实学院) Department of ECEN(电子工程系) Department of CSCE(计算机科学与工程系) Texas A&M University(德克萨斯农工大学)

专题命中 通用世界模型 :world model(comments);world models(comments);分类 cs.CV;world model(comments)

AI总结 本文提出一个复杂4D无标记人体运动捕捉的数据集和评估,包含单人和多人场景,涵盖复杂运动、频繁人与人遮挡、快速位置交换和不同距离变化,验证了现有方法在真实条件下的性能不足。

Comments 14 pages, 11 figures, 4 tables. Accepted for publication at CVPR 2026 4D World Models Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏