arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

2026-04-16 至 2026-04-16 共收录 1 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 视频世界模型 1 篇

2511.17792 2026-04-16 cs.CV cs.RO 96%

Target-Bench: Can Video World Models Achieve Mapless Path Planning with Semantic Targets?

Target-Bench: 视频世界模型能否在语义目标下实现无地图路径规划?

Dingrui Wang, Zhihao Liang, Hongyuan Ye, Zhexiao Sun, Zhaowei Lu, Yuchen Zhang, Yuyu Zhao, Yuan Gao, Marvin Seegert, Finn Schäfer, Haotong Qin, Wei Li, Luigi Palmieri, Felix Jahncke, Mattia Piccinini, Johannes Betz

机构 * TUM(慕尼黑技术大学) Bosch AI Center(博世人工智能中心) ETH(苏黎世联邦理工学院) NJU(南京大学)

专题命中 视频世界模型 :world model(title,abstract);world models(title,abstract);video world model(title,abstract);world model(title,abstract)

AI总结 Target-Bench首次评估视频世界模型的语义推理、空间估计和规划能力,通过450个机器人采集场景和5个互补指标揭示当前模型在语义推理与视觉生成间的显著差距。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏