arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

2026-05-25 至 2026-05-25 共收录 7 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 通用世界模型 7 篇

2605.23220 2026-05-25 cs.LG 92%

WMAttack: Automated Attack Search for Adversarial Evaluation of World-Model Agents

WMAttack:世界模型智能体对抗评估的自动化攻击搜索

Zhixiang Guo, Siyuan Liang, Shi Fu, Cheng Guo, Andras Balogh, Mark Jelasity, Dacheng Tao

机构 * Nanyang Technological University(南洋理工大学) University of Szeged(塞格德大学)

专题命中 通用世界模型 :world-model(title,abstract);world-model(title,abstract);world model(abstract);world models(abstract)

AI总结 提出WMAttack框架,通过自校正攻击搜索和表征引导攻击检索,自动搜索攻击配置以高效评估世界模型智能体的对抗鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11596 2026-05-25 cs.CV 92%

HorizonDrive: Self-Corrective Autoregressive World Model for Long-horizon Driving Simulation

HorizonDrive: 用于长时域驾驶仿真的自纠正自回归世界模型

Conglang Zhang, Yifan Zhan, Qingjie Wang, Zhanpeng Ouyang, Yu Li, Zihao Yang, Xiaoyang Guo, Weiqiang Ren, Qian Zhang, Zhen Dong, Yinqiang Zheng, Wei Yin, Zhengqing Chen

机构 * Wuhan University(武汉大学) The University of Tokyo(东京大学) Horizon Robotics Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);world models(abstract);driving world model(abstract)

AI总结 针对自回归驾驶仿真中教师模型因自身预测漂移导致监督退化的问题,提出HorizonDrive框架,通过计划性滚转恢复(SRR)训练抗漂移教师模型,并利用教师滚转分布匹配蒸馏(TRD)实现长时域监督下的高效学生模型部署。

Comments Comments: 22 pages, 14 figures. Project page: https://zcliangyue.github.io/HorizonDrive Code: https://github.com/zcliangyue/HorizonDrive

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10347 2026-05-25 cs.AI cs.CL 92%

How Mobile World Model Guides GUI Agents?

移动世界模型如何指导GUI代理?

Weikai Xu, Kun Huang, Yunren Feng, Jiaxing Li, Yuhan Chen, Yuxuan Liu, Zhizheng Jiang, Heng Qu, Pengzhi Gao, Wei Liu, Jian Luan, Xiaolin Hu, Bo An

机构 * Nanyang Technological University(南洋理工大学) MiLM Plus, Xiaomi Inc.(小米公司) Independent Researchers(独立研究人员) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Wuhan University(武汉大学) Xiamen University(厦门大学)

专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);world models(abstract);world-model(abstract)

AI总结 本文通过训练四种模态(增量文本、完整文本、扩散图像、可渲染代码)的世界模型,并评估其在下游任务中的效用,发现可渲染代码重建在分布内保真度高,文本反馈对在线分布外执行更鲁棒,世界模型生成的轨迹可提供迁移经验但无法替代原始分布,且对低熵过度自信的代理,后验自省收益有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23025 2026-05-25 cs.LG 90%

World Machine: Towards Generative World Modeling for Time-Series

世界机器:面向时间序列的生成式世界建模

Elton Cardoso do Nascimento, Alexandre da Silva Simões, Esther Luna Colombini, Ricardo Ribeiro Gudwin, Paula Dornhofer Paro Costa

机构 * Universidade Estadual de Campinas (UNICAMP)(坎皮纳斯州立大学) Universidade Estadual Paulista (UNESP)(保罗斯州立大学)

专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);world models(abstract);world models(abstract)

AI总结 提出基于Transformer的潜在状态架构World Machine,用于时间序列生成式世界建模,在合成数据集Toy1D上验证了其超越传统Transformer的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23699 2026-05-25 cs.CV 81%

CRONOS: Benchmarking Counterfactual Physical Consistency in Video Models

CRONOS:视频模型中反事实物理一致性的基准测试

León Begiristain, Olaf Dünkel, Adam Kortylewski

机构 * University of Freiburg(弗莱堡大学) Max Planck Institute for Informatics(马克斯·普朗克信息研究所) CISPA Helmholtz Center for Information Security(哈勒斯海姆信息安全中心)

专题命中 通用世界模型 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)

AI总结 提出CRONOS基准,通过干预视角、场景、物体类别和外观四个因素,评估视频模型在固定物理事件类型下反事实物理一致性的表现,发现现有模型存在显著失败。

Comments 27 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03421 2026-05-25 astro-ph.EP nlin.AO physics.bio-ph physics.pop-ph q-bio.PE 67%

Exo-Daisy World: Revisiting Gaia Theory through an Informational Architecture Perspective

Exo-Daisy World: 通过信息架构视角重新审视盖亚理论

Damian R Sowinski, Gourab Ghoshal, Adam Frank

专题命中 通用世界模型 :world model(abstract);world model(abstract)

AI总结 本研究通过语义信息理论扩展经典Daisy World模型,分析生物圈与行星环境之间的信息流,提出Exo-Daisy World模型并揭示相关性随恒星亮度增强的规律,为天体生物学观测和不可知生物特征识别提供新方法。

Comments 14 pages, 4 figures, 1 appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14083 2026-05-25 cs.LG cs.AI 50%

GeoMAE: Masking Representation Learning for Spatio-Temporal Graph Forecasting with Missing Values

GeoMAE:面向缺失值的时空图预测的掩码表示学习

Songyu Ke, Chenyu Wu, Yuxuan Liang, Huiling Qin, Junbo Zhang, Yu Zheng

机构 * College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院) JD Intelligent Cities Research(京东智能城市研究院) School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Normal University(北京师范大学)

专题命中 通用世界模型 :分类 cs.AI、cs.LG;predictive model(abstract);predictive models(abstract)

AI总结 提出GeoMAE自监督模型,通过输入预处理、注意力时空预测网络和掩码自编码器辅助任务,解决缺失数据下的时空图预测问题,在真实数据集上相对最优基线提升13.20%。

Comments 34 pages for pre-print version. This work has been published in *Neural Networks*. Please check the latest version via the following DOI

详情

展开后加载摘要…

URL PDF HTML 收藏