arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

2026-02-24 至 2026-02-24 共收录 15 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 通用世界模型 12 篇

2602.19634 2026-02-24 cs.LG cs.AI stat.ML 94%

Compositional Planning with Jumpy World Models

基于跳跃世界模型的组合规划

Jesse Farebrother, Matteo Pirotta, Andrea Tirinzoni, Marc G. Bellemare, Alessandro Lazaric, Ahmed Touati

机构 * FAIR at Meta Mila -- Qu\'ebec AI Institute McGill University

专题命中 通用世界模型 :world model(title,abstract);world models(title,abstract);world model(title,abstract);world models(title,abstract)

AI总结 本文提出基于跳跃世界模型的组合规划方法,通过学习多步动态预测模型提升长时间任务的规划性能,实现复杂任务的解决。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18739 2026-02-24 cs.LG 93%

When World Models Dream Wrong: Physical-Conditioned Adversarial Attacks against World Models

当世界模型做梦错误:针对世界模型的物理条件对抗攻击

Zhixiang Guo, Siyuan Liang, Andras Balogh, Noah Lunberry, Rong-Cheng Tu, Mark Jelasity, Dacheng Tao

机构 * Nanyang Technological University(南洋理工大学) University of Szeged(塞格德大学)

专题命中 通用世界模型 :world model(title,abstract);world models(title,abstract);world model(title,abstract);world models(title,abstract)

AI总结 本文提出PhysCond-WMA攻击方法,通过扰动物理条件通道诱导世界模型的语义、逻辑或决策层面的扭曲,揭示生成式世界模型的安全性漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07854 2026-02-24 cs.CV 93%

Geometry-Aware Rotary Position Embedding for Consistent Video World Model

面向一致视频世界模型的几何感知旋转位置嵌入

Chendong Xiang, Jiajun Liu, Jintao Zhang, Xiao Yang, Zhengwei Fang, Shizun Wang, Zijun Wang, Yingtian Zou, Hang Su, Jun Zhu

机构 * Dept. of Comp. Sci. and Tech., Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint ML Center, Tsinghua University(清华大学计算机科学与技术系、人工智能研究院、BNRist中心、THBI实验室、清华-博世联合机器学习中心、清华大学) Gaoling School of Artificial Intelligence, Renmin University of China(北京人民大学人工智能学院) National University of Singapore(新加坡国立大学) Peking University(北京大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

专题命中 通用世界模型 :world model(title,abstract);video world model(title);world model(title,abstract);video world model(title)

AI总结 本文提出ViewRope和几何感知帧稀疏注意力,通过引入相机射线方向提升视频世界模型的长期一致性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20057 2026-02-24 cs.RO cs.AI 92%

AdaWorldPolicy: World-Model-Driven Diffusion Policy with Online Adaptive Learning for Robotic Manipulation

AdaWorldPolicy:基于世界模型的扩散策略与在线自适应学习的机器人操控

Ge Yuan, Qiyuan Qiao, Jing Zhang, Dong Xu

机构 * The University of Hong Kong(香港大学) Beihang University(北航大学)

专题命中 通用世界模型 :world-model(title,abstract);world-model(title,abstract);world model(abstract);world models(abstract)

AI总结 AdaWorldPolicy通过结合世界模型和在线自适应学习,实现机器人操控的高效动态适应。

Comments Homepage: https://AdaWorldPolicy.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19285 2026-02-24 cs.CV 92%

MRI Contrast Enhancement Kinetics World Model

MRI对比增强动力学世界模型

Jindi Kong, Yuting He, Cong Xia, Rongjun Ge, Shuo Li

机构 * Case Western Reserve University(凯斯西储大学) Jiangsu Cancer Hospital(江苏癌症医院) Southeast University(东南大学)

专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);world models(abstract);world-model(abstract)

AI总结 本文提出MRI CEKWorld模型,通过时空一致性学习解决MRI对比增强动力学建模中的时间连续性和内容一致性问题。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.05744 2026-02-24 cs.NE 80%

Deep Learning: Our Miraculous Year 1990-1991

深度学习:我们的奇迹之年 1990-1991

Juergen Schmidhuber

专题命中 通用世界模型 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)

AI总结 本文回顾了1990-1991年作者在深度学习领域的突破性工作,奠定了生成式人工智能的基础,并对后续技术发展产生了深远影响。

Comments 52 pages, over 300 references, 38 illustrations, extending v1 of 4 Oct 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21363 2026-02-24 cs.RO 75%

Towards Bridging the Gap between Large-Scale Pretraining and Efficient Finetuning for Humanoid Control

迈向大规模预训练与高效微调之间的人形机器人控制的桥梁

Weidong Huang, Zhehan Li, Hangxin Liu, Biao Hou, Yao Su, Jingwen Zhang

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) School of Artificial Intelligence, Xidian University(人工智能学院,西安电子科技大学)

专题命中 通用世界模型 :world model(abstract);world model(abstract);model-based RL(abstract);分类 cs.RO

AI总结 本文提出了一种结合大规模预训练与高效微调的方法,利用SAC实现人形机器人零样本部署,并通过基于模型的方法提升适应效率。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19503 2026-02-24 cs.CV 69%

A Text-Guided Vision Model for Enhanced Recognition of Small Instances

一种基于文本引导的视觉模型,用于提升小实例的识别

Hyun-Ki Jung

专题命中 通用世界模型 :world model(abstract);world model(abstract);分类 cs.CV

AI总结 本文提出了一种基于文本引导的改进YOLO-World模型,通过优化主干网络结构提升小物体检测精度和模型轻量化性能。

Comments Accepted for publication in Applied Computer Science (2026)

Journal ref Applied Computer Science, Vol. 22, No. 1, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04847 2026-02-24 cs.LG 69%

Test-Time Adaptation for LLM Agents via Environment Interaction

通过环境交互实现LLM代理的测试时适应

Arthur Chen, Zuxin Liu, Jianguo Zhang, Akshara Prabhakar, Zhiwei Liu, Shelby Heinecke, Silvio Savarese, Victor Zhong, Caiming Xiong

机构 * University of Waterloo(滑铁卢大学) Salesforce AI Research(Salesforce AI研究)

专题命中 通用世界模型 :world model(abstract);world model(abstract);分类 cs.LG

AI总结 通过环境交互实现LLM代理的测试时适应,利用语法对齐和动态接地策略提升代理在复杂环境中的泛化能力。

Comments Our code is available here: https://github.com/r2llab/GTTA

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19689 2026-02-24 econ.GN q-fin.EC 56%

Integrating Predictive Models into Two-Sided Recommendations: A Matching-Theoretic Approach

将预测模型整合到双侧推荐中:一种匹配理论方法

Kazuki Sekiya, Suguru Otani, Yuki Komatsu, Sachio Ohkawa, Shunya Noda

专题命中 通用世界模型 :predictive model(title);predictive models(title)

AI总结 本文提出了一种基于匹配理论的双侧推荐方法,通过引入有效约会指标和曝光受限的deferred acceptance算法,提高匹配效率和公平性,同时减少拥堵。

Comments 33 pages and 4 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01149 2026-02-24 cs.AI cs.LG 50%

A Benchmark of Causal vs. Correlation AI for Predictive Maintenance

因果与相关性AI在预测性维护中的基准测试

Shaunak Dhande, Chutian Ma, Giacinto Paolo Saggese, Paul Smith, Krishna Taduri

机构 * Causify AI Department of Computer Science, University of Maryland, College Park, MD, USA(计算机科学系,马里兰大学,学院公园,MD,美国)

专题命中 通用世界模型 :分类 cs.AI、cs.LG;predictive model(abstract);predictive models(abstract)

AI总结 本研究通过对比因果与相关性AI方法,发现因果模型在预测性维护中能提供更好的成本节约和故障归因能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16336 2026-02-24 cs.LG cs.AI 50%

HAWX: A Hardware-Aware FrameWork for Fast and Scalable ApproXimation of DNNs

HAWX:一种面向硬件的框架,用于快速且可扩展的深度神经网络近似

Samira Nazari, Mohammad Saeed Almasi, Mahdi Taheri, Ali Azarpeyvand, Ali Mokhtari, Ali Mahani, Christian Herglotz

机构 * University of Zanjan(赞詹大学) Brandenburg Technical University(勃兰登堡技术大学) Tallinn University of Technology(塔林技术大学) Shahid Bahonar University(沙希德·巴霍纳大学)

专题命中 通用世界模型 :分类 cs.AI、cs.LG;predictive model(abstract);predictive models(abstract)

AI总结 HAWX通过多级敏感度评分和预测模型,实现深度神经网络近似的快速且可扩展优化,提升效率并支持多种硬件架构。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身与机器人 2 篇

2602.18663 2026-02-24 cs.RO cs.LG 82%

Toward AI Autonomous Navigation for Mechanical Thrombectomy using Hierarchical Modular Multi-agent Reinforcement Learning (HM-MARL)

迈向机械取栓的AI自主导航:基于分层模块多智能体强化学习(HM-MARL)

Harry Robertshaw, Nikola Fischer, Lennart Karstensen, Benjamin Jackson, Xingyu Chen, S. M. Hadi Sadati, Christos Bergeles, Alejandro Granados, Thomas C Booth

专题命中 具身与机器人 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)

AI总结 本研究提出分层模块多智能体强化学习框架,实现机械取栓中双设备自主导航,展示体外导航能力及泛化挑战。

Comments Published in IEEE Robotics and Automation Letters

Journal ref IEEE Robotics and Automation Letters (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19651 2026-02-24 cs.RO cs.AI cs.LG 50%

Denoising Particle Filters: Learning State Estimation with Single-Step Objectives

去噪粒子滤波:基于单步目标的学习状态估计

Lennart Röstel, Berthold Bäuml

机构 * Learning AI for Dextrous Robots Lab, Technical University of Munich(灵活机器人学习人工智能实验室,慕尼黑技术大学)

专题命中 具身与机器人 :分类 cs.AI、cs.LG、cs.RO;dynamics model(abstract)

AI总结 本文提出了一种基于单步目标的去噪粒子滤波方法,通过隐式学习测量模型和动力学模型,实现高效的机器人状态估计,具有可组合性和良好的性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 仿真与规划 1 篇

2602.18694 2026-02-24 cs.LG cs.AI 60%

In-Context Planning with Latent Temporal Abstractions

基于潜在时间抽象的上下文规划

Baiting Luo, Yunuo Zhang, Nathaniel S. Keplinger, Samir Gupta, Abhishek Dubey, Ayan Mukhopadhyay

机构 * Vanderbilt University(范德比大学) William & Mary(威廉与玛丽学院)

专题命中 仿真与规划 :latent dynamics(abstract);分类 cs.AI、cs.LG;dynamics model(abstract)

AI总结 I-TAP通过学习离散时间抽象空间,实现高效且鲁棒的上下文规划,在部分可观测和随机动态环境中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏