Model-based Reinforcement Learning with a Hamiltonian Canonical ODE Network
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);environment model(abstract)
视觉与机器人
面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);environment model(abstract)
基于模型的强化学习中的性能不对称性
机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) ; School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家) ; National University of Singapore(新加坡国立大学)
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.LG、cs.RO
AI总结 本文提出JEDI世界模型,通过解决基于模型的强化学习中的性能不对称问题,在Human-Optimal任务和Breakout上取得最优成绩,同时提升计算效率。
Comments Preprint
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.CV
Comments AAAI 2023
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.LG、cs.RO
专题命中 模型式强化学习 :model-based reinforcement learning(title);world model(abstract);world model(abstract);model-based RL(abstract)
利用真实世界视频学习粒子动力学模型
机构 * Oregon State University(俄勒冈州立大学)
专题命中 模型式强化学习 :world model(abstract);world models(abstract);dynamics model(title,abstract);world model(abstract)
AI总结 提出一种从无标签真实视频直接训练神经物体动力学模型的框架,结合高斯溅射技术,通过渲染监督学习粒子位置和旋转变化,避免对合成数据的依赖。
Comments CVPR 2026 Findings
视频JEPA中的因子化潜在动态:辅助目标的实证研究
机构 * Adhikari(阿迪卡里)
专题命中 模型式强化学习 :latent dynamics(title,abstract);world-model(abstract);world-model(abstract);分类 cs.LG、cs.CV
AI总结 本研究探讨了视频JEPA中辅助目标的实证效果,通过对比不同辅助目标变体,发现潜在表示的因子化方法在提升某些能力的同时可能降低其他能力,FWM-HW-LD在混合数据集下提升了ImageNet-100和SSv2的性能。
通过多任务模型基于强化学习掌握人形控制
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.RO
AI总结 本文提出EfficientZero-Multitask算法,通过多任务模型基于强化学习提升人形机器人控制性能,实现高效样本利用和高任务适应性。
通过联合优化的世界-动作模型扩展离线模型基于的强化学习
机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; Alibaba Group(阿里巴巴集团)
专题命中 模型式强化学习 :model-based RL(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
AI总结 JOWA通过联合优化的世界-动作模型扩展离线RL,实现高效泛化和高性能
Comments Accepted by ICLR 2025
medDreamer:基于复杂电子病历的潜在想象的模型驱动强化学习用于临床决策支持
机构 * National University of Singapore(新加坡国立大学)
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
AI总结 medDreamer通过结合潜在想象和自适应特征集成模块,实现基于复杂电子病历的模型驱动强化学习,以提升个性化治疗推荐的性能。
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
Comments Accepted at NeurIPS 2024
专题命中 模型式强化学习 :model-based RL(title);world model(abstract);world model(abstract);model-based reinforcement learning(abstract)
Comments Accepted by European Conference on Artificial Intelligence (ECAI) 2024
专题命中 模型式强化学习 :model-based reinforcement learning(title);world model(abstract);world model(abstract);model-based RL(abstract)
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
Comments AAMAS'2022, cite https://dl.acm.org/doi/abs/10.5555/3535850.3535894
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
专题命中 模型式强化学习 :model-based reinforcement learning(title);world model(abstract);world model(abstract);model-based RL(abstract)
Comments 21 pages, 8 figures, 7 tables
解锁哈密顿视频动力学模型中的时间泛化
机构 * Department of Computer Science, Southern Methodist University(南卫理公会大学计算机科学系)
专题命中 模型式强化学习 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)
AI总结 研究世界模型在可变时间分辨率下预测动力学的问题,利用哈密顿生成网络(HGN),指出其在非保守环境中时间泛化失效的问题及原因,通过针对性修复实现稳定动力学预测,推荐连续时间视频生成中时间泛化的策略。
Comments To appear in the 1st Workshop on Physics-Aware Video Generation and Restoration at the 28th International Conference on Pattern Recognition
DynaWeb:基于模型的Web代理强化学习
机构 * Shanghai Jiao Tong University(上海交通大学) ; Sichuan University(四川大学) ; Hong Kong University of Science and Technology(香港科学与技术大学) ; McGill University(麦吉尔大学) ; Shanghai AI Lab(上海人工智能实验室) ; Gradient ; University of Toronto(多伦多大学) ; Mila - Quebec AI Institute(魁北克AI研究所)
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.AI
AI总结 本文提出DynaWeb框架,通过模拟环境提升Web代理的强化学习效率,实验表明其在WebArena和WebVoyager基准上显著提升性能。
机构 * Faculty of Aerospace Engineering, Delft University of Technology(航空航天工程学院,代尔夫特理工大学)
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);world model(abstract);world model(abstract);分类 cs.RO
专题命中 模型式强化学习 :model-based RL(title,abstract);world model(abstract);world model(abstract);分类 cs.LG
Comments In Reinforcement Learning Conference, 2024. 10 pages, 22 pages total, 10 figures
Journal ref Reinforcement Learning Journal, 2024
专题命中 模型式强化学习 :model-based RL(title,abstract);model-based reinforcement learning(abstract);model based RL(abstract);分类 cs.AI、cs.LG、cs.RO
Comments Published in International Conference on Learning Representations (ICLR 2022)
有偏的梦境:潜在空间模型中知识不确定性量化限制
专题命中 模型式强化学习 :latent dynamics(title,abstract);dynamics model(title,abstract);model-based reinforcement learning(abstract);分类 cs.LG
AI总结 研究探讨了潜在空间模型中知识不确定性量化存在的偏差问题,指出潜在过渡偏向于高代表性的区域,导致环境动态差异在潜在空间中不显现,影响不确定性估计的可靠性。
Comments Reinforcement Learning Conference (RLC) 2026
专题命中 模型式强化学习 :latent dynamics(title);model-based reinforcement learning(abstract);dynamics model(title);分类 cs.AI、cs.LG、cs.CV
Comments To appear at the 3rd annual Conference on Robot Learning, Osaka, Japan (CoRL 2019). 24 pages including appendix (main paper - 8 pages)
基于联合状态-动作学习嵌入的多智能体模型驱动强化学习
机构 * McGill University(麦吉尔大学)
专题命中 模型式强化学习 :model-based reinforcement learning(title);world model(abstract);world model(abstract);分类 cs.LG、cs.MA
AI总结 本文提出了一种基于联合状态-动作学习嵌入的多智能体模型驱动强化学习框架,通过统一表示学习与想象式回放,提升智能体在动态环境中协调能力与长期规划效率。
Comments 22 pages
专题命中 模型式强化学习 :model-based reinforcement learning(title);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
Comments Will be presented at the RL Safety Workshop at RLC 2024
专题命中 模型式强化学习 :model-based RL(title,abstract);model-based reinforcement learning(abstract);分类 cs.AI、cs.LG;dynamics model(abstract)
Comments ICML 2023
专题命中 模型式强化学习 :model-based reinforcement learning(title);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
Comments 13 pages, 7 figures
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);model-based RL(abstract);分类 cs.AI、cs.LG、cs.RO;dynamics model(abstract)
Comments Published at the Conference on Robot Learning (CoRL) 2022. Website: https://clvrai.com/skimo
专题命中 模型式强化学习 :model-based reinforcement learning(title,abstract);model-based RL(abstract);分类 cs.AI、cs.LG、cs.RO
Comments CoRL 2020. The video is available at: https://youtu.be/-ydXHUtPzWE
专题命中 模型式强化学习 :model-based reinforcement learning(title);world model(abstract);world model(abstract);分类 cs.AI、cs.LG
Comments 9 pages, 6 figures