Understanding World or Predicting Future? A Comprehensive Survey of World Models
理解世界还是预测未来?世界模型的全面综述
Jingtao Ding, Yunke Zhang, Yu Shang, Jie Feng, Yuheng Zhang, Zefang Zong, Yuan Yuan, Hongyuan Su, Nian Li, Jinghua Piao, Yucheng Deng, Nicholas Sukiennik, Chen Gao, Fengli Xu, Yong Li
机构
*
Department of Electronic Engineering, Beijing National Research Center for Information Science and Technology (BNRist), Tsinghua University(电子工程系,信息科学与技术国家研究中心(BNRist),清华大学)
专题命中
其他VLM
:multimodal large language model(abstract);分类 cs.AI、cs.LG
AI总结
本文综述了世界模型在理解与预测方面的功能,探讨了其在多个领域的应用及未来研究方向。
CommentsExtended version of the original ACM CSUR paper, 49 pages, 6 figures, 8 tables
机构
*
Department of Mechanical Engineering, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院机械工程系)
;
Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院电气工程与计算机科学系)
;
Department of Computer Science, Technical University of Munich, Munich, Germany(慕尼黑技术大学计算机科学系)
Amirmojtaba Sabour, Michael S. Albergo, Carles Domingo-Enrich, Nicholas M. Boffi, Sanja Fidler, Karsten Kreis, Eric Vanden-Eijnden
机构
*
NVIDIA(NVIDIA公司)
;
University of Toronto(多伦多大学)
;
Vector Institute(向量研究所)
;
Harvard University(哈佛大学)
;
Kempner Institute(凯姆纳研究所)
;
IAIFI(IAIFI机构)
;
Microsoft Research(微软研究院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Courant Institute, New York University(纽约大学应用数学学院)
;
ML Lab at Capital Fund Management (CFM)(Capital Fund Management (CFM)机器学习实验室)
专题命中
其他VLM
:vision language model(abstract);分类 cs.AI、cs.LG
Find Them All: Unveiling MLLMs for Versatile Person Re-identification
找到它们全部:揭示MLLMs用于多功能人物重识别
Jinhao Li, Zijian Chen, Lirong Deng, Guangtao Zhai, Changbo Wang
机构
*
School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院)
;
Institute of Image Communication and Information Processing, Shanghai Jiao Tong University(上海交通大学图像通信与信息处理研究所)
;
Macao Polytechnic University(澳门 polytechnic 大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
Hierarchical Semantic Tree Anchoring for CLIP-Based Class-Incremental Learning
基于CLIP的层次语义树锚定的类增量学习
Tao Hu, Lan Li, Zhen-Hao Xie, Da-Wei Zhou
机构
*
School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学)
;
State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)
机构
*
National University of Singapore(新加坡国立大学)
;
Communication University of China(中国传媒大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Hefei University of Technoloy(合肥工业大学)
专题命中
其他VLM
:multimodal large language model(abstract);分类 cs.CV、cs.AI
FedMGP: Personalized Federated Learning with Multi-Group Text-Visual Prompts
Weihao Bo, Yanpeng Sun, Yu Wang, Xinyu Zhang, Zechao Li
机构
*
Nanjing University of Science and Technology(南京理工大学)
;
National University of Singapore(新加坡国立大学)
;
Baidu VIS(百度视觉部)
;
University of Auckland(奥克兰大学)
MIRROR: Multimodal Cognitive Reframing Therapy for Rolling with Resistance
Subin Kim, Hoonrae Kim, Jihyun Lee, Yejin Jeon, Gary Geunbae Lee
机构
*
KT Corporation, Republic of Korea(韩国KT公司)
;
Graduate School of Artificial Intelligence, POSTECH, Republic of Korea(POSTECH人工智能研究生院)
;
Computer Science and Engineering, POSTECH, Republic of Korea(POSTECH计算机科学与工程系)
专题命中
其他VLM
:vision language model(abstract);分类 cs.CV、cs.AI
机构
*
School of Cyberspace Science and Technology, Beijing Institute of Technology(信息空间科学与技术学院,北京理工大学)
;
School of Information Engineering, Minzu University of China(信息工程学院,民族大学)
;
Australian Institute of Machine Learning, The University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学)
专题命中
其他VLM
:multimodal large language model(abstract);分类 cs.AI、cs.LG
Cooperative Pseudo Labeling for Unsupervised Federated Classification
Kuangpu Guo, Lijun Sheng, Yongcan Yu, Jian Liang, Zilei Wang, Ran He
机构
*
University of Science and Technology of China(中国科学技术大学)
;
NLPR & MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
专题命中
其他VLM
:vision language model(abstract);分类 cs.CV、cs.LG