机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems(多模态人工智能系统国家重点实验室)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
University of Science and Technology Beijing(北京科技大学)
;
Hunan University of Science and Technology(湖南科技大学)
;
Shanxi University of Finance and Economics(山西财经大学)
;
Beijing Friendship Hospital, Capital Medical University(首都医科大学北京友谊医院)
Vision Language Models Know Law of Conservation without Understanding More-or-Less
Dezhi Luo, Haiyun Lyu, Qingying Gao, Haoran Sun, Yijiang Li, Hokin Deng
机构
*
University of Michigan(密歇根大学)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Carnegie Mellon University(卡内基梅隆大学)
专题命中
VLM训练与架构
:vision language model(title,abstract);分类 cs.AI
CommentsPublished at the ICLR 2025 Workshop on Bidirectional Human-AI Alignment (BiAlign)