ThinkFake: Reasoning in Multimodal Large Language Models for AI-Generated Image Detection
专题命中 视觉推理 :multimodal large language model(title,abstract);MLLM(abstract);分类 cs.CV
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 视觉推理 :multimodal large language model(title,abstract);MLLM(abstract);分类 cs.CV
机构 * Harvard Medical School, Harvard University(哈佛医学院、哈佛大学) ; Athinoula A. Martinos Center for Biomedical Imaging, Massachusetts General Hospital(阿提尼乌拉A.马丁努斯生物医学成像中心、麻省总医院) ; Knovel Engineering Lab, Singapore(Knovel工程实验室、新加坡)
专题命中 视觉推理 :vision-language model(title);分类 cs.CV
机构 * Tsinghua University(清华大学) ; Shanghai Jiao Tong University(上海交通大学) ; Galbot ; Peking University(北京大学) ; UIUC(伊利诺伊大学香槟分校) ; ShanghaiTech University(上海交通大学) ; Eastern Institute of Technology(技术研究所) ; Shanghai Qi Zhi Institute(上海启智研究院)
专题命中 视觉推理 :VLM(abstract);grounding(abstract);分类 cs.CV、cs.AI
Comments Accepted at NeurIPS 2025 Spotlight
机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) ; Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心) ; Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院)
专题命中 视觉推理 :MLLM(abstract);分类 cs.AI
Comments Accepted by IEEE CASM
机构 * New Laboratory of Pattern Recognition (NLPR) Institute of Automation, Chinese Academy of Scieneces(模式识别新实验室(NLPR)自动化研究所,中国科学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
专题命中 视觉推理 :grounding(abstract);分类 cs.AI
Comments Accepted by Machine Intelligence Research (MIR)