RAU: Reference-based Anatomical Understanding with Vision Language Models
Yiwei Li, Yikang Liu, Jiaqi Guo, Lin Zhao, Zheyuan Zhang, Xiao Chen, Boris Mailhe, Ankush Mukherjee, Terrence Chen, Shanhui Sun
机构
*
United Imaging Intelligence(联合影像智能)
;
School of Computing, University of Georgia(佐治亚大学计算机学院)
;
Department of Electrical and Computer Engineering, Northwestern University(西北大学电气与计算机工程系)
专题命中
视觉问答
:vision language model(title);vision-language model(abstract);VLM(abstract);visual reasoning(abstract)
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所模式识别实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Kling Team, Kuaishou Technology(快手科技 Kling 团队)
;
Peking University(北京大学)
;
Nanjing University(南京大学)
专题命中
视觉问答
:multimodal large language model(abstract);分类 cs.CV、cs.AI
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院)
;
Pengcheng Laboratory(鹏城实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
专题命中
视觉推理
:multimodal large language model(title,abstract);grounding(abstract);分类 cs.CV
机构
*
University of California, San Diego(加州大学圣地亚哥分校)
;
ByteDance(字节跳动)
;
University of California, Merced(加州大学默塞德分校)
;
University of Southern California(南加州大学)
;
University at Buffalo(布法罗大学)
;
The University of Queensland(昆士兰大学)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Fudan University(复旦大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai Innovation Institute(上海创新研究院)
Training-Free Multimodal Deepfake Detection via Graph Reasoning
Yuxin Liu, Fei Wang, Kun Li, Yiqi Nie, Junjie Chen, Yanyan Wei, Zhangling Duan, Zhaohong Jia
机构
*
School of Internet, Anhui University, Hefei, China(安徽大学互联网学院)
;
School of Computer Science and Information Engineering, Hefei University of Technology, Hefei, China(合肥工业大学计算机科学与信息工程学院)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center, Hefei, China(合肥综合国家科学中心人工智能研究院)
;
Department of Computer Science, Hong Kong Baptist University, Hong Kong, China(香港 Baptist 大学计算机科学系)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Sichuan University(四川大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
University of Macau(澳门大学)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
视觉推理
:multimodal large language model(abstract)
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
SenseTime Research(商汤科技研究院)
;
Tsinghua University(清华大学)
;
Nanjing University(南京大学)
;
Fudan University(复旦大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai Jiao Tong University(上海交通大学)
专题命中
视觉定位与Grounding
:InternVL(abstract);grounding(abstract);multimodal large language model(abstract);MLLM(abstract)
机构
*
University of California, San Diego(加州大学圣地亚哥分校)
;
ByteDance(字节跳动)
;
The University of Queensland(昆士兰大学)
;
University of Southern California(南加州大学)
;
University at Buffalo(布法罗大学)
;
University of California, Merced(加州大学默塞德分校)
Phrase-grounded Fact-checking for Automatically Generated Chest X-ray Reports
Razi Mahmood, Diego Machado-Reyes, Joy Wu, Parisa Kaviani, Ken C. L. Wong, Niharika D'Souza, Mannudeep Kalra, Ge Wang, Pingkun Yan, Tanveer Syeda-Mahmood
机构
*
Rensselaer Polytechnic Institute, NY, USA(罗文学院)
;
IBM Research, Almaden, CA, USA(IBM研究院)
;
Stanford University, CA, USA(斯坦福大学)
;
Massachusetts General Hospital (MGH), Boston, USA(麻省总医院)
专题命中
视觉定位与Grounding
:vision language model(abstract);VLM(abstract);分类 cs.CV、cs.AI
机构
*
Nanjing University of Science and Technology(南京理工大学)
;
Intellifusion Inc.(Intellifusion公司)
;
Northwestern Polytechnical University(西北工业大学)
;
Zhejiang Lab(浙江实验室)
;
Yan’an University(延安大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
Design and Implementation of a Secure RAG-Enhanced AI Chatbot for Smart Tourism Customer Service: Defending Against Prompt Injection Attacks -- A Case Study of Hsinchu, Taiwan
Yu-Kai Shih, You-Kai Kang
机构
*
Department of Information Management, National Dong Hwa University(信息管理系,国立东华大学)
;
By The Student (BTS) Experimental Education Program (Non-School Type)(学生(BTS)实验教育计划(非学校类型))
MotivGraph-SoIQ: Integrating Motivational Knowledge Graphs and Socratic Dialogue for Enhanced LLM Ideation
Xinping Lei, Tong Zhou, Yubo Chen, Kang Liu, Jun Zhao
机构
*
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems(认知与决策智能复杂系统重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Hunan Provincial Key Laboratory of Philosophy and Social Sciences of Artificial Intelligence and Precision International, Hunan Normal University(湖南省人工智能与精准哲学社会科学省级重点实验室,湖南师范大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)