机构
*
National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室)
;
National Engineering Research Center for Visual Information and Applications(视觉信息与应用国家工程研究中心)
;
Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院)
;
Xi’an Jiaotong University(西安交通大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Osaka University(大阪大学)
专题命中
图文多模态
:multimodal(abstract);分类 cs.CV、cs.AI
CommentsAccepted by IEEE Transactions on Information Forensics & Security
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能研究院,清华大学)
;
Gaoling School of Artificial Intelligence, Renmin University of China(人工智能学院,中国人民大学)
;
Kuaishou Technology Inc.(快手科技有限公司)
;
Shanghai Key Laboratory of Multi. Info. Processing, East China Normal University(多信息处理重点实验室,华东师范大学)
Proactive Disentangled Modeling of Trigger-Object Pairings for Backdoor Defense
Kyle Stein, Andrew A. Mahyari, Guillermo Francia, Eman El-Sheikh
机构
*
Department of Intelligent Systems and Robotics, University of West Florida(智能系统与机器人系,西佛罗里达大学)
;
Florida Institute For Human and Machine Cognition (IHMC)(佛罗里达人类与机器认知研究所)
;
Center for Cybersecurity, University of West Florida(网络安全中心,西佛罗里达大学)
INTER: Mitigating Hallucination in Large Vision-Language Models by Interaction Guidance Sampling
Xin Dong, Shichao Dong, Jin Wang, Jing Huang, Li Zhou, Zenghui Sun, Lihua Jing, Jingsong Lan, Xiaoyong Zhu, Bo Zheng
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
The University of Hong Kong(香港大学)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
Unveiling Effective In-Context Configurations for Image Captioning: An External & Internal Analysis
Li Li, Yongliang Wu, Jingze Zhu, Jiawei Peng, Jianfei Cai, Xu Yang
机构
*
School of Computer Science & Engineering, Key Lab of New Generation Artificial Intelligence Technology & Its Interdisciplinary Applications (Ministry of Education), Southeast University, China(计算机科学与工程学院,新一代人工智能技术及跨学科应用重点实验室,东南大学,中国)
;
Faculty of IT, Monash University, Australia(信息科技学院,墨尔本大学,澳大利亚)
;
School of Computer Science & Engineering, Southeast University, China(计算机科学与工程学院,东南大学,中国)
MVL-Loc: Leveraging Vision-Language Model for Generalizable Multi-Scene Camera Relocalization
Zhendong Xiao, Wu Wei, Shujie Ji, Shan Yang, Changhao Chen
机构
*
School of Automation Science and Engineering, South China University of Technology(自动化科学与工程学院,华南理工大学)
;
Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(人工智能方向,香港科学与技术大学(广州))