机构
*
South China University of Technology(华南理工大学)
;
Sun Yat-sen University(中山大学)
;
Hangzhou Dianzi University(杭州电子科技大学)
;
Zhejiang University of Finance & Economics(浙江财经大学)
;
National University of Singapore(新加坡国立大学)
;
Shenzhen Research Institute of Big Data(深圳大数据研究院)
;
City University of Hong Kong(香港城市大学)
VLMs Guided Interpretable Decision Making for Autonomous Driving
Xin Hu, Taotao Jing, Renran Tian, Zhengming Ding
机构
*
Department of Computer Science, Tulane University(路易斯安那大学计算机科学系)
;
Qualcomm(高通公司)
;
Department of Industrial and Systems Engineering, North Carolina State University(北卡罗来纳州立大学工业与系统工程系)
Tracing and Mitigating Hallucinations in Multimodal LLMs via Dynamic Attention Localization
Tiancheng Yang, Lin Zhang, Jiaye Lin, Guimin Hu, Di Wang, Lijie Hu
机构
*
MBZUAI
;
Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能与数据分析实验室)
;
King Abdullah University of Science and Technology(卡迪夫大学科学与技术大学)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉科学学院)
;
University of Copenhagen(哥本哈根大学)
;
Tsinghua University(清华大学)
专题命中
视觉问答
:visual question answering(abstract);multimodal large language model(abstract);分类 cs.CV
OIDA-QA: A Multimodal Benchmark for Analyzing the Opioid Industry Documents Archive
Xuan Shen, Brian Wingenroth, Zichao Wang, Jason Kuen, Wanrong Zhu, Ruiyi Zhang, Yiwei Wang, Lichun Ma, Anqi Liu, Hongfu Liu, Tong Sun, Kevin S. Hawkins, Kate Tasker, G. Caleb Alexander, Jiuxiang Gu
专题命中
视觉问答
:grounding(abstract);multimodal large language model(abstract);分类 cs.AI
CommentsAccepted by AAAI 2026 Artificial Intelligence for Social Impact Track
机构
*
Columbia University, United States Shanghai Jiao Tong University, China San Francisco State University, United States Carnegie Mellon University, United States Texas A\&M University, College Station, United States University of California, San Diego, United States
机构
*
ZJU-Angelalign R&D Center for Intelligence Healthcare(浙江大学智能医疗研发中心)
;
Zhejiang University(浙江大学)
;
Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室)
;
Guangdong Institute of Intelligence Science and Technology(广东省智能科学与技术研究院)
MedAlign: A Synergistic Framework of Multimodal Preference Optimization and Federated Meta-Cognitive Reasoning
Siyong Chen, Jinbo Wen, Jiawen Kang, Tenghui Huang, Xumin Huang, Yuanjia Su, Hudan Pan, Zishao Zhong, Dusit Niyato, Shengli Xie, Dong In Kim
机构
*
School of Automation, Guangdong University of Technology(广东工业大学自动化学院)
;
College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院)
;
State Key Laboratory of Traditional Chinese Medicine Syndrome, The Second Affiliated Hospital of Guangzhou University of Chinese Medicine, Guangdong Provincial Hospital of Chinese Medicine, Guangdong Provincial Academy of Chinese Medical Sciences(广东省中医药科学院中医证候重点实验室,广州中医药大学第二附属医院,广东省中医院,广东省中医药科学院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院)
;
Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电子与计算机工程系)
MedReason-R1: Learning to Reason for CT Diagnosis with Reinforcement Learning and Local Zoom
Yifan Li, Fenghe Tang, Yingtai Li, Shaohua Kevin Zhou
机构
*
1 School of Biomedical Engineering, Division of Life Sciences
;
Medicine, University of Science
;
Technology of China, Hefei, Anhui, 230026, P.R. China 2 Center for Medical Imaging, Robotics
;
Analytic Computing \& LEarning (MIRACLE), Suzhou Institute for Advanced Research, USTC, Suzhou 215123, P.R. China 3 Jiangsu Provincial Key Laboratory of Multimodal Digital Twin Technology, Suzhou Jiangsu, 215123 4 State Key Laboratory of Precision
机构
*
University of Central Florida(中央佛罗里达大学)
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Columbia University(哥伦比亚大学)
;
Amazon Research(亚马逊研究)
;
University of California, Berkeley(加州大学伯克利分校)
MMA-ASIA: A Multilingual and Multimodal Alignment Framework for Culturally-Grounded Evaluation
Weihua Zheng, Zhengyuan Liu, Tanmoy Chakraborty, Weiwen Xu, Xiaoxue Gao, Bryan Chen Zhengyu Tan, Bowei Zou, Chang Liu, Yujia Hu, Xing Xie, Xiaoyuan Yi, Jing Yao, Chaojun Wang, Long Li, Rui Liu, Huiyao Liu, Koji Inoue, Ryuichi Sumida, Tatsuya Kawahara, Fan Xu, Lingyu Ye, Wei Tian, Dongjun Kim, Jimin Jung, Jaehyung Seo, Nadya Yuki Wangsajaya, Pham Minh Duc, Ojasva Saxena, Palash Nandi, Xiyan Tao, Wiwik Karlina, Tuan Luong, Keertana Arun Vasan, Roy Ka-Wei Lee, Nancy F. Chen
机构
*
Singapore University of Technology and Design(新加坡科技设计大学)
;
Agency for Science, Technology and Research, Singapore(新加坡科技研究局)
;
Indian Institute of Technology Delhi(印度理工学院德里分校)
;
Alibaba DAMO Academy(阿里巴巴达摩院)
;
Microsoft Research Asia(微软亚洲研究院)
;
Shanghai University of Finance and Economics(上海财经大学)
;
Inner Mongolia University(内蒙古大学)
;
Kyoto University(京都大学)
;
Jiangxi Normal University(江西师范大学)
;
Korea University(韩国大学)
;
Nanyang Technological University(南洋理工大学)
机构
*
School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院)
;
College of Artificial Intelligence, Xi’an Jiaotong University(西安交通大学人工智能学院)
;
School of Computer Science and Technology and Ministry of Education Key Lab For Intelligent Networks and Network Security, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院和教育部智能网络与网络安全重点实验室)
;
School of Mathematics and Statistics and Ministry of Education Key Lab of Intelligent Networks and Network Security, Xi’an Jiaotong University(西安交通大学数学与统计学院和教育部智能网络与网络安全重点实验室)
;
Pazhou Laboratory (Huangpu), Guangzhou, Guangdong, China(琶洲实验室(黄埔),广州,广东,中国)
Hanfu-Bench: A Multimodal Benchmark on Cross-Temporal Cultural Understanding and Transcreation
Li Zhou, Lutong Yu, Dongchu Xie, Shaohuan Cheng, Wenyan Li, Haizhou Li
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shenzhen Research Institute of Big Data(深圳大数据研究院)
;
Chengdu Technological University(成都理工大学)
;
University of Copenhagen(哥本哈根大学)
OmniScene: Attention-Augmented Multimodal 4D Scene Understanding for Autonomous Driving
Pei Liu, Hongliang Lu, Haichao Liu, Haipeng Liu, Xin Liu, Ruoyu Yao, Shengbo Eben Li, Jun Ma
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
Li Auto Inc.
;
the School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院)