The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans?
Yuan Xun, Xiaojun Jia, Xinwei Liu, Hua Zhang
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
Nanyang Technological University(南洋理工大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
Gather and Trace: Rethinking Video TextVQA from an Instance-oriented Perspective
Yan Zhang, Gangyan Zeng, Daiqing Wu, Huawen Shen, Binbin Li, Yu Zhou, Can Ma, Xiaojun Bi
机构
*
Institute of Information Engineering, Chinese Academy of Sciences School of Cyber Security, University of Chinese Academy of Sciences Beijing China
;
School of Cyber Science
;
Engineering, Nanjing University of Science
;
VCIP \& TMCC \& DISSec, College of Computer Science, Nankai University Tianjin China
;
Key Laboratory of Ethnic Language Intelligent Analysis
;
Security Governance of MOE, Minzu University of China Beijing China
;
Institute of Information Engineering, Chinese Academy of Sciences
;
School of Cyber Security, University of Chinese Academy of Sciences
;
VCIP \& TMCC \& DISSec, College of Computer Science, Nankai University
;
Security Governance of MOE, Minzu University of China
机构
*
School of Computer Science(计算机学院)
;
Sichuan University(四川大学)
;
National Key Laboratory of Fundamental Science on Synthetic Vision(合成视觉基础科学国家重点实验室)
Boosting Visual Knowledge-Intensive Training for LVLMs Through Causality-Driven Visual Object Completion
Qingguo Hu, Ante Wang, Jia Song, Delai Qiu, Qingsong Liu, Jinsong Su
机构
*
School of Informatics, Xiamen University, China(厦门大学信息学院)
;
Xiamen Unisound Intelligence Technology Co., Ltd(厦门Unisound智能科技有限公司)
;
Shanghai Artificial Intelligence Laboratory, China(上海人工智能实验室)
;
Key Laboratory of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian and Taiwan (Xiamen University), Ministry of Culture and Tourism, China(福建省和台湾非物质文化遗产数字化保护与智能处理重点实验室(厦门大学),中华人民共和国文化和旅游部,中国)