CommentsThe M-PACE framework uses a "mother-child" AI model system to automate and unify compliance checks for ads, reducing costs while maintaining high accuracy
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
Zichen Wu, Hsiu-Yuan Huang, Yunfang Wu
机构
*
School of Computer Science, Peking University(北京大学计算机科学学院)
;
MOE Key Laboratory of Computational Linguistics, Peking University(北京大学教育部计算语言学重点实验室)
;
National Key Laboratory for Multimedia Information Processing, Peking University(北京大学国家多媒体信息处理重点实验室)
Semantic Change Detection of Roads and Bridges: A Fine-grained Dataset and Multimodal Frequency-driven Detector
Qingling Shu, Sibao Chen, Xiao Wang, Zhihui You, Wei Lu, Jin Tang, Bin Luo
机构
*
MOE Key Lab of ICSP, IMIS Lab of Anhui Province, Anhui Provincial Key Lab of Multimodal Cognitive Computation, School of Computer Science and Technology, Anhui University, Hefei, China(教育部ICSP重点实验室、安徽IMIS实验室、安徽省多模态认知计算重点实验室、计算机科学与技术学院、安徽大学,合肥,中国)
;
School of Public Safety and Emergency Management, Anhui University of Science and Technology, Hefei, China(公共安全与应急管理学院、安徽理工大学,合肥,中国)
Jamendo-QA: A Large-Scale Music Question Answering Dataset
Junyoung Koh, Soo Yong Kim, Yongwon Choi, Gyu Hyeong Choi
机构
*
Department of Artificial Intelligence, Yonsei University(延世大学人工智能系)
;
MAAP LAB, MODULABS(MODULABS MAAP实验室)
;
KRAFTON
;
AI Matics
;
Department of Media Software, Sungkyul University(顺天大学媒体软件系)
专题命中
多模态评测
:multimodal(abstract);分类 cs.MM、eess.AS
Comments4 pages, 8 figures. Submitted to ICASSP 2026
MountainLion: A Multi-Modal LLM-Based Agent System for Interpretable and Adaptive Financial Trading
Siyi Wu, Junqiao Wang, Zhaoyang Guan, Leyi Zhao, Xinyuan Song, Xinyu Ying, Dexu Yu, Jinhao Wang, Hanlin Zhang, Michele Pak, Yangfan He, Yi Xin, Jianhui Wang, Tianyu Shi
机构
*
The University of Texas at Arlington(德克萨斯大学阿灵顿分校)
;
Sichuan University(四川大学)
;
Northwestern University(西北大学)
;
Indiana University(印第安纳大学)
;
Emory University(埃默里大学)
;
Nankai University(南开大学)
;
MountainLion Research(MountainLion研究机构)
;
Xi’an University of Electronic Science and Technology(西安电子科技大学)
;
Kyoto University(京都大学)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
Nanjing university(南京大学)
;
Tsinghua University(清华大学)
;
University of Toronto(多伦多大学)
Towards deployment-centric multimodal AI beyond vision and language
Xianyuan Liu, Jiayang Zhang, Shuo Zhou, Thijs L. van der Plas, Avish Vijayaraghavan, Anastasiia Grishina, Mengdie Zhuang, Daniel Schofield, Christopher Tomlinson, Yuhan Wang, Ruizhe Li, Louisa van Zeeland, Sina Tabakhi, Cyndie Demeocq, Xiang Li, Arunav Das, Orlando Timmerman, Thomas Baldwin-McDonald, Jinge Wu, Peizhen Bai, Zahraa Al Sahili, Omnia Alwazzan, Thao N. Do, Mohammod N. I. Suvon, Angeline Wang, Lucia Cipolina-Kun, Luigi A. Moretti, Lucas Farndale, Nitisha Jain, Natalia Efremova, Yan Ge, Marta Varela, Hak-Keung Lam, Oya Celiktutan, Ben R. Evans, Alejandro Coca-Castro, Honghan Wu, Zahraa S. Abdallah, Chen Chen, Valentin Danchev, Nataliya Tkachenko, Lei Lu, Tingting Zhu, Gregory G. Slabaugh, Roger K. Moore, William K. Cheung, Peter H. Charlton, Haiping Lu
机构
*
Centre for Machine Intelligence, University of Sheffield, Sheffield, UK(机器智能中心,谢菲尔德大学)
;
School of Computer Science, University of Sheffield, Sheffield, UK(计算机科学学院,谢菲尔德大学)
;
The Alan Turing Institute, London, UK(艾伦·图灵研究所,伦敦)
;
Department of Metabolism, Digestion and Reproduction, Imperial College London, London, UK(代谢、消化与生殖部门,伦敦帝国学院)
;
Department of Applied AI, Simula Research Laboratory, Oslo, Norway(应用人工智能部门,Simula研究实验室,奥斯陆)
;
Information School, University of Sheffield, Sheffield, UK(信息学院,谢菲尔德大学)
;
NHS England, Leeds, UK(英国英格兰国家医疗服务体系,利兹)
;
Institute of Health Informatics, University College London, London, UK(健康信息研究所,伦敦大学学院)
;
Department of Engineering, King’s College London, London, UK(工程部门,伦敦国王学院)
;
Department of Computing Science, University of Aberdeen, Aberdeen, UK(计算科学部门,阿伯丁大学)
;
School of Informatics, University of Edinburgh, Edinburgh, UK(信息学院,爱丁堡大学)
;
School of Engineering Mathematics and Technology, University of Bristol, Bristol, UK(工程数学与技术学院,布里斯托尔大学)
;
Department of Informatics, King’s College London, London, UK(信息部门,伦敦国王学院)
;
Department of Earth Sciences, University of Cambridge, Cambridge, UK(地球科学部门,剑桥大学)
;
Department of Computer Science, University of Manchester, Manchester, UK(计算机科学部门,曼彻斯特大学)
MicroRCA-Agent: Microservice Root Cause Analysis Method Based on Large Language Model Agents
Pan Tang, Shixiang Tang, Huanqi Pu, Zhiqing Miao, Zhixing Wang
机构
*
School of Communication and Information Engineering, Shanghai University, Shanghai, China(上海大学通信与信息工程学院)
;
School of Communication and Electronic Engineering, East China Normal University, Shanghai, China(华东师范大学通信与电子工程学院)
;
School of Information and Electronics, Beijing Institute of Technology, Beijing, China(北京理工大学信息与电子学院)
A. Ali Heydari, Ken Gu, Vidya Srinivas, Hong Yu, Zhihan Zhang, Yuwei Zhang, Akshay Paruchuri, Qian He, Hamid Palangi, Nova Hammerquist, Ahmed A. Metwally, Brent Winslow, Yubin Kim, Kumar Ayush, Yuzhe Yang, Girish Narayanswamy, Maxwell A. Xu, Jake Garrison, Amy Armento Lee, Jenny Vafeiadou, Ben Graef, Isaac R. Galatzer-Levy, Erik Schenck, Andrew Barakat, Javier Perez, Jacqueline Shreibati, John Hernandez, Anthony Z. Faranesh, Javier L. Prieto, Connor Heneghan, Yun Liu, Jiening Zhan, Mark Malhotra, Shwetak Patel, Tim Althoff, Xin Liu, Daniel McDuff, Xuhai "Orson" Xu
Copycat vs. Original: Multi-modal Pretraining and Variable Importance in Box-office Prediction
Qin Chao, Eunsoo Kim, Boyang Li
机构
*
College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)
;
Business School, University of Seoul, Republic of Korea(商学学院,首尔大学,韩国)
;
Alibaba Group and the Alibaba-NTU Joint Research Institute, Singapore(阿里巴巴集团及阿里巴巴-南洋理工大学联合研究机构,新加坡)
VLA-Mark: A cross modal watermark for large vision-language alignment model
Shuliang Liu, Qi Zheng, Jesse Jiaxi Xu, Yibo Yan, Junyan Zhang, He Geng, Aiwei Liu, Peijie Jiang, Jia Liu, Yik-Cheung Tam, Xuming Hu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
The Hong Kong University of Science and Technology(香港科技大学)
;
University of Toronto(多伦多大学)
;
Ant Group, Alibaba(蚂蚁集团,阿里巴巴)
;
New York University Shanghai(纽约大学上海分校)