Social Debiasing for Fair Multi-modal LLMs
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CL、cs.AI
Comments Project page: https://github.com/xaCheng1996/Social_Debiasing_For_Fair_MLLMs
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CL、cs.AI
Comments Project page: https://github.com/xaCheng1996/Social_Debiasing_For_Fair_MLLMs
机构 * TUDelft(代尔夫特理工大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments 16 pages (including references), 5 figures and 6 tables
机构 * Department of Artificial Intelligence, Chung-Ang University(Chung-Ang大学人工智能系) ; Visual Intelligence Lab., ETRI(ETRI视觉智能实验室) ; University of Science and Technology (UST)(科技大学(UST)) ; School of Electronics Engineering, Kyungpook National University(Kyungpook国立大学电子工程学院)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV
Comments 6 pages, 3 figures. Accepted at IEEE International Conference on Advanced Visual and Signal-Based Systems 2025
机构 * Nanyang Technological University(南洋理工大学) ; The University of Tokyo(东京大学) ; Hong Kong Polytechnic University(香港理工大学)
专题命中 音频语音多模态 :multimodal(title,abstract);MLLM(abstract);分类 eess.AS
Comments 22 pages, 4 figures
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multi-modal(title,abstract)
机构 * Emobot ; CentraleSupélec ; IETR (UMR CNRS 6164)(IETR)
专题命中 音频语音多模态 :multimodal(abstract);multi-modal(abstract);分类 eess.AS
机构 * The University of Hong Kong(香港大学) ; The Chinese University of Hong Kong(香港中文大学) ; Google(谷歌)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.AI
Comments Accepted to UIST 2025. Project website: https://zhaorunning.github.io/NoteIt/
机构 * MoE Key Lab of Artificial Intelligence, AI Institute Shanghai Jiao Tong University Shanghai China(人工智能联合实验室,人工智能研究院,上海交通大学)
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments ACM MM 2025; Code is released at https://github.com/VISION-SJTU/AnchorSync
机构 * University of California, Berkeley(加州大学伯克利分校) ; MIT Media Lab(MIT媒体实验室) ; Princeton University(普林斯顿大学)
专题命中 视频多模态 :multimodal(abstract);分类 cs.AI
机构 * Dept. of Computer Science, University of California, Irvine(加州大学伊市分校计算机科学系) ; School of Nursing, University of California, Irvine(加州大学伊市分校护理学院)
专题命中 视频多模态 :multi-modal(abstract)
机构 * Kuaishou Inc.(快手公司)
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.AI
Comments CIKM 2025
机构 * Singapore Management University(新加坡国立管理学院) ; Fudan University(复旦大学)
专题命中 多模态生成 :MLLM(title);multimodal(abstract);cross-modal(abstract);分类 cs.CL、cs.AI
Comments Accepted by ACM MM 2025
机构 * Institute for Logic, Language and Computation (ILLC), University of Amsterdam(逻辑、语言与计算研究所(ILLC),阿姆斯特丹大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
机构 * Indraprastha Institute of Information Technology(印度理工学院信息技术研究所)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CL
Comments 8 pages, 4 figures. Code is available at: https://github.com/shubh-iiit/RecipeGPT2-Your-Own-AI-Chef
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
机构 * Department of Computer Science, Vanderbilt University(计算机科学系,范德比尔特大学) ; Weill Cornell Medicine(韦尔·科恩医学中心) ; Department of Electrical and Computer Engineering, Vanderbilt University(电气与计算机工程系,范德比尔特大学) ; Department of Biostatistics, Vanderbilt University Medical Center(生物统计学系,范德比尔特大学医学中心) ; NVIDIA
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
机构 * Xidian University(西安电子科技大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract)
Comments new Subsection 4.1 on Kinetic Langevin diffusion as forward process included; to appear in Annals of Applied Probability; 25 pages, 4 figures; see short YouTube videos https://youtu.be/hQvfpwI0UPk?si=tfL-DrH2EzqCuGSN and https://youtu.be/xjzVPOEkl44?si=fq9l3kZFg8eELYG3 explaining the main results and ideas of proofs
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
机构 * University of Auckland(奥克兰大学)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV
Comments 7 pages, 6 figures
机构 * FZI Research Center for Information Technology(弗劳恩霍夫研究所信息技术研究中心) ; Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) ; Technical University of Berlin(柏林技术大学)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV
Comments Daniel Bogdoll, Iramm Hamdard, and Lukas Namgyu Rößler contributed equally. Accepted for publication at ECCV 2024 W-CODA workshop
机构 * Noah’s Ark Lab(诺亚 Ark 实验室) ; The University of Hong Kong(香港大学) ; The Hong Kong University of Science and Technology(香港科技大学)
专题命中 多模态评测 :multi-modal(title);multimodal(abstract);分类 cs.CL
Comments 10 pages
机构 * Harbin Institute of Technology(哈尔滨工业大学) ; Nanyang Technological University(南洋理工大学)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.AI
Comments Accepted for publication at ACM Multimedia (ACM MM) 2025. 10 pages, 5 figures. Code and dataset: https://github.com/zqxwcevrtyui/DP2Rec
专题命中 多模态评测 :multimodal(abstract);multi-modal(abstract)
机构 * Department of Computer Science(计算机科学系) ; Center for Machine Vision(机器视觉中心) ; Signal Analysis, University of Oulu, Finland(信号分析中心,奥卢大学,芬兰) ; State Key Lab of Blockchain(区块链国家重点实验室) ; Data Security, Zhejiang University, China(数据安全,浙江大学,中国)
专题命中 多模态评测 :multimodal(abstract);分类 cs.CV
Comments 35 Pages, 4 figures, 5 Tables
专题命中 多模态评测 :multimodal(abstract);分类 cs.CV
专题命中 多模态评测 :multimodal(abstract);分类 cs.AI
专题命中 多模态评测 :multimodal(abstract)
专题命中 多模态评测 :multimodal(abstract)
Comments The corresponding author: Babak Teimourpour