arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1940
2509.22070 2025-09-29 cs.CV

SpecXNet: A Dual-Domain Convolutional Network for Robust Deepfake Detection

Inzamamul Alam, Md Tanvir Islam, Simon S. Woo

Comments ACM MM Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21339 2025-09-29 cs.IR cs.AI cs.CV cs.MM

Cross-Modal Retrieval with Cauchy-Schwarz Divergence

Jiahao Zhang, Wenzhe Yin, Shujian Yu

机构 * The HongKong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Amsterdam(阿姆斯特丹大学) Vrije Universiteit Amsterdam(自由大学)

Comments Accepted by ACMMM-25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18485 2025-09-25 q-bio.NC cs.CV

Deciphering Functions of Neurons in Vision-Language Models

Jiaqi Xu, Cuiling Lan, Yan Lu

机构 * University of Science and Technology of China(中国科学技术大学) Microsoft Research Asia(微软亚洲研究院)

Comments Accepted by the 31st ACM International Conference on Multimedia (ACM MM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11567 2025-09-25 cs.CV

Positional Prompt Tuning for Efficient 3D Representation Learning

Shaochen Zhang, Zekun Qi, Runpei Dong, Xiuxiu Bai, Xing Wei

机构 * Xi'an Jiaotong University(西安交通大学) Tsinghua University(清华大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

Comments Accepted at ACMMM 2025 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17554 2025-09-24 cs.CV

An h-space Based Adversarial Attack for Protection Against Few-shot Personalization

Xide Xu, Sandesh Kamath, Muhammad Atif Butt, Bogdan Raducanu

机构 * Computer Vision Center Universitat Autònoma de Barcelona(计算机视觉中心自治大学巴塞罗那)

Comments 32 pages, 15 figures. Accepted by ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18683 2025-09-24 cs.CV cs.AI cs.MM

LEAF-Mamba: Local Emphatic and Adaptive Fusion State Space Model for RGB-D Salient Object Detection

Lanhu Wu, Zilin Gao, Hao Fei, Mong-Li Lee, Wynne Hsu

机构 * Dalian University of Technology(大连理工大学) National University of Singapore(新加坡国立大学)

Comments Accepted to ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07239 2025-09-23 cs.CV cs.AI

Contextual Gesture: Co-Speech Gesture Video Generation through Context-aware Gesture Representation

Pinxin Liu, Pengfei Zhang, Hyeongwoo Kim, Pablo Garrido, Ari Shapiro, Kyle Olszewski

机构 * University of Rochester(罗切斯特大学) University of California Irvine(加州大学尔湾分校) Imperial College(帝国理工学院)

Comments Accepted to ACM MM 2025. Project Page: https://andypinxinliu.github.io/Contextual-Gesture/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16632 2025-09-23 cs.CV

DA-Font: Few-Shot Font Generation via Dual-Attention Hybrid Integration

Weiran Chen, Guiqian Zhu, Ying Li, Yi Ji, Chunping Liu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院)

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03319 2025-09-23 cs.CV cs.AI cs.MM

SD-VSum: A Method and Dataset for Script-Driven Video Summarization

Manolis Mylonas, Evlampios Apostolidis, Vasileios Mezaris

机构 * ITI, CERTH(ITI、CERTH)

Comments In ACM Multimedia 2025, DOI:10.1145/3746027.3755821

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15230 2025-09-22 cs.LG cs.AI

Pre-Forgettable Models: Prompt Learning as a Native Mechanism for Unlearning

Rutger Hendrix, Giovanni Patanè, Leonardo G. Russo, Simone Carnemolla, Giovanni Bellitto, Federica Proietto Salanitri, Concetto Spampinato, Matteo Pennisi

机构 * University of Catania(卡塔尼亚大学)

Comments Accepted at ACM multimedia 2025 BNI track

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21830 2025-09-19 cs.AI

DualSG: A Dual-Stream Explicit Semantic-Guided Multivariate Time Series Forecasting Framework

Kuiye Ding, Fanda Fan, Yao Wang, Ruijie jian, Xiaorui Wang, Luqi Gong, Yishan Jiang, Chunjie Luo, Jianfeng Zhan

机构 * SKL of Processors, Institute of Computing Technology, Chinese Academy of Sciences(处理器国家重点实验室,计算技术研究所,中国科学院) Fu Foundation School of Engineering and Applied Science, Columbia University(工程与应用科学学院,哥伦比亚大学) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang Lab(浙江实验室) Beijing University of Technology(北京理工大学) Institute of Computing Technology, Chinese Academy of Sciences(计算技术研究所,中国科学院)

Comments This paper has been accepted by ACM Multimedia 2025 (ACM MM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08557 2025-09-19 cs.SD cs.AI cs.MM eess.AS

FreeAudio: Training-Free Timing Planning for Controllable Long-Form Text-to-Audio Generation

Yuxuan Jiang, Zehua Chen, Zeqian Ju, Chang Li, Weibei Dou, Jun Zhu

机构 * Tsinghua University(清华大学) Shengshu AI(盛舒AI) University of Science and Technology of China(中国科学技术大学)

Comments Accepted at ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12701 2025-09-17 cs.CV

SmokeBench: A Real-World Dataset for Surveillance Image Desmoking in Early-Stage Fire Scenes

Wenzhuo Jin, Qianfeng Yang, Xianhao Wu, Hongming Chen, Pengpeng Li, Xiang Chen

机构 * Beijing Jiaotong University(北京交通大学) Dalian Polytechnic University(大连理工大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Dalian Martime University(大连海洋大学) Nanjing University of Science and Technology(南京理工大学)

Comments Accepted by ACMMM 2025 Datasets Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12250 2025-09-17 cs.CV cs.AI cs.RO

OnlineHOI: Towards Online Human-Object Interaction Generation and Perception

Yihong Ji, Yunze Liu, Yiyao Zhuo, Weijiang Yu, Fei Ma, Joshua Huang, Fei Yu

机构 * Tsinghua University, Shanghai Qi Zhi Institute(清华大学,上海启智研究院) Guangdong Laboratory of Artificial Intelligence(人工智能与数字经济广东实验室) Sun Yat-Sen University(中山大学) Shenzhen University(深圳大学)

Comments Accepted at ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12211 2025-09-17 cs.DC cs.AI

TinyServe: Query-Aware Cache Selection for Efficient LLM Serving

Dong Liu, Yanxuan Yu

机构 * Yale University(耶鲁大学) Columbia University(哥伦比亚大学)

Comments Accepted to ACM MM as Oral Paper, also accepted to ICML MOSS workshop, publicly available as https://openreview.net/forum?id=sOdtl4jLci

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03903 2025-09-17 cs.CV

Taming Anomalies with Down-Up Sampling Networks: Group Center Preserving Reconstruction for 3D Anomaly Detection

Hanzhe Liang, Jie Zhang, Tao Dai, Linlin Shen, Jinbao Wang, Can Gao

机构 * College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院) Shenzhen Audencia Financial Technology Institute(深圳Audencia金融科技研究院) Faculty of Applied Sciences, Macao Polytechnic University(澳门理工学院应用科学学院) School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院) Guangdong Provincial Key Laboratory of Intelligent Information Processing(广东省智能信息处理重点实验室)

Comments ACM MM25 Accepted, 9 pages, 2 figures, 8 tables

Journal ref 33rd ACM International Conference on Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11884 2025-09-16 cs.CV

SAM-TTT: Segment Anything Model via Reverse Parameter Configuration and Test-Time Training for Camouflaged Object Detection

Zhenni Yu, Li Zhao, Guobao Xiao, Xiaoqin Zhang

机构 * College of Computer Science and Artificial Intelligence, Wenzhou University(计算机科学与人工智能学院,温州大学) College of Computer Science and Technology, Tongji University(计算机科学与技术学院,同济大学) College of Information Science and Technology, Zhejiang Shuren University(信息科学与技术学院,浙江师大)

Comments accepted by ACM MM 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12356 2025-09-16 eess.IV cs.CV

Regist3R: Incremental Registration with Stereo Foundation Model

Sidun Liu, Wenyu Li, Peng Qiao, Yong Dou

机构 * College of Computer Science and Technology(计算机科学与技术学院) National Key Laboratory of Parallel and Distributed Computing(并行与分布式计算国家重点实验室) National University of Defense Technology(国防科技大学)

Comments Accepted by ACM Multimedia 2025. github link: https://github.com/Liu-SD/Regist3R

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11796 2025-09-16 cs.CV

FineQuest: Adaptive Knowledge-Assisted Sports Video Understanding via Agent-of-Thoughts Reasoning

Haodong Chen, Haojian Huang, XinXiang Yin, Dian Shao

机构 * School of Automation, Northwestern Polytechnical University(自动化学院,西北工业大学) The University of Hong Kong(香港大学) School of Software, Northwestern Polytechnical University(软件学院,西北工业大学) Unmanned System Research Institute, Northwestern Polytechnical University(无人系统研究院,西北工业大学)

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11642 2025-09-16 cs.CV

WeatherBench: A Real-World Benchmark Dataset for All-in-One Adverse Weather Image Restoration

Qiyuan Guan, Qianfeng Yang, Xiang Chen, Tianyu Song, Guiyue Jin, Jiyu Jin

机构 * Dalian Polytechnic University(大连工业大学) Nanjing University of Science and Technology(南京理工大学) Dalian Martime University(大连海洋大学)

Comments Accepted by ACMMM 2025 Datasets Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11628 2025-09-16 cs.LG cs.AI cs.CV

SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching

Jiacheng Liu, Chang Zou, Yuanhuiyi Lyu, Fei Ren, Shaobo Wang, Kaixin Li, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shandong University(山东大学) University of Electronic Science and Technology of China(电子科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

Comments 15 pages, 9 figures, ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11572 2025-09-16 cs.AI cs.CL

Formal Reasoning for Intelligent QA Systems: A Case Study in the Educational Domain

Tuan Bui, An Nguyen, Phat Thai, Minh Hua, Ngan Pham L. N., Ngan Pham T. B., Dung Le, Long Nguyen, Thanh-Tung Tran, Thang Bui, Tho Quan

机构 * Ho Chi Minh City University of Technology (HCMUT) - VNU-HCM(胡志明市技术大学(HCMUT)- VNU-HCM) International University - VNU-HCM(国际大学 - VNU-HCM)

Comments Published at the 2nd ACM Workshop in AI-powered Question & Answering Systems (AIQAM '25), co-located with ACM Multimedia 2025

Journal ref Proceedings of the 2nd ACM Workshop in AI-powered Question and Answering Systems (AIQAM '25), October 27-28, 2025, Dublin, Ireland

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11264 2025-09-16 cs.CV

Cross-Domain Attribute Alignment with CLIP: A Rehearsal-Free Approach for Class-Incremental Unsupervised Domain Adaptation

Kerun Mi, Guoliang Kang, Guangyu Li, Lin Zhao, Tao Zhou, Chen Gong

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Nanjing University of Science and Technology(南京理工大学) School of Automation Science and Electrical Engineering(自动化科学与电气工程学院) Beihang University(北航) School of Automation and Intelligent Sensing(自动化与智能感知学院) Shanghai Jiao Tong University(上海交通大学)

Comments Accepted to ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08137 2025-09-16 cs.CV cs.AI

Occlusion-Aware Temporally Consistent Amodal Completion for 3D Human-Object Interaction Reconstruction

Hyungjun Doh, Dong In Lee, Seunggeun Chi, Pin-Hao Huang, Kwonjoon Lee, Sangpil Kim, Karthik Ramani

机构 * Elmore Family School of Electrical and Computer Engineering(电气与计算机工程学院) Purdue University(普渡大学) Department of Artificial Intelligence(人工智能系) Korea University(韩国大学) Honda Research Institute USA(本田美国研究院) School of Mechanical Engineering(机械工程学院)

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01064 2025-09-16 cs.CV cs.AI

Fighting Fire with Fire (F3): A Training-free and Efficient Visual Adversarial Example Purification Method in LVLMs

Yudong Zhang, Ruobing Xie, Yiqing Huang, Jiansheng Chen, Xingwu Sun, Zhanhui Kang, Di Wang, Yu Wang

机构 * Tsinghua University, Tencent(清华大学,腾讯) Tencent(腾讯) University of Science and Technology Beijing(北京科技大学) Tencent, University of Macau(腾讯,澳门大学) Tsinghua University(清华大学)

Comments Accepted by ACM Multimedia 2025 BNI track (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18039 2025-09-16 cs.AI

MultiMind: Enhancing Werewolf Agents with Multimodal Reasoning and Theory of Mind

Zheng Zhang, Nuoqian Xiao, Qi Chai, Deheng Ye, Hao Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tencent(腾讯)

Comments Accepted by ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10359 2025-09-15 cs.CV

Immunizing Images from Text to Image Editing via Adversarial Cross-Attention

Matteo Trippodo, Federico Becattini, Lorenzo Seidenari

机构 * University of Florence(佛罗伦萨大学) University of Siena(锡耶纳大学)

Comments Accepted as Regular Paper at ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18733 2025-09-12 cs.CV

Drawing2CAD: Sequence-to-Sequence Learning for CAD Generation from Vector Drawings

Feiwei Qin, Shichao Lu, Junhao Hou, Changmiao Wang, Meie Fang, Ligang Liu

机构 * Hangzhou Dianzi University(杭州电子科技大学) Zhejiang University(浙江大学) Shenzhen Research Institute of Big Data(深圳大数据研究院) Guangzhou University(广州大学) University of Science and Technology of China(中国科学技术大学)

Comments Accepted to ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08008 2025-09-11 cs.SI cs.AI cs.MM

A New Dataset and Benchmark for Grounding Multimodal Misinformation

Bingjian Yang, Danni Xu, Kaipeng Niu, Wenxuan Liu, Zheng Wang, Mohan Kankanhalli

机构 * National Engineering Research Center for Multimedia Software, School of Computer Science, Wuhan University(多媒体软件国家工程研究中心,计算机科学学院,武汉大学) School of Computing, National University of Singapore(计算学院,新加坡国立大学) School of Computer Science, Peking University(计算机科学学院,北京大学) State Key Laboratory for Multimedia Information Processing, Peking University(多媒体信息处理国家重点实验室,北京大学)

Comments 6 pages, 5 figures, ACM Multimedia 2025 Dataset Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06552 2025-09-09 cs.LG cs.CV cs.DC cs.IR

Tackling Device Data Distribution Real-time Shift via Prototype-based Parameter Editing

Zheqi Lv, Wenqiao Zhang, Kairui Fu, Qi Tian, Shengyu Zhang, Jiajie Su, Jingyuan Chen, Kun Kuang, Fei Wu

机构 * Zhejiang University(浙江大学)

Comments Published on MM'25: Proceedings of the 33rd ACM International Conference on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏