arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1944
2308.10601 2023-08-22 cs.CV cs.CR cs.LG eess.IV

Improving the Transferability of Adversarial Examples with Arbitrary Style Transfer

Zhijin Ge, Fanhua Shang, Hongying Liu, Yuanyuan Liu, Liang Wan, Wei Feng, Xiaosen Wang

Comments 10 pages, 2 figures, accepted by the 31st ACM International Conference on Multimedia (MM '23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.05186 2023-08-22 cs.CV cs.AI

Suspected Object Matters: Rethinking Model's Prediction for One-stage Visual Grounding

Yang Jiao, Zequn Jie, Jingjing Chen, Lin Ma, Yu-Gang Jiang

Comments Accepted to ACM MM 23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10257 2023-08-22 cs.CV

Make-It-4D: Synthesizing a Consistent Long-Term Dynamic Scene Video from a Single Image

Liao Shen, Xingyi Li, Huiqiang Sun, Juewen Peng, Ke Xian, Zhiguo Cao, Guosheng Lin

Comments accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09983 2023-08-22 cs.CV

Prototypical Cross-domain Knowledge Transfer for Cervical Dysplasia Visual Inspection

Yichen Zhang, Yifang Yin, Ying Zhang, Zhenguang Liu, Zheng Wang, Roger Zimmermann

Comments accepted in ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08306 2023-08-22 cs.MM cs.LG

Towards Balanced Active Learning for Multimodal Classification

Meng Shen, Yizheng Huang, Jianxiong Yin, Heqing Zou, Deepu Rajan, Simon See

Comments 12 pages, accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09611 2023-08-21 cs.CV

Language-guided Human Motion Synthesis with Atomic Actions

Yuanhao Zhai, Mingzhen Huang, Tianyu Luan, Lu Dong, Ifeoma Nwogu, Siwei Lyu, David Doermann, Junsong Yuan

Comments Accepted to ACM MM 2023, code: https://github.com/yhZhai/ATOM

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06087 2023-08-21 cs.MM cs.AI cs.CV

Audio-Visual Spatial Integration and Recursive Attention for Robust Sound Source Localization

Sung Jin Um, Dongjin Kim, Jung Uk Kim

Comments Camera-Ready, ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08881 2023-08-21 cs.CV

Text-Only Training for Visual Storytelling

Yuechen Wang, Wengang Zhou, Zhenbo Lu, Houqiang Li

Comments ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16736 2023-08-21 cs.CV cs.AI

GraMMaR: Ground-aware Motion Model for 3D Human Motion Reconstruction

Sihan Ma, Qiong Cao, Hongwei Yi, Jing Zhang, Dacheng Tao

Comments Accepted to ACM Multimedia 2023. The code will be available at https://github.com/xymsh/GraMMaR

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08256 2023-08-17 cs.CV cs.HC

MultiMediate'23: Engagement Estimation and Bodily Behaviour Recognition in Social Interactions

Philipp Müller, Michal Balazia, Tobias Baur, Michael Dietz, Alexander Heimerl, Dominik Schiller, Mohammed Guermal, Dominike Thomas, François Brémond, Jan Alexandersson, Elisabeth André, Andreas Bulling

Comments ACM MultiMedia'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08088 2023-08-17 cs.CV cs.IR cs.MM

Pro-Cap: Leveraging a Frozen Vision-Language Model for Hateful Meme Detection

Rui Cao, Ming Shan Hee, Adriel Kuek, Wen-Haw Chong, Roy Ka-Wei Lee, Jing Jiang

Comments Camera-ready for 23, ACM MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07578 2023-08-17 cs.MM

Understanding User Behavior in Volumetric Video Watching: Dataset, Analysis and Prediction

Kaiyuan Hu, Haowen Yang, Yili Jin, Junhua Liu, Yongting Chen, Miao Zhang, Fangxin Wang

Comments Accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04043 2023-08-17 cs.LG cs.AI

Echoes: Unsupervised Debiasing via Pseudo-bias Labeling in an Echo Chamber

Rui Hu, Yahan Tu, Jitao Sang

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07733 2023-08-16 eess.IV cs.CV cs.MM

Dynamic Low-Rank Instance Adaptation for Universal Neural Image Compression

Yue Lv, Jinxi Xiang, Jun Zhang, Wenming Yang, Xiao Han, Wei Yang

Comments Accepted by ACM MM 2023, 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07605 2023-08-16 cs.CV cs.AI cs.MM

SGDiff: A Style Guided Diffusion Model for Fashion Synthesis

Zhengwentai Sun, Yanghong Zhou, Honghong He, P. Y. Mok

Comments Accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07316 2023-08-15 cs.CV cs.MM

Jurassic World Remake: Bringing Ancient Fossils Back to Life via Zero-Shot Long Image-to-Image Translation

Alexander Martin, Haitian Zheng, Jie An, Jiebo Luo

Comments 9 pages, 10 figures, ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07202 2023-08-15 cs.CV

Towards Robust Real-Time Scene Text Detection: From Semantic to Instance Representation Learning

Xugong Qin, Pengyuan Lyu, Chengquan Zhang, Yu Zhou, Kun Yao, Peng Zhang, Hailun Lin, Weiping Wang

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07102 2023-08-15 cs.CV cs.CL cs.MM

Temporal Sentence Grounding in Streaming Videos

Tian Gan, Xiao Wang, Yan Sun, Jianlong Wu, Qingpei Guo, Liqiang Nie

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07026 2023-08-15 cs.CV

AdvCLIP: Downstream-agnostic Adversarial Examples in Multimodal Contrastive Learning

Ziqi Zhou, Shengshan Hu, Minghui Li, Hangtao Zhang, Yechao Zhang, Hai Jin

Comments This paper has been accepted by the ACM International Conference on Multimedia (ACM MM '23, October 29-November 3, 2023, Ottawa, ON, Canada)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06998 2023-08-15 cs.CV

Mutual Information-driven Triple Interaction Network for Efficient Image Dehazing

Hao Shen, Zhong-Qiu Zhao, Yulun Zhang, Zhao Zhang

Comments Accepted in ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06897 2023-08-15 cs.CV cs.MM

Orthogonal Temporal Interpolation for Zero-Shot Video Recognition

Yan Zhu, Junbao Zhuo, Bin Ma, Jiajia Geng, Xiaoming Wei, Xiaolin Wei, Shuhui Wang

Journal ref Proceedings of the 31st ACM International Conference on Multimedia (MM '23), October 29-November 3, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04067 2023-08-15 cs.IR

Online Distillation-enhanced Multi-modal Transformer for Sequential Recommendation

Wei Ji, Xiangyan Liu, An Zhang, Yinwei Wei, Yongxin Ni, Xiang Wang

Comments 11 pages, 7 figures, accepted in ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.00847 2023-08-15 cs.CV

MAFW: A Large-scale, Multi-modal, Compound Affective Database for Dynamic Facial Expression Recognition in the Wild

Yuanyuan Liu, Wei Dai, Chuanxu Feng, Wenbin Wang, Guanghao Yin, Jiabei Zeng, Shiguang Shan

Comments This paper has been accepted by ACM MM'22

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06749 2023-08-15 cs.CV eess.IV

FastLLVE: Real-Time Low-Light Video Enhancement with Intensity-Aware Lookup Table

Wenhao Li, Guangyang Wu, Wenyi Wang, Peiran Ren, Xiaohong Liu

Comments 11pages, 9 Figures, and 6 Tables. Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05095 2023-08-15 cs.CV cs.AI

LayoutLLM-T2I: Eliciting Layout Guidance from LLM for Text-to-Image Generation

Leigang Qu, Shengqiong Wu, Hao Fei, Liqiang Nie, Tat-Seng Chua

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05081 2023-08-15 cs.CV cs.CL

Constructing Holistic Spatio-Temporal Scene Graph for Video Semantic Role Labeling

Yu Zhao, Hao Fei, Yixin Cao, Bobo Li, Meishan Zhang, Jianguo Wei, Min Zhang, Tat-Seng Chua

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04733 2023-08-15 cs.CV

TextPainter: Multimodal Text Image Generation with Visual-harmony and Text-comprehension for Poster Design

Yifan Gao, Jinpeng Lin, Min Zhou, Chuanbin Liu, Hongtao Xie, Tiezheng Ge, Yuning Jiang

Comments Accepted to ACM MM 2023. Dataset Link: https://tianchi.aliyun.com/dataset/160034

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04502 2023-08-15 cs.CL

Revisiting Disentanglement and Fusion on Modality and Context in Conversational Multimodal Emotion Recognition

Bobo Li, Hao Fei, Lizi Liao, Yu Zhao, Chong Teng, Tat-Seng Chua, Donghong Ji, Fei Li

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06161 2023-08-14 cs.CV

Rethinking the Localization in Weakly Supervised Object Localization

Rui Xu, Yong Luo, Han Hu, Bo Du, Jialie Shen, Yonggang Wen

Comments Accepted by ACM International Conference on Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06101 2023-08-14 cs.CV

Taming the Power of Diffusion Models for High-Quality Virtual Try-On with Appearance Flow

Junhong Gou, Siyu Sun, Jianfu Zhang, Jianlou Si, Chen Qian, Liqing Zhang

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏