arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1944
2309.01339 2023-09-06 cs.CL cs.AI cs.CV cs.MM

UniSA: Unified Generative Framework for Sentiment Analysis

Zaijing Li, Ting-En Lin, Yuchuan Wu, Meng Liu, Fengxiao Tang, Ming Zhao, Yongbin Li

Comments Accepted to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01075 2023-09-06 cs.CV

Muti-Stage Hierarchical Food Classification

Xinyue Pan, Jiangpeng He, Fengqing Zhu

Comments accepted for ACM MM 2023 Madima

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01010 2023-09-06 cs.CV cs.AI

Mitigating Motion Blur for Robust 3D Baseball Player Pose Modeling for Pitch Analysis

Jerrin Bright, Yuhao Chen, John Zelek

Comments Accepted in the 6th International Workshop on Multimedia Content Analysis in Sports (MMSports'23) @ ACM Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00007 2023-09-06 cs.CV cs.CR cs.LG

When Measures are Unreliable: Imperceptible Adversarial Perturbations toward Top-$k$ Multi-Label Learning

Yuchen Sun, Qianqian Xu, Zitai Wang, Qingming Huang

Comments 22 pages, 7 figures, accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09221 2023-09-06 cs.NI cs.CV

Moby: Empowering 2D Models for Efficient Point Cloud Analytics on the Edge

Jingzong Li, Yik Hong Cai, Libin Liu, Yu Mao, Chun Jason Xue, Hong Xu

Comments Accepted to ACM International Conference on Multimedia (MM) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00199 2023-09-04 cs.CV cs.AI cs.LG

Diffusion Model with Clustering-based Conditioning for Food Image Generation

Yue Han, Jiangpeng He, Mridul Gupta, Edward J. Delp, Fengqing Zhu

Comments Accepted for 31st ACM International Conference on Multimedia: 8th International Workshop on Multimedia Assisted Dietary Management (MADiMa 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12538 2023-09-04 cs.CV

Mutual-Guided Dynamic Network for Image Fusion

Yuanshen Guan, Ruikang Xu, Mingde Yao, Lizhi Wang, Zhiwei Xiong

Comments ACMMM 2023 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16739 2023-09-01 cs.CV

Parsing is All You Need for Accurate Gait Recognition in the Wild

Jinkai Zheng, Xinchen Liu, Shuai Wang, Lihao Wang, Chenggang Yan, Wu Liu

Comments 16 pages, 14 figures, ACM MM 2023 accepted, project page: https://gait3d.github.io/gait3d-parsing-hp

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16635 2023-09-01 cs.CV

MFR-Net: Multi-faceted Responsive Listening Head Generation via Denoising Diffusion Model

Jin Liu, Xi Wang, Xiaomeng Fu, Yesheng Chai, Cai Yu, Jiao Dai, Jizhong Han

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16383 2023-09-01 cs.CV cs.MM

Separate and Locate: Rethink the Text in Text-based Visual Question Answering

Chengyang Fang, Jiangnan Li, Liang Li, Can Ma, Dayong Hu

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16110 2023-08-31 cs.CV

Improving Few-shot Image Generation by Structural Discrimination and Textural Modulation

Mengping Yang, Zhe Wang, Wenyi Feng, Qian Zhang, Ting Xiao

Comments To appear in ACM MM 2023, code is available at https://github.com/kobeshegu/SDTM-GAN-ACMMM-2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10799 2023-08-31 cs.CV

SelfTalk: A Self-Supervised Commutative Training Diagram to Comprehend 3D Talking Faces

Ziqiao Peng, Yihao Luo, Yue Shi, Hao Xu, Xiangyu Zhu, Jun He, Hongyan Liu, Zhaoxin Fan

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15004 2023-08-30 cs.CV

PBFormer: Capturing Complex Scene Text Shape with Polynomial Band Transformer

Ruijin Liu, Ning Lu, Dapeng Chen, Cheng Li, Zejian Yuan, Wei Peng

Comments 9 pages, 8 figures, accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.00135 2023-08-30 cs.CV

TeViS:Translating Text Synopses to Video Storyboards

Xu Gu, Yuchong Sun, Feiyue Ni, Shizhe Chen, Xihua Wang, Ruihua Song, Boyuan Li, Xiang Cao

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14686 2023-08-29 cs.CV

360-Degree Panorama Generation from Few Unregistered NFoV Images

Jionghao Wang, Ziyu Chen, Jun Ling, Rong Xie, Li Song

Comments Accepted to ACM Multimedia 2023 (MM' 23). Code is available: https://github.com/shanemankiw/Panodiff

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14395 2023-08-29 cs.MM cs.CV

UMMAFormer: A Universal Multimodal-adaptive Transformer Framework for Temporal Forgery Localization

Rui Zhang, Hongxia Wang, Mingshan Du, Hanqing Liu, Yang Zhou, Qiang Zeng

Comments 11 pages, 8 figures, 66 references. This paper has been accepted for ACM MM 2023

Journal ref Proceedings of the 31st ACM International Conference on Multimedia (MM '23), October 29-November 3, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14052 2023-08-29 cs.CV

MM-AU:Towards Multimodal Understanding of Advertisement Videos

Digbalay Bose, Rajat Hebbar, Tiantian Feng, Krishna Somandepalli, Anfeng Xu, Shrikanth Narayanan

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06725 2023-08-29 cs.CV cs.AI cs.MM

CLE Diffusion: Controllable Light Enhancement Diffusion Model

Yuyang Yin, Dejia Xu, Chuangchuang Tan, Ping Liu, Yao Zhao, Yunchao Wei

Comments Accepted In Proceedings of the 31st ACM International Conference on Multimedia (MM' 23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12845 2023-08-25 cs.CV

Implicit Obstacle Map-driven Indoor Navigation Model for Robust Obstacle Avoidance

Wei Xie, Haobo Jiang, Shuo Gu, Jin Xie

Comments 9 pages, 7 figures, 43 references. This paper has been accepted for ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12712 2023-08-25 cs.CV

Ground-to-Aerial Person Search: Benchmark Dataset and Approach

Shizhou Zhang, Qingchun Yang, De Cheng, Yinghui Xing, Guoqiang Liang, Peng Wang, Yanning Zhang

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12599 2023-08-25 cs.SD cs.LG eess.AS

Exploiting Time-Frequency Conformers for Music Audio Enhancement

Yunkee Chae, Junghyun Koo, Sungho Lee, Kyogu Lee

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04706 2023-08-25 cs.IR cs.LG

Pareto Invariant Representation Learning for Multimedia Recommendation

Shanshan Huang, Haoxuan Li, Qingsong Li, Chunyuan Zheng, Li Liu

Comments ACM MM 2023 full paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12163 2023-08-24 cs.CV

NPF-200: A Multi-Modal Eye Fixation Dataset and Method for Non-Photorealistic Videos

Ziyu Yang, Sucheng Ren, Zongwei Wu, Nanxuan Zhao, Junle Wang, Jing Qin, Shengfeng He

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12045 2023-08-24 cs.CV cs.AI cs.CL cs.MM

CgT-GAN: CLIP-guided Text GAN for Image Captioning

Jiarui Yu, Haoran Li, Yanbin Hao, Bin Zhu, Tong Xu, Xiangnan He

Comments Accepted at ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11822 2023-08-24 cs.LG cs.CR cs.CV

PatchBackdoor: Backdoor Attack against Deep Neural Networks without Model Modification

Yizhen Yuan, Rui Kong, Shenghao Xie, Yuanchun Li, Yunxin Liu

Comments accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11646 2023-08-24 cs.LG cs.AI cs.GT

Joint Local Relational Augmentation and Global Nash Equilibrium for Federated Learning with Non-IID Data

Xinting Liao, Chaochao Chen, Weiming Liu, Pengyang Zhou, Huabin Zhu, Shuheng Shen, Weiqiang Wang, Mengling Hu, Yanchao Tan, Xiaolin Zheng

Comments To appear in ACM International Conference on Multimedia (ACM MM23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02237 2023-08-24 cs.CV

MSECNet: Accurate and Robust Normal Estimation for 3D Point Clouds by Multi-Scale Edge Conditioning

Haoyi Xiu, Xin Liu, Weimin Wang, Kyoung-Sook Kim, Masashi Matsuoka

Comments Accepted for ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01095 2023-08-24 cs.CV

AutoPoster: A Highly Automatic and Content-aware Design System for Advertising Poster Generation

Jinpeng Lin, Min Zhou, Ye Ma, Yifan Gao, Chenxi Fei, Yangjian Chen, Zhang Yu, Tiezheng Ge

Comments Accepted for ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.06924 2023-08-24 cs.IR cs.MM

A Tale of Two Graphs: Freezing and Denoising Graph Structures for Multimodal Recommendation

Xin Zhou, Zhiqi Shen

Comments Accepted to ACM Multimedia (MM) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11084 2023-08-23 cs.SD eess.AS

PMVC: Data Augmentation-Based Prosody Modeling for Expressive Voice Conversion

Yimin Deng, Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao

Comments Accepted by the 31st ACM International Conference on Multimedia (MM2023)

详情

展开后加载摘要…

URL PDF HTML 收藏