arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1944
2308.05447 2023-08-11 cs.CV eess.IV

A Generalized Physical-knowledge-guided Dynamic Model for Underwater Image Enhancement

Pan Mu, Hanning Xu, Zheyuan Liu, Zheng Wang, Sixian Chan, Cong Bai

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05421 2023-08-11 cs.CV cs.MM

Progressive Spatio-temporal Perception for Audio-Visual Question Answering

Guangyao Li, Wenxuan Hou, Di Hu

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04132 2023-08-11 cs.MM cs.NI

Optimizing Adaptive Video Streaming with Human Feedback

Tianchi Huang, Rui-Xiao Zhang, Chenglei Wu, Lifeng Sun

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05112 2023-08-11 cs.CV cs.GR

Explicifying Neural Implicit Fields for Efficient Dynamic Human Avatar Modeling via a Neural Explicit Surface

Ruiqi Zhang, Jie Chen, Qiang Wang

Comments 8 pages, accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07304 2023-08-11 cs.CV cs.AI

CLIP-Count: Towards Text-Guided Zero-Shot Object Counting

Ruixiang Jiang, Lingbo Liu, Changwen Chen

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04828 2023-08-10 cs.CV

Seeing in Flowing: Adapting CLIP for Action Recognition with Motion Prompts Learning

Qiang Wang, Junlong Du, Ke Yan, Shouhong Ding

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04805 2023-08-10 cs.IR cs.SD eess.AS

DiVa: An Iterative Framework to Harvest More Diverse and Valid Labels from User Comments for Music

Hongru Liang, Jingyao Liu, Yuanxin Xiang, Jiachen Du, Lanjun Zhou, Shushen Pan, Wenqiang Lei

Comments 11 pages, 5 figures, published to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04767 2023-08-10 cs.CV cs.AI cs.MM cs.SD eess.AS

Induction Network: Audio-Visual Modality Gap-Bridging for Self-Supervised Sound Source Localization

Tianyu Liu, Peng Zhang, Wei Huang, Yufei Zha, Tao You, Yanning Zhang

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04672 2023-08-10 cs.CV cs.AI cs.MM

Resource Constrained Model Compression via Minimax Optimization for Spiking Neural Networks

Jue Chen, Huan Yuan, Jianchao Tan, Bin Chen, Chengru Song, Di Zhang

Comments ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04536 2023-08-10 cs.CV

Facial Prior Based First Order Motion Model for Micro-expression Generation

Yi Zhang, Youjun Zhao, Yuhang Wen, Zixuan Tang, Xinhua Xu, Mengyuan Liu

Comments ACM Multimedia 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03892 2023-08-10 cs.CV

DocDiff: Document Enhancement via Residual Diffusion Models

Zongyuan Yang, Baolin Liu, Yongping Xiong, Lan Yi, Guibin Wu, Xiaojun Tang, Ziqi Liu, Junjie Zhou, Xing Zhang

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04413 2023-08-09 cs.CV

Digging into Depth Priors for Outdoor Neural Radiance Fields

Chen Wang, Jiadai Sun, Lina Liu, Chenming Wu, Zhelun Shen, Dayan Wu, Yuchao Dai, Liangjun Zhang

Comments Accepted to ACM MM 2023. Project Page: https://cwchenwang.github.io/outdoor-nerf-depth

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04380 2023-08-09 cs.CV cs.IR cs.MM

Your Negative May not Be True Negative: Boosting Image-Text Matching with False Negative Elimination

Haoxuan Li, Yi Bin, Junrong Liao, Yang Yang, Heng Tao Shen

Comments Accepted at ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04343 2023-08-09 cs.CV cs.IR cs.MM

Unifying Two-Stream Encoders with Transformers for Cross-Modal Retrieval

Yi Bin, Haoxuan Li, Yahui Xu, Xing Xu, Yang Yang, Heng Tao Shen

Comments Accepted at ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04118 2023-08-09 cs.CV cs.MM

Multimodal Color Recommendation in Vector Graphic Documents

Qianru Qiu, Xueting Wang, Mayu Otani

Comments Accepted to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03979 2023-08-09 cs.CV

PAIF: Perception-Aware Infrared-Visible Image Fusion for Attack-Tolerant Semantic Segmentation

Zhu Liu, Jinyuan Liu, Benzhuang Zhang, Long Ma, Xin Fan, Risheng Liu

Comments Accepted by ACM MM'2023;The source codes are available at https://github.com/LiuZhu-CV/PAIF

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03975 2023-08-09 cs.CV

Prompted Contrast with Masked Motion Modeling: Towards Versatile 3D Action Representation Learning

Jiahang Zhang, Lilang Lin, Jiaying Liu

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03698 2023-08-09 cs.HC cs.CV

Screen-based 3D Subjective Experiment Software

Songlin Fan, Wei Gao

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03529 2023-08-09 cs.CV

Feature Decoupling-Recycling Network for Fast Interactive Segmentation

Huimin Zeng, Weinong Wang, Xin Tao, Zhiwei Xiong, Yu-Wing Tai, Wenjie Pei

Comments Accepted to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03177 2023-08-09 cs.CV

Boosting Few-shot 3D Point Cloud Segmentation via Query-Guided Enhancement

Zhenhua Ning, Zhuotao Tian, Guangming Lu, Wenjie Pei

Comments Accepted to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02552 2023-08-09 cs.CV

Degeneration-Tuning: Using Scrambled Grid shield Unwanted Concepts from Stable Diffusion

Zixuan Ni, Longhui Wei, Jiacheng Li, Siliang Tang, Yueting Zhuang, Qi Tian

Journal ref ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02227 2023-08-09 cs.CV cs.AI cs.HC cs.MM

MAE-DFER: Efficient Masked Autoencoder for Self-supervised Dynamic Facial Expression Recognition

Licai Sun, Zheng Lian, Bin Liu, Jianhua Tao

Comments ACM MM 2023 (camera ready). Codes and models are publicly available at https://github.com/sunlicai/MAE-DFER

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03643 2023-08-08 cs.MM

Mamba: Bringing Multi-Dimensional ABR to WebRTC

Yueheng Li, Zicheng Zhang, Hao Chen, Zhan Ma

Comments In Proceedings of the 31st ACM International Conference on Multimedia, October 29-November 3, 2023, Ottawa, ON, Canada. ACM, New York, NY, USA, 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03608 2023-08-08 cs.CV

Recurrent Self-Supervised Video Denoising with Denser Receptive Field

Zichun Wang, Yulun Zhang, Debing Zhang, Ying Fu

Comments Accepted to ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03381 2023-08-08 cs.CV

Bilevel Generative Learning for Low-Light Vision

Yingchi Liu, Zhu Liu, Long Ma, Jinyuan Liu, Xin Fan, Zhongxuan Luo, Risheng Liu

Comments Accepted by ACM MM'2023, The code will be available at https://github.com/Yingchi1998/BGL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03348 2023-08-08 cs.CV

Cooperative Colorization: Exploring Latent Cross-Domain Priors for NIR Image Spectrum Translation

Xingxing Yang, Jie Chen, Zaifeng Yang

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03331 2023-08-08 cs.CR cs.DC

A Four-Pronged Defense Against Byzantine Attacks in Federated Learning

Wei Wan, Shengshan Hu, Minghui Li, Jianrong Lu, Longling Zhang, Leo Yu Zhang, Hai Jin

Comments This paper has been accepted by the 31st ACM International Conference on Multimedia (MM '23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03280 2023-08-08 cs.CV

Mirror-NeRF: Learning Neural Radiance Fields for Mirrors with Whitted-Style Ray Tracing

Junyi Zeng, Chong Bao, Rui Chen, Zilong Dong, Guofeng Zhang, Hujun Bao, Zhaopeng Cui

Comments Accepted to ACM Multimedia 2023. Project Page: https://zju3dv.github.io/Mirror-NeRF/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03256 2023-08-08 cs.CV

Learning a Graph Neural Network with Cross Modality Interaction for Image Fusion

Jiawei Li, Jiansheng Chen, Jinyuan Liu, Huimin Ma

Comments 9 pages, 10 figures, ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03151 2023-08-08 cs.CV cs.CL

Food-500 Cap: A Fine-Grained Food Caption Benchmark for Evaluating Vision-Language Models

Zheng Ma, Mianzhi Pan, Wenhan Wu, Kanzhi Cheng, Jianbing Zhang, Shujian Huang, Jiajun Chen

Comments Accepted at ACM Multimedia (ACMMM) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏