arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1962
2308.02823 2023-08-08 cs.CV cs.AI

A Symbolic Character-Aware Model for Solving Geometry Problems

Maizhen Ning, Qiu-Feng Wang, Kaizhu Huang, Xiaowei Huang

Comments ACM MM 2023 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02813 2023-08-08 cs.CV

Deep Image Harmonization in Dual Color Spaces

Linfeng Tan, Jiangtong Li, Li Niu, Liqing Zhang

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02794 2023-08-08 cs.CV

Unfolding Once is Enough: A Deployment-Friendly Transformer Unit for Super-Resolution

Yong Liu, Hang Dong, Boyang Liang, Songwei Liu, Qingji Dong, Kai Chen, Fangmin Chen, Lean Fu, Fei Wang

Comments Accepted by the 31st ACM International Conference on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02770 2023-08-08 cs.CV

One-stage Low-resolution Text Recognition with High-resolution Knowledge Transfer

Hang Guo, Tao Dai, Mingyan Zhu, Guanghao Meng, Bin Chen, Zhi Wang, Shu-Tao Xia

Comments Accepted as the ACM MM 2023 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02606 2023-08-08 cs.CV

Improving Human-Object Interaction Detection via Virtual Image Learning

Shuman Fang, Shuai Liu, Jie Li, Guannan Jiang, Xianming Lin, Rongrong Ji

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10469 2023-08-08 cs.CV

Object Segmentation by Mining Cross-Modal Semantics

Zongwei Wu, Jingjing Wang, Zhuyun Zhou, Zhaochong An, Qiuping Jiang, Cédric Demonceaux, Guolei Sun, Radu Timofte

Comments ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02283 2023-08-07 cs.CV

Diffusion-Augmented Depth Prediction with Sparse Annotations

Jiaqi Li, Yiran Wang, Zihao Huang, Jinghong Zheng, Ke Xian, Zhiguo Cao, Jianming Zhang

Comments Accepted by ACM MM'2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02239 2023-08-07 cs.CV cs.AI cs.RO

DTF-Net: Category-Level Pose Estimation and Shape Reconstruction via Deformable Template Field

Haowen Wang, Zhipeng Fan, Zhen Zhao, Zhengping Che, Zhiyuan Xu, Dong Liu, Feifei Feng, Yakun Huang, Xiuquan Qiao, Jian Tang

Comments The first two authors are with equal contributions. Paper accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02228 2023-08-07 cs.CV

Painterly Image Harmonization using Diffusion Model

Lingxiao Lu, Jiangtong Li, Junyan Cao, Li Niu, Liqing Zhang

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02190 2023-08-07 cs.SD cs.CL eess.AS

Emo-DNA: Emotion Decoupling and Alignment Learning for Cross-Corpus Speech Emotion Recognition

Jiaxin Ye, Yujie Wei, Xin-Cheng Wen, Chenglong Ma, Zhizhong Huang, Kunhong Liu, Hongming Shan

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02177 2023-08-07 cs.CV

Scene-aware Human Pose Generation using Transformer

Jieteng Yao, Junjie Chen, Li Niu, Bin Sheng

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02173 2023-08-07 cs.CV cs.HC cs.MM

Efficient Labelling of Affective Video Datasets via Few-Shot & Multi-Task Contrastive Learning

Ravikiran Parameshwara, Ibrahim Radwan, Akshay Asthana, Iman Abbasnejad, Ramanathan Subramanian, Roland Goecke

Comments 10 pages, 6 figures, to be published in Proceedings of the 31st ACM International Conference on Multimedia (MM '23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01634 2023-08-07 cs.CV cs.MM

Disentangling Multi-view Representations Beyond Inductive Bias

Guanzhou Ke, Yang Yu, Guoqing Chao, Xiaoli Wang, Chenyang Xu, Shengfeng He

Comments 9 pages, 5 figures, 4 tables

Journal ref In Proceedings of the 31st ACM International Conference on Multimedia (MM '23), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01568 2023-08-07 cs.CV

MVFlow: Deep Optical Flow Estimation of Compressed Videos with Motion Vector Prior

Shili Zhou, Xuhao Jiang, Weimin Tan, Ruian He, Bo Yan

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12964 2023-08-07 cs.CV

Text-based Person Search without Parallel Image-Text Data

Yang Bai, Jingyao Wang, Min Cao, Chen Chen, Ziqiang Cao, Liqiang Nie, Min Zhang

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06710 2023-08-07 cs.CV cs.AI

Null-text Guidance in Diffusion Models is Secretly a Cartoon-style Creator

Jing Zhao, Heliang Zheng, Chaoyue Wang, Long Lan, Wanrong Huang, Wenjing Yang

Comments Accepted by ACM MM 2023

Journal ref ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01850 2023-08-04 cs.CV cs.AI

Synthesizing Long-Term Human Motions with Diffusion Models via Coherent Sampling

Zhao Yang, Bing Su, Ji-Rong Wen

Comments Accepted at ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01537 2023-08-04 cs.MM

Learning Causality-inspired Representation Consistency for Video Anomaly Detection

Yang Liu, Zhaoyang Xia, Mengyang Zhao, Donglai Wei, Yuzheng Wang, Liu Siao, Bobo Ju, Gaoyun Fang, Jing Liu, Liang Song

Comments Accepted to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01526 2023-08-04 cs.CV

Data Augmentation for Human Behavior Analysis in Multi-Person Conversations

Kun Li, Dan Guo, Guoliang Chen, Feiyang Liu, Meng Wang

Comments Solutions of HFUT-VUT Team at the ACM MM 2023 Grand Challenge (MultiMediate: Multi-modal Behaviour Analysis for Artificial Mediation). Accepted at ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00958 2023-08-04 cs.CR cs.AI

Isolation and Induction: Training Robust Deep Neural Networks against Model Stealing Attacks

Jun Guo, Aishan Liu, Xingyu Zheng, Siyuan Liang, Yisong Xiao, Yichao Wu, Xianglong Liu

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13501 2023-08-04 cs.CV cs.AI cs.MM

LaDI-VTON: Latent Diffusion Textual-Inversion Enhanced Virtual Try-On

Davide Morelli, Alberto Baldrati, Giuseppe Cartella, Marcella Cornia, Marco Bertini, Rita Cucchiara

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12726 2023-08-04 cs.CV cs.CL cs.MM

Towards Explainable In-the-Wild Video Quality Assessment: A Database and a Language-Prompted Approach

Haoning Wu, Erli Zhang, Liang Liao, Chaofeng Chen, Jingwen Hou, Annan Wang, Wenxiu Sun, Qiong Yan, Weisi Lin

Comments Proceedings of the 31st ACM International Conference on Multimedia (MM '23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01147 2023-08-03 cs.CV cs.MM eess.IV

Contrast-augmented Diffusion Model with Fine-grained Sequence Alignment for Markup-to-Image Generation

Guojin Zhong, Jin Yuan, Pan Wang, Kailun Yang, Weili Guan, Zhiyong Li

Comments Accepted to ACM MM 2023. The code will be released at https://github.com/zgj77/FSACDM

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01126 2023-08-03 cs.CV cs.CL cs.MM

Beyond Generic: Enhancing Image Captioning with Real-World Knowledge using Vision-Language Pre-Training Model

Kanzhi Cheng, Wenpo Song, Zheng Ma, Wenhao Zhu, Zixuan Zhu, Jianbing Zhang

Comments Accepted at ACM Multimedia (ACMMM) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00729 2023-08-03 cs.CV

Ada-DQA: Adaptive Diverse Quality-aware Feature Acquisition for Video Quality Assessment

Hongbo Liu, Mingda Wu, Kun Yuan, Ming Sun, Yansong Tang, Chuanchuan Zheng, Xing Wen, Xiu Li

Comments 10 pages, 5 figures, to appear in ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00400 2023-08-03 cs.CL cs.MM

ZRIGF: An Innovative Multimodal Framework for Zero-Resource Image-Grounded Dialogue Generation

Bo Zhang, Jian Wang, Hui Ma, Bo Xu, Hongfei Lin

Comments ACM Multimedia 2023 Accpeted, Repo: https://github.com/zhangbo-nlp/ZRIGF

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10636 2023-08-03 cs.CV

Learning and Evaluating Human Preferences for Conversational Head Generation

Mohan Zhou, Yalong Bai, Wei Zhang, Ting Yao, Tiejun Zhao, Tao Mei

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00655 2023-08-02 cs.CV

Toward Zero-shot Character Recognition: A Gold Standard Dataset with Radical-level Annotations

Xiaolei Diao, Daqian Shi, Jian Li, Lida Shi, Mingzhe Yue, Ruihua Qi, Chuntao Li, Hao Xu

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00508 2023-08-02 cs.CV

Relational Contrastive Learning for Scene Text Recognition

Jinglei Zhang, Tiancheng Lin, Yi Xu, Kai Chen, Rui Zhang

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06321 2023-08-02 cs.CV cs.MM eess.IV

SepMark: Deep Separable Watermarking for Unified Source Tracing and Deepfake Detection

Xiaoshuai Wu, Xin Liao, Bo Ou

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏