arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1966
2212.01007 2022-12-05 cs.CV

Compound Batch Normalization for Long-tailed Image Classification

Lechao Cheng, Chaowei Fang, Dingwen Zhang, Guanbin Li, Gang Huang

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.11401 2022-12-05 cs.CL cs.CV cs.MM

Chunk-aware Alignment and Lexical Constraint for Visual Entailment with Natural Language Explanations

Qian Yang, Yunxin Li, Baotian Hu, Lin Ma, Yuxing Ding, Min Zhang

Comments 11 pages (including Supplementary Materials); Accepted to ACM MM 2022

Journal ref ACM International Conference on Multimedia. 2022. 3587-3597

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05392 2022-12-01 cs.CV

TGDM: Target Guided Dynamic Mixup for Cross-Domain Few-Shot Learning

Linhai Zhuo, Yuqian Fu, Jingjing Chen, Yixin Cao, Yu-Gang Jiang

Comments accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.11978 2022-11-30 cs.CV

Meta-FDMixup: Cross-Domain Few-Shot Learning Guided by Labeled Target Data

Yuqian Fu, Yanwei Fu, Yu-Gang Jiang

Comments Accepted by ACM Multimedia 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08965 2022-11-29 cs.CV cs.AI cs.CL cs.MM

GSRFormer: Grounded Situation Recognition Transformer with Alternate Semantic Attention Refinement

Zhi-Qi Cheng, Qi Dai, Siyao Li, Teruko Mitamura, Alexander G. Hauptmann

Comments ACM Multimedia 2022 (Oral), Code: https://github.com/zhiqic/GSRFormer

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13235 2022-11-28 cs.CL cs.AI cs.CV

Unified Multimodal Model with Unlikelihood Training for Visual Dialog

Zihao Wang, Junli Wang, Changjun Jiang

Comments Accepted by the 30th ACM International Conference on Multimedia (ACM MM 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12716 2022-11-24 cs.CV

Global Meets Local: Effective Multi-Label Image Classification via Category-Aware Weak Supervision

Jiawei Zhan, Jun Liu, Wei Tang, Guannan Jiang, Xi Wang, Bin-Bin Gao, Tianliang Zhang, Wenlong Wu, Wei Zhang, Chengjie Wang, Yuan Xie

Comments 12 pages, 10 figures, published in ACMMM 2022

Journal ref Proceedings of the 30th ACM International Conference on Multimedia. 2022: 6318-6326

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.09868 2022-11-24 cs.CV

Adaptive Mixture of Experts Learning for Generalizable Face Anti-Spoofing

Qianyu Zhou, Ke-Yue Zhang, Taiping Yao, Ran Yi, Shouhong Ding, Lizhuang Ma

Comments Accepted to ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.11695 2022-11-22 cs.CV

Estimation of Reliable Proposal Quality for Temporal Action Detection

Junshan Hu, Chaoxu guo, Liansheng Zhuang, Biao Wang, Tiezheng Ge, Yuning Jiang, Houqiang Li

Comments Accepted to ACM Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.10382 2022-11-21 cs.CV cs.IR

Informative Sample-Aware Proxy for Deep Metric Learning

Aoyu Li, Ikuro Sato, Kohta Ishikawa, Rei Kawakami, Rio Yokota

Comments Accepted at ACM Multimedia Asia (MMAsia) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.00239 2022-11-15 cs.CV

ObjectMix: Data Augmentation by Copy-Pasting Objects in Videos for Action Recognition

Jun Kimata, Tomoya Nitta, Toru Tamaki

Comments ACM Multimedia Asia (MMAsia '22), December 13--16, 2022, Tokyo, Japan

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.05429 2022-11-11 cs.CV cs.GR cs.MM

DrawMon: A Distributed System for Detection of Atypical Sketch Content in Concurrent Pictionary Games

Nikhil Bansal, Kartik Gupta, Kiruthika Kannan, Sivani Pentapati, Ravi Kiran Sarvadevabhatla

Comments Presented at ACM Multimedia 2022. For project page and dataset, visit https://drawm0n.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.04753 2022-11-10 cs.CV

ReFu: Refine and Fuse the Unobserved View for Detail-Preserving Single-Image 3D Human Reconstruction

Gyumin Shim, Minsoo Lee, Jaegul Choo

Comments Accepted at ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.04534 2022-11-10 cs.CV cs.CL

Going for GOAL: A Resource for Grounded Football Commentaries

Alessandro Suglia, José Lopes, Emanuele Bastianelli, Andrea Vanzo, Shubham Agarwal, Malvina Nikandrou, Lu Yu, Ioannis Konstas, Verena Rieser

Comments Preprint formatted using the ACM Multimedia template (8 pages + appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.03314 2022-11-08 cs.CV cs.CL

CLOP: Video-and-Language Pre-Training with Knowledge Regularizations

Guohao Li, Hu Yang, Feng He, Zhifan Feng, Yajuan Lyu, Hua Wu, Haifeng Wang

Comments ACM Multimedia 2022 (MM'22)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.00890 2022-11-03 cs.CV

Rethinking the Metric in Few-shot Learning: From an Adaptive Multi-Distance Perspective

Jinxiang Lai, Siqian Yang, Guannan Jiang, Xi Wang, Yuxi Li, Zihui Jia, Xiaochen Chen, Jun Liu, Bin-Bin Gao, Wei Zhang, Yuan Xie, Chengjie Wang

Journal ref Proceedings of the 30th ACM International Conference on Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.15902 2022-10-31 eess.IV cs.CV

Learning to Immunize Images for Tamper Localization and Self-Recovery

Qichao Ying, Hang Zhou, Zhenxing Qian, Sheng Li, Xinpeng Zhang

Comments Under Review. Extended version of our ACMMM 2021 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.11826 2022-10-27 cs.CV

Fast and Flexible Human Pose Estimation with HyperPose

Yixiao Guo, Jiawei Liu, Guo Li, Luo Mai, Hao Dong

Comments 4 pages, 1 figure. Published in ACM Multimedia

Journal ref Proceedings of the 29th ACM International Conference on Multimedia, 2021, 3763-3766

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.13835 2022-10-26 cs.CV

Synthetic Data Supervised Salient Object Detection

Zhenyu Wu, Lin Wang, Wei Wang, Tengfei Shi, Chenglizhao Chen, Aimin Hao, Shuo Li

Comments 9 pages, 8 figures

Journal ref ACM MM, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.10972 2022-10-25 cs.MM cs.CV

A Multimodal Sensor Fusion Framework Robust to Missing Modalities for Person Recognition

Vijay John, Yasutomo Kawanishi

Comments Accepted for ACM Multimedia Asia, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.15312 2022-10-25 cs.CV

In-N-Out Generative Learning for Dense Unsupervised Video Segmentation

Xiao Pan, Peike Li, Zongxin Yang, Huiling Zhou, Chang Zhou, Hongxia Yang, Jingren Zhou, Yi Yang

Comments Accepted by ACM MM 2022

Journal ref ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.05691 2022-10-24 cs.LG cs.AI cs.CL cs.MM eess.AS

The MuSe 2022 Multimodal Sentiment Analysis Challenge: Humor, Emotional Reactions, and Stress

Lukas Christ, Shahin Amiriparian, Alice Baird, Panagiotis Tzirakis, Alexander Kathan, Niklas Müller, Lukas Stappen, Eva-Maria Meßner, Andreas König, Alan Cowen, Erik Cambria, Björn W. Schuller

Comments Baseline paper for the 3rd Multimodal Sentiment Analysis Challenge (MuSe) 2022, a full-day workshop at ACM Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.14047 2022-10-21 cs.CV cs.MM eess.IV

A Deep Learning based No-reference Quality Assessment Model for UGC Videos

Wei Sun, Xiongkuo Min, Wei Lu, Guangtao Zhai

Comments Accepted by ACM MM 2022

Journal ref Proceedings of the 30th ACM International Conference on Multimedia (2022) 856-865

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.06829 2022-10-21 cs.MM

Realistic Video Sequences for Subjective QoE Analysis

Kerim Hodzic, Mirsad Cosovic, Sasa Mrdovic, Jason J. Quinlan, Darijo Raca

Comments conference paper

Journal ref MMSys 22: Proceedings of the 13th ACM Multimedia Systems Conference, June 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.10897 2022-10-19 cs.CV

Efficient Modeling of Future Context for Image Captioning

Zhengcong Fei, Junshi Huang, Xiaoming Wei, Xiaolin Wei

Comments ACM Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.06818 2022-10-14 eess.AS cs.SD

Deepfake Detection System for the ADD Challenge Track 3.2 Based on Score Fusion

Yuxiang Zhang, Jingze Lu, Xingming Wang, Zhuo Li, Runqiu Xiao, Wenchao Wang, Ming Li, Pengyuan Zhang

Comments Accepted by ACM Multimedia 2022 Workshop: First International Workshop on Deepfake Detection for Audio Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.06779 2022-10-14 cs.CV

Generalized Inter-class Loss for Gait Recognition

Weichen Yu, Hongyuan Yu, Yan Huang, Liang Wang

Comments to be published in ACMMM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.06054 2022-10-14 cs.SD cs.LG cs.MM eess.AS

SongDriver: Real-time Music Accompaniment Generation without Logical Latency nor Exposure Bias

Zihao Wang, Qihao Liang, Kejun Zhang, Yuxing Wang, Chen Zhang, Pengfei Yu, Yongsheng Feng, Wenbo Liu, Yikai Wang, Yuntai Bao, Yiheng Yang

Comments *Both Zihao Wang and Qihao Liang contribute equally to the paper and share the co-first authorship. This paper has been accepted by ACM Multimedia 2022, oral session, full paper (main track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.12964 2022-10-13 cs.CV

Incremental Few-Shot Semantic Segmentation via Embedding Adaptive-Update and Hyper-class Representation

Guangchen Shi, Yirui Wu, Jun Liu, Shaohua Wan, Wenhai Wang, Tong Lu

Journal ref Proceedings of the 30th ACM International Conference on Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05280 2022-10-12 cs.CV

ME-D2N: Multi-Expert Domain Decompositional Network for Cross-Domain Few-Shot Learning

Yuqian Fu, Yu Xie, Yanwei Fu, Jingjing Chen, Yu-Gang Jiang

Comments Accepted by ACM Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏