arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1966
2109.04145 2021-09-10 cs.CV

PIMNet: A Parallel, Iterative and Mimicking Network for Scene Text Recognition

Zhi Qiao, Yu Zhou, Jin Wei, Wei Wang, Yuan Zhang, Ning Jiang, Hongbin Wang, Weiping Wang

Comments Accepted by ACM MM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.03483 2021-09-09 cs.CV

Pose-guided Inter- and Intra-part Relational Transformer for Occluded Person Re-Identification

Zhongxing Ma, Yifan Zhao, Jia Li

Comments 10 pages, 6 figures, Accepted by ACM MM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.03426 2021-09-09 cs.CV

Mask is All You Need: Rethinking Mask R-CNN for Dense and Arbitrary-Shaped Scene Text Detection

Xugong Qin, Yu Zhou, Youhui Guo, Dayan Wu, Zhihong Tian, Ning Jiang, Hongbin Wang, Weiping Wang

Comments Accepted by ACM MM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.02993 2021-09-08 cs.CV cs.MM cs.SD eess.AS eess.IV

Evaluation of an Audio-Video Multimodal Deepfake Dataset using Unimodal and Multimodal Detectors

Hasam Khalid, Minha Kim, Shahroz Tariq, Simon S. Woo

Comments 2 Figures, 2 Tables, Accepted for publication at the 1st Workshop on Synthetic Multimedia - Audiovisual Deepfake Generation and Detection (ADGD '21) at ACM MM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.02955 2021-09-08 cs.CV

Sensor-Augmented Egocentric-Video Captioning with Dynamic Modal Attention

Katsuyuki Nakamura, Hiroki Ohashi, Mitsuhiro Okada

Comments Accepted to ACM Multimedia (ACMMM) 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.00895 2021-09-03 cs.CV cs.AI cs.CL

Knowledge Perceived Multi-modal Pretraining in E-commerce

Yushan Zhu, Huaixiao Tou, Wen Zhang, Ganqiang Ye, Hui Chen, Ningyu Zhang, Huajun Chen

Comments Accepted to ACM MM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.02502 2021-09-03 cs.CV cs.AI

Imperceptible Adversarial Examples by Spatial Chroma-Shift

Ayberk Aydin, Deniz Sen, Berat Tuna Karli, Oguz Hanoglu, Alptekin Temizel

Comments 10 pages, 5 figures. Accepted to International Workshop on Adversarial Learning for Multimedia, ACM Multimedia 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.13630 2021-09-01 cs.CV cs.CL

SimulLR: Simultaneous Lip Reading Transducer with Attention-Guided Adaptive Memory

Zhijie Lin, Zhou Zhao, Haoyuan Li, Jinglin Liu, Meng Zhang, Xingshan Zeng, Xiaofei He

Comments ACMMM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.13098 2021-08-31 cs.CV

Object-aware Long-short-range Spatial Alignment for Few-Shot Fine-Grained Image Classification

Yike Wu, Bo Zhang, Gang Yu, Weixi Zhang, Bin Wang, Tao Chen, Jiayuan Fan

Comments Accepted by ACM MM'21 (oral presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.12973 2021-08-31 cs.SD cs.MM eess.AS

Armor: A Benchmark for Meta-evaluation of Artificial Music

Songhe Wang, Zheng Bao, Jingtong E

Comments To appear at ACM Multimedia 2021 (8 pages, 5 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.12868 2021-08-31 cs.CV

A Multimodal Framework for Video Ads Understanding

Zejia Weng, Lingchen Meng, Rui Wang, Zuxuan Wu, Yu-Gang Jiang

Comments 4 pages; 2 figures; ACM MM 2021 workshop; Tencent Advertising Algorithm Competition ACM Multimedia 2021 Grand Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.01886 2021-08-31 cs.CV

Self-Contrastive Learning with Hard Negative Sampling for Self-supervised Point Cloud Learning

Bi'an Du, Xiang Gao, Wei Hu, Xin Li

Comments Accepted to ACM MM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.12384 2021-08-30 cs.CV

DC-GNet: Deep Mesh Relation Capturing Graph Convolution Network for 3D Human Shape Reconstruction

Shihao Zhou, Mengxi Jiang, Shanshan Cai, Yunqi Lei

Comments Accepted by ACM MM'21 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.03690 2021-08-29 eess.IV cs.CV

Enhanced Invertible Encoding for Learned Image Compression

Yueqi Xie, Ka Leong Cheng, Qifeng Chen

Comments Accepted to ACM Multimedia 2021 as Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.11912 2021-08-27 cs.CV cs.CL cs.MM

Similar Scenes arouse Similar Emotions: Parallel Data Augmentation for Stylized Image Captioning

Guodun Li, Yuchen Zhai, Zehao Lin, Yin Zhang

Comments Accepted at ACM Multimedia (ACMMM) 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.11119 2021-08-26 cs.CV

Product-oriented Machine Translation with Cross-modal Cross-lingual Pre-training

Yuqing Song, Shizhe Chen, Qin Jin, Wei Luo, Jun Xie, Fei Huang

Comments Accepted as Oral by ACMMM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.10515 2021-08-25 cs.CV

ARShoe: Real-Time Augmented Reality Shoe Try-on System on Smartphones

Shan An, Guangfu Che, Jinghao Guo, Haogang Zhu, Junjie Ye, Fangru Zhou, Zhaoqi Zhu, Dong Wei, Aishan Liu, Wei Zhang

Comments Accepted by ACM Multimedia 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.00139 2021-08-24 cs.CV cs.MM

Pose-Guided Feature Learning with Knowledge Distillation for Occluded Person Re-Identification

Kecheng Zheng, Cuiling Lan, Wenjun Zeng, Jiawei Liu, Zhizheng Zhang, Zheng-Jun Zha

Comments ACM MM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08985 2021-08-23 cs.MM cs.HC

Metaverse for Social Good: A University Campus Prototype

Haihan Duan, Jiaye Li, Sizheng Fan, Zhonghao Lin, Xiao Wu, Wei Cai

Journal ref Proceedings of the 29th ACM International Conference on Multimedia (MM '21), October 20--24, 2021, Virtual Event, China

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.13322 2021-08-23 cs.CV cs.AI cs.LG cs.MM

Spatio-Temporal Inception Graph Convolutional Networks for Skeleton-Based Action Recognition

Zhen Huang, Xu Shen, Xinmei Tian, Houqiang Li, Jianqiang Huang, Xian-Sheng Hua

Comments ACM MM 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.05013 2021-08-21 cs.RO cs.CV

Elastic Tactile Simulation Towards Tactile-Visual Perception

Yikai Wang, Wenbing Huang, Bin Fang, Fuchun Sun, Chang Li

Comments ACMMM 2021 (Oral). Code available at https://github.com/yikaiw/EIP. arXiv admin note: substantial text overlap with arXiv:2011.11528

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08784 2021-08-20 cs.CV cs.MM

Wisdom of (Binned) Crowds: A Bayesian Stratification Paradigm for Crowd Counting

Sravya Vardhani Shivapuja, Mansi Pradeep Khamkar, Divij Bajaj, Ganesh Ramakrishnan, Ravi Kiran Sarvadevabhatla

Comments Accepted at ACM Multimedia (ACMMM) 2021 . Code, pretrained models and interactive visualizations can be viewed at our project page https://deepcount.iiit.ac.in/

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08674 2021-08-20 cs.CV

Towards Controllable and Photorealistic Region-wise Image Manipulation

Ansheng You, Chenglin Zhou, Qixuan Zhang, Lan Xu

Journal ref ACMMM 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08669 2021-08-20 cs.CV

Video Relation Detection via Tracklet based Visual Transformer

Kaifeng Gao, Long Chen, Yifeng Huang, Jun Xiao

Comments 1st of Video Relation Understanding (VRU) Grand Challenge in ACM Multimedia 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08633 2021-08-20 cs.CV cs.MM

Spatio-Temporal Interaction Graph Parsing Networks for Human-Object Interaction Recognition

Ning Wang, Guangming Zhu, Liang Zhang, Peiyi Shen, Hongsheng Li, Cong Hua

Comments ACM MM Oral paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08596 2021-08-20 cs.CV

Feature Stylization and Domain-aware Contrastive Learning for Domain Generalization

Seogkyu Jeon, Kibeom Hong, Pilhyeon Lee, Jewook Lee, Hyeran Byun

Comments Accepted to ACM MM 2021 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.08644 2021-08-20 cs.AI

Efficient Reinforcement Learning Development with RLzoo

Zihan Ding, Tianyang Yu, Yanhua Huang, Hongming Zhang, Guo Li, Quancheng Guo, Luo Mai, Hao Dong

Comments Accepted by ACM Multimedia Open Source Software Competition

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08217 2021-08-19 cs.CV cs.AI cs.CL cs.LG cs.MM

X-modaler: A Versatile and High-performance Codebase for Cross-modal Analytics

Yehao Li, Yingwei Pan, Jingwen Chen, Ting Yao, Tao Mei

Comments Accepted by 2021 ACMMM Open Source Software Competition. Source code: https://github.com/YehLi/xmodaler

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.08211 2021-08-19 cs.CV cs.CR

MBRS : Enhancing Robustness of DNN-based Watermarking by Mini-Batch of Real and Simulated JPEG Compression

Zhaoyang Jia, Han Fang, Weiming Zhang

Comments 9 pages, 6 figures, received by ACM MM'21

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.07073 2021-08-17 cs.CV cs.CL

ROSITA: Enhancing Vision-and-Language Semantic Alignments via Cross- and Intra-modal Knowledge Integration

Yuhao Cui, Zhou Yu, Chunqi Wang, Zhongzhou Zhao, Ji Zhang, Meng Wang, Jun Yu

Comments Accepted at ACM Multimedia 2021. Code available at https://github.com/MILVLG/rosita

详情

展开后加载摘要…

URL PDF HTML 收藏