arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1944
2204.03342 2024-10-08 cs.LG cs.AI

Domain Adaptation for Time-Series Classification to Mitigate Covariate Shift

Felix Ott, David Rügamer, Lucas Heublein, Bernd Bischl, Christopher Mutschler

Journal ref 2022 Proceedings of the 30th ACM International Conference on Multimedia (ACMMM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01594 2024-10-03 cs.CV

MM-LDM: Multi-Modal Latent Diffusion Model for Sounding Video Generation

Mingzhen Sun, Weining Wang, Yanyuan Qiao, Jiahui Sun, Zihan Qin, Longteng Guo, Xinxin Zhu, Jing Liu

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08202 2024-10-02 cs.CV

Towards Practical Human Motion Prediction with LiDAR Point Clouds

Xiao Han, Yiming Ren, Yichen Yao, Yujing Sun, Yuexin Ma

Comments Accepted by ACM MM Oral 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12371 2024-10-02 cs.CV

Gait Recognition in Large-scale Free Environment via Single LiDAR

Xiao Han, Yiming Ren, Peishan Cong, Yujing Sun, Jingya Wang, Lan Xu, Yuexin Ma

Comments Accepted by ACM MM Oral 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20081 2024-10-01 cs.CV cs.MM

ProFD: Prompt-Guided Feature Disentangling for Occluded Person Re-Identification

Can Cui, Siteng Huang, Wenxuan Song, Pengxiang Ding, Min Zhang, Donglin Wang

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19961 2024-10-01 cs.CV cs.CL

Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval

Yabing Wang, Le Wang, Qiang Zhou, Zhibin Wang, Hao Li, Gang Hua, Wei Tang

Comments Accepted by ACM Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19342 2024-10-01 cs.CV

X-Prompt: Multi-modal Visual Prompt for Video Object Segmentation

Pinxue Guo, Wanyun Li, Hao Huang, Lingyi Hong, Xinyu Zhou, Zhaoyu Chen, Jinglun Li, Kaixun Jiang, Wei Zhang, Wenqiang Zhang

Comments ACMMM'2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18561 2024-09-30 cs.CV

AL-GTD: Deep Active Learning for Gaze Target Detection

Francesco Tonini, Nicola Dall'Asen, Lorenzo Vaquero, Cigdem Beyan, Elisa Ricci

Comments Accepted to ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17779 2024-09-30 cs.CV

DAC: 2D-3D Retrieval with Noisy Labels via Divide-and-Conquer Alignment and Correction

Chaofan Gan, Yuanpeng Tu, Yuxi Li, Weiyao Lin

Comments accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17523 2024-09-27 cs.CV cs.AI

EAGLE: Egocentric AGgregated Language-video Engine

Jing Bi, Yunlong Tang, Luchuan Song, Ali Vosoughi, Nguyen Nguyen, Chenliang Xu

Comments Accepted by ACMMM 24

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17432 2024-09-27 cs.CV

HazeSpace2M: A Dataset for Haze Aware Single Image Dehazing

Md Tanvir Islam, Nasir Rahim, Saeed Anwar, Muhammad Saqib, Sambit Bakshi, Khan Muhammad

Comments Accepted by ACM Multimedia 2024

Journal ref ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05445 2024-09-26 cs.MM

Navigating Weight Prediction with Diet Diary

Yinxuan Gui, Bin Zhu, Jingjing Chen, Chong-Wah Ngo, Yu-Gang Jiang

Comments ACM MM'24 oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16081 2024-09-25 cs.HC cs.AI

Online Multi-level Contrastive Representation Distillation for Cross-Subject fNIRS Emotion Recognition

Zhili Lai, Chunmei Qing, Junpeng Tan, Wanxiang Luo, Xiangmin Xu

Comments Accepted in ACMMM-2024 Workshop BCI. Codes are available at https://github.com/Lzhili/fNIRS-OMCRD

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14925 2024-09-24 cs.CV cs.MM

DanceCamAnimator: Keyframe-Based Controllable 3D Dance Camera Synthesis

Zixuan Wang, Jiayi Li, Xiaoyu Qin, Shikun Sun, Songtao Zhou, Jia Jia, Jiebo Luo

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07720 2024-09-24 cs.CV cs.AI

Multi-modal Auto-regressive Modeling via Visual Words

Tianshuo Peng, Zuchao Li, Lefei Zhang, Hai Zhao, Ping Wang, Bo Du

Comments ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09831 2024-09-24 cs.CV

Digging into contrastive learning for robust depth estimation with diffusion models

Jiyuan Wang, Chunyu Lin, Lang Nie, Kang Liao, Shuwei Shao, Yao Zhao

Comments Accept by ACM MM 2024, Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13136 2024-09-23 cs.LG cs.CR cs.CV

Federated Learning with Label-Masking Distillation

Jianghu Lu, Shikun Li, Kexin Bao, Pengju Wang, Zhenxing Qian, Shiming Ge

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12385 2024-09-20 cs.CV cs.AI cs.LG

Look Through Masks: Towards Masked Face Recognition with De-Occlusion Distillation

Chenyu Li, Shiming Ge, Daichi Zhang, Jia Li

Comments Accepted by ACM MM 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16114 2024-09-20 cs.CV cs.AI cs.LG

Learning Noise-Robust Joint Representation for Multimodal Emotion Recognition under Incomplete Data Scenarios

Qi Fan, Haolin Zuo, Rui Liu, Zheng Lian, Guanglai Gao

Comments Accepted by MRAC@ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15051 2024-09-17 cs.CV

Prior Knowledge Integration via LLM Encoding and Pseudo Event Regulation for Video Moment Retrieval

Yiyang Jiang, Wengyu Zhang, Xulu Zhang, Xiaoyong Wei, Chang Wen Chen, Qing Li

Comments Accepted to ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.07273 2024-09-16 eess.IV cs.CV

MLIC: Multi-Reference Entropy Model for Learned Image Compression

Wei Jiang, Jiayu Yang, Yongqi Zhai, Peirong Ning, Feng Gao, Ronggang Wang

Comments Accepted to ACMMM 2023

Journal ref Proceedings of the 31st ACM International Conference on Multimedia, pp.7618--7627, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08251 2024-09-13 cs.CV

Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding

Hongyu Li, Tianrui Hui, Zihan Ding, Jing Zhang, Bin Ma, Xiaoming Wei, Jizhong Han, Si Liu

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00991 2024-09-13 cs.CV cs.AI

3D Priors-Guided Diffusion for Blind Face Restoration

Xiaobin Lu, Xiaobin Hu, Jun Luo, Ben Zhu, Yaping Ruan, Wenqi Ren

Comments This paper was accepted by ACM MM 2024, and the project page is accessible at: https://github.com/838143396/3Diffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07452 2024-09-12 cs.CV cs.MM

Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models

Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Chong-Wah Ngo, Tao Mei

Comments ACM Multimedia 2024. Source code is available at \url{https://github.com/yanghb22-fdu/Hi3D-Official}

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07451 2024-09-12 cs.CV cs.MM

FreeEnhance: Tuning-Free Image Enhancement via Content-Consistent Noising-and-Denoising Process

Yang Luo, Yiheng Zhang, Zhaofan Qiu, Ting Yao, Zhineng Chen, Yu-Gang Jiang, Tao Mei

Comments ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07256 2024-09-12 cs.CV

MRAC Track 1: 2nd Workshop on Multimodal, Generative and Responsible Affective Computing

Shreya Ghosh, Zhixi Cai, Abhinav Dhall, Dimitrios Kollias, Roland Goecke, Tom Gedeon

Comments ACM MM Workshop 2024. Workshop webpage: https://react-ws.github.io/2024/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06991 2024-09-12 cs.CV

1M-Deepfakes Detection Challenge

Zhixi Cai, Abhinav Dhall, Shreya Ghosh, Munawar Hayat, Dimitrios Kollias, Kalin Stefanov, Usman Tariq

Comments ACM MM 2024. Challenge webpage: https://deepfakes1m.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21773 2024-09-12 cs.CV

RainMamba: Enhanced Locality Learning with State Space Models for Video Deraining

Hongtao Wu, Yijun Yang, Huihui Xu, Weiming Wang, Jinni Zhou, Lei Zhu

Comments ACM Multimedia 2024 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05868 2024-09-11 cs.CV

SpecGaussian with Latent Features: A High-quality Modeling of the View-dependent Appearance for 3D Gaussian Splatting

Zhiru Wang, Shiyun Xie, Chengwei Pan, Guoping Wang

Comments 9 pages,6 figures, 5 tables, ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.08727 2024-09-11 cs.CV

Improving Out-of-Distribution Detection with Disentangled Foreground and Background Features

Choubo Ding, Guansong Pang

Comments Accepted by ACM MM 2024, 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏