arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1944
2408.12895 2024-08-26 cs.MM

Ada2I: Enhancing Modality Balance for Multimodal Conversational Emotion Recognition

Cam-Van Thi Nguyen, The-Son Le, Anh-Tuan Mai, Duc-Trong Le

Comments Accepted at ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12796 2024-08-26 cs.AI cs.CV

Real-Time Posture Monitoring and Risk Assessment for Manual Lifting Tasks Using MediaPipe and LSTM

Ereena Bagga, Ang Yang

Comments Proceedings of the 1st International Workshop on Multimedia Computing for Health and Medicine at ACM MM'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12292 2024-08-23 cs.CV cs.AI

Towards Deconfounded Image-Text Matching with Causal Inference

Wenhui Li, Xinqi Su, Dan Song, Lanjun Wang, Kun Zhang, An-An Liu

Comments ACM MM

Journal ref 2023/10/26,Proceedings of the 31st ACM International Conference on Multimedia,6264-6273

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10500 2024-08-23 cs.MM cs.CV cs.SD eess.AS

SZTU-CMU at MER2024: Improving Emotion-LLaMA with Conv-Attention for Multimodal Emotion Recognition

Zebang Cheng, Shuyuan Tu, Dawei Huang, Minghan Li, Xiaojiang Peng, Zhi-Qi Cheng, Alexander G. Hauptmann

Comments Ranked 1st in MER24@IJCAI and MRAC24@ACM MM (MER-NOISE & MER-OV (self-evaluated))

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07794 2024-08-23 cs.CV

DGMamba: Domain Generalization via Generalized State Space Model

Shaocong Long, Qianyu Zhou, Xiangtai Li, Xuequan Lu, Chenhao Ying, Yuan Luo, Lizhuang Ma, Shuicheng Yan

Comments Accepted to ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11334 2024-08-22 cs.CL cs.AI

BURExtract-Llama: An LLM for Clinical Concept Extraction in Breast Ultrasound Reports

Yuxuan Chen, Haoyan Yang, Hengkai Pan, Fardeen Siddiqui, Antonio Verdone, Qingyang Zhang, Sumit Chopra, Chen Zhao, Yiqiu Shen

Comments This paper has been accepted as the oral paper for the HCHM workshop, ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05966 2024-08-22 cs.CV cs.AI cs.GR cs.MM

Freehand Sketch Generation from Mechanical Components

Zhichao Liao, Di Huang, Heming Fang, Yue Ma, Fengyuan Piao, Xinghui Li, Long Zeng, Pingfa Feng

Comments Published at ACM Multimedia (ACM MM) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11055 2024-08-21 cs.CV

Prompt-Guided Image-Adaptive Neural Implicit Lookup Tables for Interpretable Image Enhancement

Satoshi Kosugi

Comments Accepted to ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10935 2024-08-21 cs.CV

Large Point-to-Gaussian Model for Image-to-3D Generation

Longfei Lu, Huachen Gao, Tao Dai, Yaohua Zha, Zhi Hou, Junta Wu, Shu-Tao Xia

Comments 10 pages, 9 figures, ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10247 2024-08-21 q-bio.BM cs.AI

MetaEnzyme: Meta Pan-Enzyme Learning for Task-Adaptive Redesign

Jiangbin Zheng, Han Zhang, Qianqing Xu, An-Ping Zeng, Stan Z. Li

Comments Accepted to ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00763 2024-08-21 cs.SE cs.AI cs.CL cs.CV cs.MM

New Job, New Gender? Measuring the Social Bias in Image Generation Models

Wenxuan Wang, Haonan Bai, Jen-tse Huang, Yuxuan Wan, Youliang Yuan, Haoyi Qiu, Nanyun Peng, Michael R. Lyu

Comments ACM MM 2024 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05713 2024-08-20 cs.CV

SSL: A Self-similarity Loss for Improving Generative Image Super-resolution

Du Chen, Zhengqiang Zhang, Jie Liang, Lei Zhang

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01669 2024-08-20 cs.CV cs.MM

SynopGround: A Large-Scale Dataset for Multi-Paragraph Video Grounding from TV Dramas and Synopses

Chaolei Tan, Zihang Lin, Junfu Pu, Zhongang Qi, Wei-Yi Pei, Zhi Qu, Yexin Wang, Ying Shan, Wei-Shi Zheng, Jian-Fang Hu

Comments Accepted to ACM MM 2024. Project page: https://synopground.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09384 2024-08-20 cs.CV cs.MM

FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model

Ziyu Yao, Xuxin Cheng, Zhiqi Huang

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09191 2024-08-20 cs.CV

GSLAMOT: A Tracklet and Query Graph-based Simultaneous Locating, Mapping, and Multiple Object Tracking System

Shuo Wang, Yongcai Wang, Zhimin Xu, Yongyu Guo, Wanting Li, Zhe Huang, Xuewei Bai, Deying Li

Comments 11 pages, 9 figures, ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09178 2024-08-20 cs.CV

MambaTrack: A Simple Baseline for Multiple Object Tracking with State Space Model

Changcheng Xiao, Qiong Cao, Zhigang Luo, Long Lan

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09122 2024-08-20 cs.CV

MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation

Xiao Zhao, Xukun Zhang, Dingkang Yang, Mingyang Sun, Mingcheng Li, Shunli Wang, Lihua Zhang

Comments Accepted to ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14812 2024-08-20 cs.CV cs.AI

WeakSAM: Segment Anything Meets Weakly-supervised Instance-level Recognition

Lianghui Zhu, Junwei Zhou, Yan Liu, Xin Hao, Wenyu Liu, Xinggang Wang

Comments Accepted by ACM MM 2024. Code is available at https://github.com/hustvl/WeakSAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08903 2024-08-20 cs.CV cs.LG

Rethinking Impersonation and Dodging Attacks on Face Recognition Systems

Fengfan Zhou, Qianyu Zhou, Bangjie Yin, Hui Zheng, Xuequan Lu, Lizhuang Ma, Hefei Ling

Comments Accepted to ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08543 2024-08-19 cs.CV

Language-Driven Interactive Shadow Detection

Hongqiu Wang, Wei Wang, Haipeng Zhou, Huihui Xu, Shaozhi Wu, Lei Zhu

Comments ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19988 2024-08-19 cs.MM

HeadsetOff: Enabling Photorealistic Video Conferencing on Economical VR Headsets

Yili Jin, Xize Duan, Fangxin Wang, Xue Liu

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08125 2024-08-16 cs.CV

Category-Prompt Refined Feature Learning for Long-Tailed Multi-Label Image Classification

Jiexuan Yan, Sheng Huang, Nankun Mu, Luwen Huangfu, Bo Liu

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07944 2024-08-16 cs.CV

Training Spatial-Frequency Visual Prompts and Probabilistic Clusters for Accurate Black-Box Transfer Learning

Wonwoo Cho, Kangyeol Kim, Saemee Choi, Jaegul Choo

Comments ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07919 2024-08-16 eess.AS

Advancing Multi-grained Alignment for Contrastive Language-Audio Pre-training

Yiming Li, Zhifang Guo, Xiangdong Wang, Hong Liu

Comments ACM MM 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07819 2024-08-16 cs.MM cs.CV cs.LG

Regularized Contrastive Partial Multi-view Outlier Detection

Yijia Wang, Qianqian Xu, Yangbangyan Jiang, Siran Dai, Qingming Huang

Comments Proceedings of the 32nd ACM International Conference on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07736 2024-08-16 cs.LG cs.AI

Enhancing Model Interpretability with Local Attribution over Global Exploration

Zhiyu Zhu, Zhibo Jin, Jiayu Zhang, Huaming Chen

Comments Accepted by ACMMM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08556 2024-08-16 cs.CV cs.AI

SM4Depth: Seamless Monocular Metric Depth Estimation across Multiple Cameras and Scenes by One Model

Yihao Liu, Feng Xue, Anlong Ming, Mingshuai Zhao, Huadong Ma, Nicu Sebe

Comments Accepted by ACM MultiMedia 24, Project Page: xuefeng-cvr.github.io/SM4Depth

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07530 2024-08-15 cs.CV

Towards Real-time Video Compressive Sensing on Mobile Devices

Miao Cao, Lishun Wang, Huan Wang, Guoqing Wang, Xin Yuan

Comments 9 pages, Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07484 2024-08-15 cs.CV eess.IV

GRFormer: Grouped Residual Self-Attention for Lightweight Single Image Super-Resolution

Yuzhen Li, Zehang Deng, Yuxin Cao, Lihua Liu

Comments Accepted for ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07050 2024-08-14 cs.SD cs.CV eess.AS

PSM: Learning Probabilistic Embeddings for Multi-scale Zero-Shot Soundscape Mapping

Subash Khanal, Eric Xing, Srikumar Sastry, Aayush Dhakal, Zhexiao Xiong, Adeel Ahmad, Nathan Jacobs

Comments Accepted at ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏