arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

共收录 11877
2503.13147 2025-04-01 cs.CV

Iterative Predictor-Critic Code Decoding for Real-World Image Dehazing

Jiayi Fu, Siyu Liu, Zikun Liu, Chun-Le Guo, Hyunhee Park, Ruiqi Wu, Guoqing Wang, Chongyi Li

Comments Acceptted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09754 2025-04-01 cs.CV

Lost in Translation, Found in Context: Sign Language Translation with Contextual Cues

Youngjoon Jang, Haran Raajesh, Liliane Momeni, Gül Varol, Andrew Zisserman

Comments CVPR 2025 Camera Ready, Project page: https://www.robots.ox.ac.uk/~vgg/research/litfic/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19412 2025-04-01 cs.CV

MINIMA: Modality Invariant Image Matching

Jiangwei Ren, Xingyu Jiang, Zizhuo Li, Dingkang Liang, Xin Zhou, Xiang Bai

Comments Accepted to CVPR 2025. The dataset and code are available at https://github.com/LSXI7/MINIMA

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17684 2025-04-01 cs.LG

COBRA: COmBinatorial Retrieval Augmentation for Few-Shot Adaptation

Arnav M. Das, Gantavya Bhatt, Lilly Kumari, Sahil Verma, Jeff Bilmes

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04852 2025-04-01 cs.CV

SleeperMark: Towards Robust Watermark against Fine-Tuning Text-to-image Diffusion Models

Zilan Wang, Junfeng Guo, Jiacheng Zhu, Yiming Li, Heng Huang, Muhao Chen, Zhengzhong Tu

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03752 2025-04-01 cs.AI

Beyond Local Sharpness: Communication-Efficient Global Sharpness-aware Minimization for Federated Learning

Debora Caldarola, Pietro Cagnasso, Barbara Caputo, Marco Ciccone

Comments Accepted at CVPR 2025, 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01316 2025-04-01 cs.CV cs.AI cs.MM

Long Video Diffusion Generation with Segmented Cross-Attention and Content-Rich Video Data Curation

Xin Yan, Yuxuan Cai, Qiuyue Wang, Yuan Zhou, Wenhao Huang, Huan Yang

Comments This paper is accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19626 2025-04-01 cs.CV cs.AI

GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding

Yawen Shao, Wei Zhai, Yuhang Yang, Hongchen Luo, Yang Cao, Zheng-Jun Zha

Comments CVPR 2025. Project page: https://yawen-shao.github.io/GREAT/ Code: https://github.com/yawen-shao/GREAT_code

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18499 2025-04-01 cs.CV

OpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation

Pengfei Zhou, Xiaopeng Peng, Jiajun Song, Chuanhao Li, Zhaopan Xu, Yue Yang, Ziyao Guo, Hao Zhang, Yuqi Lin, Yefei He, Lirui Zhao, Shuo Liu, Tianhua Li, Yuxuan Xie, Xiaojun Chang, Yu Qiao, Wenqi Shao, Kaipeng Zhang

Comments 53 pages, 19 figures, accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15738 2025-04-01 cs.CV

AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea

Qifan Yu, Wei Chow, Zhongqi Yue, Kaihang Pan, Yang Wu, Xiaoyang Wan, Juncheng Li, Siliang Tang, Hanwang Zhang, Yueting Zhuang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15262 2025-04-01 cs.CV

MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation

Weijia Wu, Mingyu Liu, Zeyu Zhu, Xi Xia, Haoen Feng, Wen Wang, Kevin Qinghong Lin, Chunhua Shen, Mike Zheng Shou

Comments The project website is at: https://weijiawu.github.io/MovieBench/. Code: https://github.com/showlab/MovieBecnh

Journal ref CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14723 2025-04-01 cs.CV

Effective SAM Combination for Open-Vocabulary Semantic Segmentation

Minhyeok Lee, Suhwan Cho, Jungho Lee, Sunghun Yang, Heeseung Choi, Ig-Jae Kim, Sangyoun Lee

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13632 2025-04-01 cs.CV

ID-Patch: Robust ID Association for Group Photo Personalization

Yimeng Zhang, Tiancheng Zhi, Jing Liu, Shen Sang, Liming Jiang, Qing Yan, Sijia Liu, Linjie Luo

Comments Accepted by CVPR 2025. Project Page is: https://byteaigc.github.io/ID-Patch/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11912 2025-04-01 cs.CV cs.AI cs.LG

F$^3$OCUS -- Federated Finetuning of Vision-Language Foundation Models with Optimal Client Layer Updating Strategy via Multi-objective Meta-Heuristics

Pramit Saha, Felix Wagner, Divyanshu Mishra, Can Peng, Anshul Thakur, David Clifton, Konstantinos Kamnitsas, J. Alison Noble

Comments Accepted in CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16770 2025-04-01 cs.CV cs.AI

The Scene Language: Representing Scenes with Programs, Words, and Embeddings

Yunzhi Zhang, Zizhang Li, Matt Zhou, Shangzhe Wu, Jiajun Wu

Comments CVPR 2025. Project page: https://ai.stanford.edu/~yzzhang/projects/scene-language/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13772 2025-04-01 cs.CV

GroupMamba: Efficient Group-Based Visual State Space Model

Abdelrahman Shaker, Syed Talal Wasim, Salman Khan, Juergen Gall, Fahad Shahbaz Khan

Comments Accepted at CVPR-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16321 2025-04-01 cs.LG cs.AI

Mosaic of Modalities: A Comprehensive Benchmark for Multimodal Graph Learning

Jing Zhu, Yuhang Zhou, Shengyi Qian, Zhongmou He, Tong Zhao, Neil Shah, Danai Koutra

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10889 2025-04-01 cs.CV cs.AI cs.LG

VELOCITI: Benchmarking Video-Language Compositional Reasoning with Strict Entailment

Darshana Saravanan, Varun Gupta, Darshan Singh, Zeeshan Khan, Vineet Gandhi, Makarand Tapaswi

Comments Accepted to CVPR 2025. Project Page, see https://katha-ai.github.io/projects/velociti

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09126 2025-04-01 cs.CV

3D-AVS: LiDAR-based 3D Auto-Vocabulary Segmentation

Weijie Wei, Osman Ülger, Fatemeh Karimi Nejadasl, Theo Gevers, Martin R. Oswald

Comments v3 is the camera-ready version for CVPR 2025, while v2 serves as both a preview and the camera-ready version for the CVPR 2024 OpenSun3D Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04489 2025-04-01 cs.CV cs.AI

SINE: SINgle Image Editing with Text-to-Image Diffusion Models

Zhixing Zhang, Ligong Han, Arnab Ghosh, Dimitris Metaxas, Jian Ren

Comments Accepted at CVPR 2023. Project website: https://zhang-zx.github.io/SINE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17726 2025-03-31 cs.CV cs.AI cs.LG

VidTwin: Video VAE with Decoupled Structure and Dynamics

Yuchi Wang, Junliang Guo, Xinyi Xie, Tianyu He, Xu Sun, Jiang Bian

Comments Accepted by CVPR 2025; Project page: https://vidtwin.github.io/; Code: https://github.com/microsoft/VidTok/tree/main/vidtwin

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13360 2025-03-31 cs.CV cs.AI cs.CL cs.LG cs.MM

RAP: Retrieval-Augmented Personalization for Multimodal Large Language Models

Haoran Hao, Jiaming Han, Changsheng Li, Yu-Feng Li, Xiangyu Yue

Comments Accepted by CVPR 2025. Code: https://github.com/Hoar012/RAP-MLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22496 2025-03-31 cs.RO cs.CV

Scenario Dreamer: Vectorized Latent Diffusion for Generating Driving Simulation Environments

Luke Rowe, Roger Girgis, Anthony Gosselin, Liam Paull, Christopher Pal, Felix Heide

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22462 2025-03-31 cs.CV

SemAlign3D: Semantic Correspondence between RGB-Images through Aligning 3D Object-Class Representations

Krispin Wandel, Hesheng Wang

Comments Accepted to CVPR 2025. Poster: https://cvpr.thecvf.com/virtual/2025/poster/32799

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22430 2025-03-31 cs.CV

MVSAnywhere: Zero-Shot Multi-View Stereo

Sergio Izquierdo, Mohamed Sayed, Michael Firman, Guillermo Garcia-Hernando, Daniyar Turmukhambetov, Javier Civera, Oisin Mac Aodha, Gabriel Brostow, Jamie Watson

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22309 2025-03-31 cs.CV

A Dataset for Semantic Segmentation in the Presence of Unknowns

Zakaria Laskar, Tomas Vojir, Matej Grcic, Iaroslav Melekhov, Shankar Gangisettye, Juho Kannala, Jiri Matas, Giorgos Tolias, C. V. Jawahar

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22262 2025-03-31 cs.CV

Mono2Stereo: A Benchmark and Empirical Study for Stereo Conversion

Songsong Yu, Yuxin Chen, Zhongang Qi, Zeke Xie, Yifan Wang, Lijun Wang, Ying Shan, Huchuan Lu

Comments Accepted by CVPR 2025 Project webpage: https://mono2stereo-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22201 2025-03-31 cs.CV

Multi-modal Knowledge Distillation-based Human Trajectory Forecasting

Jaewoo Jeong, Seohee Lee, Daehee Park, Giwon Lee, Kuk-Jin Yoon

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22163 2025-03-31 cs.LG

T-CIL: Temperature Scaling using Adversarial Perturbation for Calibration in Class-Incremental Learning

Seong-Hyeon Hwang, Minsu Kim, Steven Euijong Whang

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22020 2025-03-31 cs.CV cs.AI cs.LG cs.RO

CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models

Qingqing Zhao, Yao Lu, Moo Jin Kim, Zipeng Fu, Zhuoyang Zhang, Yecheng Wu, Zhaoshuo Li, Qianli Ma, Song Han, Chelsea Finn, Ankur Handa, Ming-Yu Liu, Donglai Xiang, Gordon Wetzstein, Tsung-Yi Lin

Comments Project website: https://cot-vla.github.io/

Journal ref CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏