arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

共收录 11877
2503.14830 2025-03-20 cs.CV

Decompositional Neural Scene Reconstruction with Generative Diffusion Prior

Junfeng Ni, Yu Liu, Ruijie Lu, Zirui Zhou, Song-Chun Zhu, Yixin Chen, Siyuan Huang

Comments CVPR'25. Project page: https://dp-recon.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14564 2025-03-20 cs.CV cs.AI cs.LG

Effortless Active Labeling for Long-Term Test-Time Adaptation

Guowei Wang, Changxing Ding

Comments CVPR 2025.Code:https://github.com/flash1803/EATTA

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11221 2025-03-20 cs.CV

Toward Generalized Image Quality Assessment: Relaxing the Perfect Reference Quality Assumption

Du Chen, Tianhe Wu, Kede Ma, Lei Zhang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08352 2025-03-20 cs.CV

Mitigating Ambiguities in 3D Classification with Gaussian Splatting

Ruiqi Zhang, Hao Zhu, Jingyi Zhao, Qi Zhang, Xun Cao, Zhan Ma

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01715 2025-03-20 cs.CV cs.AI

KeyFace: Expressive Audio-Driven Facial Animation for Long Sequences via KeyFrame Interpolation

Antoni Bigata, Michał Stypułkowski, Rodrigo Mira, Stella Bounareli, Konstantinos Vougioukas, Zoe Landgraf, Nikita Drobyshev, Maciej Zieba, Stavros Petridis, Maja Pantic

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21201 2025-03-20 cs.CV cs.AI

The PanAf-FGBG Dataset: Understanding the Impact of Backgrounds in Wildlife Behaviour Recognition

Otto Brookes, Maksim Kukushkin, Majid Mirmehdi, Colleen Stephens, Paula Dieguez, Thurston C. Hicks, Sorrel Jones, Kevin Lee, Maureen S. McCarthy, Amelia Meier, Emmanuelle Normand, Erin G. Wessling, Roman M. Wittig, Kevin Langergraber, Klaus Zuberbühler, Lukas Boesch, Thomas Schmid, Mimi Arandjelovic, Hjalmar Kühl, Tilo Burghardt

Comments 2025 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09082 2025-03-20 cs.CV

Towards Long-Horizon Vision-Language Navigation: Platform, Benchmark and Method

Xinshuai Song, Weixing Chen, Yang Liu, Weikai Chen, Guanbin Li, Liang Lin

Comments Accepted by CVPR 2025. A novel Long-Horizon Vision-Language Navigation task, project page: https://hcplab-sysu.github.io/LH-VLN/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17385 2025-03-20 cs.CV

DepthCues: Evaluating Monocular Depth Perception in Large Vision Models

Duolikun Danier, Mehmet Aygün, Changjian Li, Hakan Bilen, Oisin Mac Aodha

Comments Accepted to CVPR 2025. Project page: https://danier97.github.io/depthcues/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11666 2025-03-20 cs.CV

DORNet: A Degradation Oriented and Regularized Network for Blind Depth Super-Resolution

Zhengxue Wang, Zhiqiang Yan, Jinshan Pan, Guangwei Gao, Kai Zhang, Jian Yang

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14506 2025-03-20 cs.LG

Distilling Long-tailed Datasets

Zhenghao Zhao, Haoxuan Wang, Yuzhang Shang, Kai Wang, Yan Yan

Comments CVPR 2025. Code is available at https://github.com/ichbill/LTDD

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.06031 2025-03-20 cs.CV physics.flu-dyn

Global Transport for Fluid Reconstruction with Learned Self-Supervision

Aleksandra Franz, Barbara Solenthaler, Nils Thuerey

Comments CVPR 2021 oral, source code: https://github.com/tum-pbs/Global-Flow-Transport

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14483 2025-03-19 cs.CV

Multi-view Reconstruction via SfM-guided Monocular Depth Estimation

Haoyu Guo, He Zhu, Sida Peng, Haotong Lin, Yunzhi Yan, Tao Xie, Wenguan Wang, Xiaowei Zhou, Hujun Bao

Comments CVPR 2025. Project page: https://zju3dv.github.io/murre/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14182 2025-03-19 cs.RO cs.CV

Bridging Past and Future: End-to-End Autonomous Driving with Historical Prediction and Planning

Bozhou Zhang, Nan Song, Xin Jin, Li Zhang

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14129 2025-03-19 cs.CV

SketchFusion: Learning Universal Sketch Features through Fusing Foundation Models

Subhadeep Koley, Tapas Kumar Dutta, Aneeshan Sain, Pinaki Nath Chowdhury, Ayan Kumar Bhunia, Yi-Zhe Song

Comments Accepted in CVPR 2025. Project page available at https://subhadeepkoley.github.io/SketchFusion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14029 2025-03-19 cs.CV

Rethinking End-to-End 2D to 3D Scene Segmentation in Gaussian Splatting

Runsong Zhu, Shi Qiu, Zhengzhe Liu, Ka-Hei Hui, Qianyi Wu, Pheng-Ann Heng, Chi-Wing Fu

Comments CVPR 2025. The code is publicly available at this https URL (https://github.com/Runsong123/Unified-Lift)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14021 2025-03-19 cs.CV cs.AI cs.HC

MP-GUI: Modality Perception with MLLMs for GUI Understanding

Ziwei Wang, Weizhi Chen, Leyang Yang, Sheng Zhou, Shengchu Zhao, Hanbei Zhan, Jiongchao Jin, Liangcheng Li, Zirui Shao, Jiajun Bu

Comments Paper accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13957 2025-03-19 cs.CV

DIFFVSGG: Diffusion-Driven Online Video Scene Graph Generation

Mu Chen, Liulei Li, Wenguan Wang, Yi Yang

Comments CVPR 2025, Code: https://github.com/kagawa588/DiffVsgg

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13836 2025-03-19 cs.CV cs.AI cs.GR cs.LG

SALAD: Skeleton-aware Latent Diffusion for Text-driven Motion Generation and Editing

Seokhyeon Hong, Chaelin Kim, Serin Yoon, Junghyun Nam, Sihun Cha, Junyong Noh

Comments CVPR 2025; Project page https://seokhyeonhong.github.io/projects/salad/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13739 2025-03-19 cs.CV

Learning from Synchronization: Self-Supervised Uncalibrated Multi-View Person Association in Challenging Scenes

Keqi Chen, Vinkle Srivastav, Didier Mutter, Nicolas Padoy

Comments Accepted for CVPR 2025. Code: https://github.com/CAMMA-public/Self-MVA

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13646 2025-03-19 cs.CV

Omnia de EgoTempo: Benchmarking Temporal Understanding of Multi-Modal LLMs in Egocentric Videos

Chiara Plizzari, Alessio Tonioni, Yongqin Xian, Achin Kulshrestha, Federico Tombari

Comments Accepted to CVPR 2025. Dataset and code are available at https://github.com/google-research-datasets/egotempo.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12035 2025-03-19 cs.CV

MOS: Modeling Object-Scene Associations in Generalized Category Discovery

Zhengyuan Peng, Jinpeng Ma, Zhimin Sun, Ran Yi, Haichuan Song, Xin Tan, Lizhuang Ma

Comments Accepted to CVPR 2025.The code is available at https://github.com/JethroPeng/MOS

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10630 2025-03-19 cs.CV cs.RO

UniGoal: Towards Universal Zero-shot Goal-oriented Navigation

Hang Yin, Xiuwei Xu, Lingqing Zhao, Ziwei Wang, Jie Zhou, Jiwen Lu

Comments Accepted to CVPR 2025. Project page: https://bagh2178.github.io/UniGoal/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20762 2025-03-19 eess.IV cs.CV

Towards Practical Real-Time Neural Video Compression

Zhaoyang Jia, Bin Li, Jiahao Li, Wenxuan Xie, Linfeng Qi, Houqiang Li, Yan Lu

Comments CVPR 2025. Visit the project page at https://dcvccodec.github.io and access the code at https://github.com/microsoft/DCVC

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20161 2025-03-19 eess.IV cs.CV

Balanced Rate-Distortion Optimization in Learned Image Compression

Yichi Zhang, Zhihao Duan, Yuning Huang, Fengqing Zhu

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20032 2025-03-19 cs.LG cs.AI

Order-Robust Class Incremental Learning: Graph-Driven Dynamic Similarity Grouping

Guannan Lai, Yujie Li, Xiangkun Wang, Junbo Zhang, Tianrui Li, Xin Yang

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01709 2025-03-19 cs.CV cs.AI

MoVE-KD: Knowledge Distillation for VLMs with Mixture of Visual Encoders

Jiajun Cao, Yuan Zhang, Tao Huang, Ming Lu, Qizhe Zhang, Ruichuan An, Ningning MA, Shanghang Zhang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14295 2025-03-19 cs.CV cs.AI cs.LG cs.RO

Temporally Consistent Object-Centric Learning by Contrasting Slots

Anna Manasyan, Maximilian Seitzer, Filip Radovic, Georg Martius, Andrii Zadaianchuk

Comments Published at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02172 2025-03-19 cs.CV cs.AI cs.CL

VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning

Xueqing Wu, Yuheng Ding, Bingxuan Li, Pan Lu, Da Yin, Kai-Wei Chang, Nanyun Peng

Comments CVPR 2025. https://visco-benchmark.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19108 2025-03-19 cs.CV

Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model

Feng Liu, Shiwei Zhang, Xiaofeng Wang, Yujie Wei, Haonan Qiu, Yuzhong Zhao, Yingya Zhang, Qixiang Ye, Fang Wan

Comments Accepted in CVPR 2025. Project: https://liewfeng.github.io/TeaCache

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15205 2025-03-19 cs.CV cs.GR

DAGSM: Disentangled Avatar Generation with GS-enhanced Mesh

Jingyu Zhuang, Di Kang, Linchao Bao, Liang Lin, Guanbin Li

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏