arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

共收录 11877
2503.17142 2025-03-24 cs.CV cs.LG

Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models

Davide Berasi, Matteo Farina, Massimiliano Mancini, Elisa Ricci, Nicola Strisciuglio

Comments Camera-ready version for CVPR 2025 (with Supp.Mat.)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17093 2025-03-24 cs.CV

ColabSfM: Collaborative Structure-from-Motion by Point Cloud Registration

Johan Edstedt, André Mateus, Alberto Jaenal

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17080 2025-03-24 cs.CV

Seeing What Matters: Empowering CLIP with Patch Generation-to-Selection

Gensheng Pei, Tao Chen, Yujia Wang, Xinhao Cai, Xiangbo Shu, Tianfei Zhou, Yazhou Yao

Comments accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16997 2025-03-24 cs.CV

Steady Progress Beats Stagnation: Mutual Aid of Foundation and Conventional Models in Mixed Domain Semi-Supervised Medical Image Segmentation

Qinghe Ma, Jian Zhang, Zekun Li, Lei Qi, Qian Yu, Yinghuan Shi

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16956 2025-03-24 eess.AS cs.AI cs.CV cs.SD

From Faces to Voices: Learning Hierarchical Representations for High-quality Video-to-Speech

Ji-Hoon Kim, Jeongsoo Choi, Jaehun Kim, Chaeyoung Jung, Joon Son Chung

Comments CVPR 2025, demo page: https://mm.kaist.ac.kr/projects/faces2voices/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16930 2025-03-24 cs.CV

Vision-Language Gradient Descent-driven All-in-One Deep Unfolding Networks

Haijin Zeng, Xiangming Wang, Yongyong Chen, Jingyong Su, Jie Liu

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16916 2025-03-24 cs.CV

Temporal Action Detection Model Compression by Progressive Block Drop

Xiaoyong Chen, Yong Guo, Jiaming Liang, Sitong Zhuang, Runhao Zeng, Xiping Hu

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16873 2025-03-24 cs.CV cs.AI

Classifier-guided CLIP Distillation for Unsupervised Multi-label Classification

Dongseob Kim, Hyunjung Shim

Comments CVPR 2025 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16843 2025-03-24 cs.CV

LoRASculpt: Sculpting LoRA for Harmonizing General and Specialized Knowledge in Multimodal Large Language Models

Jian Liang, Wenke Huang, Guancheng Wan, Qu Yang, Mang Ye

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16709 2025-03-24 cs.CV cs.AI

QuartDepth: Post-Training Quantization for Real-Time Depth Estimation on the Edge

Xuan Shen, Weize Ma, Jing Liu, Changdi Yang, Rui Ding, Quanyi Wang, Henghui Ding, Wei Niu, Yanzhi Wang, Pu Zhao, Jun Lin, Jiuxiang Gu

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15300 2025-03-24 cs.CV

SUM Parts: Benchmarking Part-Level Semantic Segmentation of Urban Meshes

Weixiao Gao, Liangliang Nan, Hugo Ledoux

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14897 2025-03-24 cs.CV

When Domain Generalization meets Generalized Category Discovery: An Adaptive Task-Arithmetic Driven Approach

Vaibhav Rathore, Shubhranil B, Saikat Dutta, Sarthak Mehrotra, Zsolt Kira, Biplab Banerjee

Comments Accepted at CVPR 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13214 2025-03-24 cs.CV cs.AI

A General Adaptive Dual-level Weighting Mechanism for Remote Sensing Pansharpening

Jie Huang, Haorui Chen, Jiaxuan Ren, Siran Peng, Liangjian Deng

Comments This paper is accepted at the CVPR Conference on Computer Vision and Pattern Recognition 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08140 2025-03-24 cs.CV cs.RO

HOTFormerLoc: Hierarchical Octree Transformer for Versatile Lidar Place Recognition Across Ground and Aerial Views

Ethan Griffiths, Maryam Haghighat, Simon Denman, Clinton Fookes, Milad Ramezani

Comments 16 pages, 13 figures, 10 tables, Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07685 2025-03-24 cs.CV

Matrix3D: Large Photogrammetry Model All-in-One

Yuanxun Lu, Jingyang Zhang, Tian Fang, Jean-Daniel Nahmias, Yanghai Tsin, Long Quan, Xun Cao, Yao Yao, Shiwei Li

Comments CVPR 2025 camera ready. Project Page: https://nju-3dv.github.io/projects/matrix3d

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07411 2025-03-24 cs.CV cs.MM

EgoTextVQA: Towards Egocentric Scene-Text Aware Video Question Answering

Sheng Zhou, Junbin Xiao, Qingyun Li, Yicong Li, Xun Yang, Dan Guo, Meng Wang, Tat-Seng Chua, Angela Yao

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06553 2025-03-24 cs.CV

VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification

Xianwei Zhuang, Zhihong Zhu, Yuxin Xie, Liming Liang, Yuexian Zou

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08376 2025-03-24 cs.CV

Reloc3r: Large-Scale Training of Relative Camera Pose Regression for Generalizable, Fast, and Accurate Visual Localization

Siyan Dong, Shuzhe Wang, Shaohui Liu, Lulu Cai, Qingnan Fan, Juho Kannala, Yanchao Yang

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06699 2025-03-24 cs.CV

You See it, You Got it: Learning 3D Creation on Pose-Free Videos at Scale

Baorui Ma, Huachen Gao, Haoge Deng, Zhengxiong Luo, Tiejun Huang, Lulu Tang, Xinlong Wang

Comments Accepted by CVPR 2025, Project Page: https://vision.baai.ac.cn/see3d

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04455 2025-03-24 cs.RO cs.AI cs.CV cs.LG

Code-as-Monitor: Constraint-aware Visual Programming for Reactive and Proactive Robotic Failure Detection

Enshen Zhou, Qi Su, Cheng Chi, Zhizheng Zhang, Zhongyuan Wang, Tiejun Huang, Lu Sheng, He Wang

Comments Accepted by CVPR 2025. Project page: https://zhoues.github.io/Code-as-Monitor/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04077 2025-03-24 cs.CV

SoMA: Singular Value Decomposed Minor Components Adaptation for Domain Generalizable Representation Learning

Seokju Yun, Seunghye Chae, Dongheon Lee, Youngmin Ro

Comments CVPR 2025 Project page: https://ysj9909.github.io/SoRA.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10332 2025-03-24 cs.CV

Number it: Temporal Grounding Videos like Flipping Manga

Yongliang Wu, Xinting Hu, Yuyang Sun, Yizhou Zhou, Wenbo Zhu, Fengyun Rao, Bernt Schiele, Xu Yang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05132 2025-03-24 cs.CV cs.AI cs.CL cs.LG cs.RO

3D-GRAND: A Million-Scale Dataset for 3D-LLMs with Better Grounding and Less Hallucination

Jianing Yang, Xuweiyi Chen, Nikhil Madaan, Madhavan Iyengar, Shengyi Qian, David F. Fouhey, Joyce Chai

Comments CVPR 2025. Project website: https://3d-grand.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09974 2025-03-24 cs.CV cs.AI cs.CL cs.LG

GET: Unlocking the Multi-modal Potential of CLIP for Generalized Category Discovery

Enguang Wang, Zhimao Peng, Zhengyuan Xie, Fei Yang, Xialei Liu, Ming-Ming Cheng

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16429 2025-03-21 cs.CV

Sonata: Self-Supervised Learning of Reliable Point Representations

Xiaoyang Wu, Daniel DeTone, Duncan Frost, Tianwei Shen, Chris Xie, Nan Yang, Jakob Engel, Richard Newcombe, Hengshuang Zhao, Julian Straub

Comments CVPR 2025, produced by Pointcept x Meta, project page: https://xywu.me/sonata/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16406 2025-03-21 cs.GR cs.CV cs.MM

VerbDiff: Text-Only Diffusion Models with Enhanced Interaction Awareness

SeungJu Cha, Kwanyoung Lee, Ye-Chan Kim, Hyunwoo Oh, Dong-Jin Kim

Comments Accepted at CVPR 2025, code : https://github.com/SeungJuCha/VerbDiff.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16266 2025-03-21 cs.CR

From Head to Tail: Efficient Black-box Model Inversion Attack via Long-tailed Learning

Ziang Li, Hongguang Zhang, Juan Wang, Meihui Chen, Hongxin Hu, Wenzhe Yi, Xiaoyang Xu, Mengda Yang, Chenjun Ma

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16134 2025-03-21 cs.CV

Binarized Mamba-Transformer for Lightweight Quad Bayer HybridEVS Demosaicing

Shiyang Zhou, Haijin Zeng, Yunfan Lu, Tong Shao, Ke Tang, Yongyong Chen, Jie Liu, Jingyong Su

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16125 2025-03-21 cs.CV

Uncertainty Meets Diversity: A Comprehensive Active Learning Framework for Indoor 3D Object Detection

Jiangyi Wang, Na Zhao

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16120 2025-03-21 cs.CV

Probabilistic Prompt Distribution Learning for Animal Pose Estimation

Jiyong Rao, Brian Nlong Zhao, Yu Wang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏