arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

共收录 11877
2411.11223 2025-03-19 cs.CV

Efficient Transfer Learning for Video-language Foundation Models

Haoxing Chen, Zizheng Huang, Yan Hong, Yanshuo Wang, Zhongcai Lyu, Zhuoer Xu, Jun Lan, Zhangxuan Gu

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04746 2025-03-19 cs.CV cs.AI cs.CL cs.LG

PQPP: A Joint Benchmark for Text-to-Image Prompt and Query Performance Prediction

Eduard Poesina, Adriana Valentina Costache, Adrian-Gabriel Chifu, Josiane Mothe, Radu Tudor Ionescu

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12977 2025-03-19 cs.CV cs.GR

IRIS: Inverse Rendering of Indoor Scenes from Low Dynamic Range Images

Chih-Hao Lin, Jia-Bin Huang, Zhengqin Li, Zhao Dong, Christian Richardt, Tuotuo Li, Michael Zollhöfer, Johannes Kopf, Shenlong Wang, Changil Kim

Comments CVPR 2025 Project Website: https://irisldr.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13446 2025-03-18 cs.RO cs.CV

MoManipVLA: Transferring Vision-language-action Models for General Mobile Manipulation

Zhenyu Wu, Yuheng Zhou, Xiuwei Xu, Ziwei Wang, Haibin Yan

Comments Accepted to CVPR 2025. Project Page: https://gary3410.github.io/momanipVLA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13399 2025-03-18 cs.CV cs.AI cs.CL cs.LG q-bio.CB

MicroVQA: A Multimodal Reasoning Benchmark for Microscopy-Based Scientific Research

James Burgess, Jeffrey J Nirschl, Laura Bravo-Sánchez, Alejandro Lozano, Sanket Rajan Gupte, Jesus G. Galaz-Montoya, Yuhui Zhang, Yuchang Su, Disha Bhowmik, Zachary Coman, Sarina M. Hasan, Alexandra Johannesson, William D. Leineweber, Malvika G Nair, Ridhi Yarlagadda, Connor Zuraski, Wah Chiu, Sarah Cohen, Jan N. Hansen, Manuel D Leonetti, Chad Liu, Emma Lundberg, Serena Yeung-Levy

Comments CVPR 2025 (Conference on Computer Vision and Pattern Recognition) Project page at https://jmhb0.github.io/microvqa Benchmark at https://huggingface.co/datasets/jmhb/microvqa

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13227 2025-03-18 cs.LG cs.CV

Mind the Gap: Confidence Discrepancy Can Guide Federated Semi-Supervised Learning Across Pseudo-Mismatch

Yijie Liu, Xinyi Shang, Yiqun Zhang, Yang Lu, Chen Gong, Jing-Hao Xue, Hanzi Wang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13817 2025-03-18 cs.CV

Nullu: Mitigating Object Hallucinations in Large Vision-Language Models via HalluSpace Projection

Le Yang, Ziwei Zheng, Boxu Chen, Zhengyu Zhao, Chenhao Lin, Chao Shen

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19895 2025-03-18 cs.CV cs.CR

GuardSplat: Efficient and Robust Watermarking for 3D Gaussian Splatting

Zixuan Chen, Guangcong Wang, Jiahao Zhu, Jianhuang Lai, Xiaohua Xie

Comments This paper is accepted by the IEEE/CVF International Conference on Computer Vision and Pattern Recognition (CVPR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17698 2025-03-18 cs.CV cs.MM cs.SD eess.AS

Video-Guided Foley Sound Generation with Multimodal Controls

Ziyang Chen, Prem Seetharaman, Bryan Russell, Oriol Nieto, David Bourgin, Andrew Owens, Justin Salamon

Comments Accepted at CVPR 2025. Project site: https://ificl.github.io/MultiFoley/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16738 2025-03-18 cs.CV cs.AI cs.LG

Classifier-Free Guidance inside the Attraction Basin May Cause Memorization

Anubhav Jain, Yuya Kobayashi, Takashi Shibuya, Yuhta Takida, Nasir Memon, Julian Togelius, Yuki Mitsufuji

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13165 2025-03-18 cs.CV

From Zero to Detail: Deconstructing Ultra-High-Definition Image Restoration from Progressive Spectral Perspective

Chen Zhao, Zhizhou Chen, Yunzhe Xu, Enxuan Gu, Jian Li, Zili Yi, Qian Wang, Jian Yang, Ying Tai

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13130 2025-03-18 cs.CV

ChainHOI: Joint-based Kinematic Chain Modeling for Human-Object Interaction Generation

Ling-An Zeng, Guohong Huang, Yi-Lin Wei, Shengbo Gu, Yu-Ming Tang, Jingke Meng, Wei-Shi Zheng

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13016 2025-03-18 cs.CV

Efficient Motion-Aware Video MLLM

Zijia Zhao, Yuqi Huo, Tongtian Yue, Longteng Guo, Haoyu Lu, Bingning Wang, Weipeng Chen, Jing Liu

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12866 2025-03-18 cs.CV

SCAP: Transductive Test-Time Adaptation via Supportive Clique-based Attribute Prompting

Chenyu Zhang, Kunlun Xu, Zichen Liu, Yuxin Peng, Jiahuan Zhou

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12855 2025-03-18 cs.CV cs.AI cs.CL

VITED: Video Temporal Evidence Distillation

Yujie Lu, Yale Song, William Wang, Lorenzo Torresani, Tushar Nagarajan

Journal ref CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12745 2025-03-18 cs.CV

ProtoDepth: Unsupervised Continual Depth Completion with Prototypes

Patrick Rim, Hyoungseob Park, S. Gangopadhyay, Ziyao Zeng, Younjoon Chung, Alex Wong

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12617 2025-03-18 cs.CV cs.AI cs.LG

Scaling Semantic Categories: Investigating the Impact on Vision Transformer Labeling Performance

Anthony Lamelas, Harrison Muchnic

Comments 4 pages, 7 figures, submitted to CVPR (feedback pending)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12242 2025-03-18 cs.CV

RePerformer: Immersive Human-centric Volumetric Videos from Playback to Photoreal Reperformance

Yuheng Jiang, Zhehao Shen, Chengcheng Guo, Yu Hong, Zhuo Su, Yingliang Zhang, Marc Habermann, Lan Xu

Comments Accepted by CVPR 2025. Project Page: https://moqiyinlun.github.io/Reperformer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12168 2025-03-18 cs.CV

Learning Extremely High Density Crowds as Active Matters

Feixiang He, Jiangbei Yue, Jialin Zhu, Armin Seyfried, Dan Casas, Julien Pettré, He Wang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12127 2025-03-18 cs.CV cs.AI cs.CL cs.MM

Hyperbolic Safety-Aware Vision-Language Models

Tobia Poppi, Tejaswi Kasarla, Pascal Mettes, Lorenzo Baraldi, Rita Cucchiara

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12096 2025-03-18 cs.CV

O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models

Ashshak Sharifdeen, Muhammad Akhtar Munir, Sanoojan Baliah, Salman Khan, Muhammad Haris Khan

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12077 2025-03-18 cs.CV cs.AI

V-Stylist: Video Stylization via Collaboration and Reflection of MLLM Agents

Zhengrong Yue, Shaobin Zhuang, Kunchang Li, Yanbo Ding, Yali Wang

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12053 2025-03-18 cs.LG cs.AI

Ferret: An Efficient Online Continual Learning Framework under Varying Memory Constraints

Yuhao Zhou, Yuxin Tian, Jindi Lv, Mingjia Shi, Yuanxi Li, Qing Ye, Shuhao Zhang, Jiancheng Lv

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12006 2025-03-18 cs.CV

ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object

Zhe Shan, Yang Liu, Lei Zhou, Cheng Yan, Heng Wang, Xia Xie

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11071 2025-03-18 cs.CV

Harnessing Frequency Spectrum Insights for Image Copyright Protection Against Diffusion Models

Zhenguang Liu, Chao Shuai, Shaojing Fan, Ziping Dong, Jinwu Hu, Zhongjie Ba, Kui Ren

Comments Received by CVPR 2025 (10 pages, 11 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09248 2025-03-18 cs.CV

Bayesian Test-Time Adaptation for Vision-Language Models

Lihua Zhou, Mao Ye, Shuaifeng Li, Nianxin Li, Xiatian Zhu, Lei Deng, Hongbin Liu, Zhen Lei

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08257 2025-03-18 cs.CV cs.AI cs.RO

DexGrasp Anything: Towards Universal Robotic Dexterous Grasping with Physics Awareness

Yiming Zhong, Qi Jiang, Jingyi Yu, Yuexin Ma

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08121 2025-03-18 cs.CV

AG-VPReID: A Challenging Large-Scale Benchmark for Aerial-Ground Video-based Person Re-Identification

Huy Nguyen, Kien Nguyen, Akila Pemasiri, Feng Liu, Sridha Sridharan, Clinton Fookes

Comments Accepted at Computer Vision and Pattern Recognition Conference (CVPR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08043 2025-03-18 cs.CV

Structural and Statistical Texture Knowledge Distillation and Learning for Segmentation

Deyi Ji, Feng Zhao, Hongtao Lu, Feng Wu, Jieping Ye

Comments Accepted to TPAMI 2025. CVPR 2022 Version: arXiv:2305.03944. arXiv admin note: text overlap with arXiv:2305.03944

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06277 2025-03-18 cs.CV

STiL: Semi-supervised Tabular-Image Learning for Comprehensive Task-Relevant Information Exploration in Multimodal Classification

Siyi Du, Xinzhe Luo, Declan P. O'Regan, Chen Qin

Comments 16 pages (including 5 pages of supplementary materials), accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏