arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

共收录 11877
2503.18244 2025-03-25 cs.CV

CustomKD: Customizing Large Vision Foundation for Edge Model Improvement via Knowledge Distillation

Jungsoo Lee, Debasmit Das, Munawar Hayat, Sungha Choi, Kyuwoong Hwang, Fatih Porikli

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18134 2025-03-25 cs.CV

An Image-like Diffusion Method for Human-Object Interaction Detection

Xiaofei Hui, Haoxuan Qu, Hossein Rahmani, Jun Liu

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18123 2025-03-25 cs.CV

End-to-End Implicit Neural Representations for Classification

Alexander Gielisse, Jan van Gemert

Comments Accepted to CVPR 2025. 8 pages, supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18107 2025-03-25 cs.CV

PanoGS: Gaussian-based Panoptic Segmentation for 3D Open Vocabulary Scene Understanding

Hongjia Zhai, Hai Li, Zhenzhe Li, Xiaokun Pan, Yijia He, Guofeng Zhang

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18055 2025-03-25 cs.CV

PolarFree: Polarization-based Reflection-free Imaging

Mingde Yao, Menglu Wang, King-Man Tam, Lingen Li, Tianfan Xue, Jinwei Gu

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17984 2025-03-25 cs.CV cs.AI

Taste More, Taste Better: Diverse Data and Strong Model Boost Semi-Supervised Crowd Counting

Maochen Yang, Zekun Li, Jian Zhang, Lei Qi, Yinghuan Shi

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17928 2025-03-25 cs.CV cs.CL

Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization

Zefeng Zhang, Hengzhu Tang, Jiawei Sheng, Zhenyu Zhang, Yiming Ren, Zhenyang Li, Dawei Yin, Duohe Ma, Tingwen Liu

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17814 2025-03-25 cs.CV

LightLoc: Learning Outdoor LiDAR Localization at Light Speed

Wen Li, Chen Liu, Shangshu Yu, Dunqiang Liu, Yin Zhou, Siqi Shen, Chenglu Wen, Cheng Wang

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17752 2025-03-25 cs.CV

HiLoTs: High-Low Temporal Sensitive Representation Learning for Semi-Supervised LiDAR Segmentation in Autonomous Driving

R. D. Lin, Pengcheng Weng, Yinqiao Wang, Han Ding, Jinsong Han, Fei Wang

Comments accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17731 2025-03-25 cs.CV

Co-op: Correspondence-based Novel Object Pose Estimation

Sungphill Moon, Hyeontae Son, Dongcheol Hur, Sangwook Kim

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17709 2025-03-25 cs.CV cs.AI

GUI-Xplore: Empowering Generalizable GUI Agents with One Exploration

Yuchen Sun, Shanhui Zhao, Tao Yu, Hao Wen, Samith Va, Mengwei Xu, Yuanchun Li, Chongyang Zhang

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17677 2025-03-25 cs.LG

Reducing Class-wise Confusion for Incremental Learning with Disentangled Manifolds

Huitong Chen, Yu Wang, Yan Fan, Guosong Jiang, Qinghua Hu

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17675 2025-03-25 cs.CV

Towards Transformer-Based Aligned Generation with Self-Coherence Guidance

Shulei Wang, Wang Lin, Hai Huang, Hanting Wang, Sihang Cai, WenKang Han, Tao Jin, Jingyuan Chen, Jiacheng Sun, Jieming Zhu, Zhou Zhao

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17673 2025-03-25 cs.CV

DCEvo: Discriminative Cross-Dimensional Evolutionary Learning for Infrared and Visible Image Fusion

Jinyuan Liu, Bowei Zhang, Qingyun Mei, Xingyuan Li, Yang Zou, Zhiying Jiang, Long Ma, Risheng Liu, Xin Fan

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15686 2025-03-25 cs.CV

Multi-focal Conditioned Latent Diffusion for Person Image Synthesis

Jiaqi Liu, Jichao Zhang, Paolo Rota, Nicu Sebe

Comments CVPR 2025 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15406 2025-03-25 cs.CV

Visual Persona: Foundation Model for Full-Body Human Customization

Jisu Nam, Soowon Son, Zhan Xu, Jing Shi, Difan Liu, Feng Liu, Aashish Misraa, Seungryong Kim, Yang Zhou

Comments CVPR 2025, Project page is available at https://cvlab-kaist.github.io/Visual-Persona

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13443 2025-03-25 cs.CV cs.MM

DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models

Haoyang Li, Liang Wang, Chao Wang, Jing Jiang, Yan Peng, Guodong Long

Comments Accepted by the IEEE/CVF Conference on Computer Vision and Pattern Recognition 2025 (CVPR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06960 2025-03-25 cs.CV cs.RO

A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning

Xin Wen, Bingchen Zhao, Yilun Chen, Jiangmiao Pang, Xiaojuan Qi

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04565 2025-03-25 cs.CV cs.RO eess.IV

Omnidirectional Multi-Object Tracking

Kai Luo, Hao Shi, Sheng Wu, Fei Teng, Mengfei Duan, Chang Huang, Yuhang Wang, Kaiwei Wang, Kailun Yang

Comments Accepted to CVPR 2025. The established dataset and source code are available at https://github.com/xifen523/OmniTrack

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00861 2025-03-25 cs.CV

Zero-Shot Head Swapping in Real-World Scenarios

Taewoong Kang, Sohyun Jeong, Hyojin Jang, Jaegul Choo

Comments CVPR'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20732 2025-03-25 cs.CV

CADDreamer: CAD Object Generation from Single-view Images

Yuan Li, Cheng Lin, Yuan Liu, Xiaoxiao Long, Chenxu Zhang, Ningna Wang, Xin Li, Wenping Wang, Xiaohu Guo

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14454 2025-03-25 cs.CV

Exploiting Deblurring Networks for Radiance Fields

Haeyun Choi, Heemin Yang, Janghyeok Han, Sunghyun Cho

Comments Accepted to CVPR 2025. Project page: https://haeyun-choi.github.io/DDRF_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10674 2025-03-25 cs.CV

Occlusion-aware Text-Image-Point Cloud Pretraining for Open-World 3D Object Recognition

Khanh Nguyen, Ghulam Mubashar Hassan, Ajmal Mian

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18590 2025-03-25 cs.CV cs.GR

DiffusionRenderer: Neural Inverse and Forward Rendering with Video Diffusion Models

Ruofan Liang, Zan Gojcic, Huan Ling, Jacob Munkberg, Jon Hasselgren, Zhi-Hao Lin, Jun Gao, Alexander Keller, Nandita Vijaykumar, Sanja Fidler, Zian Wang

Comments CVPR 2025; project page: research.nvidia.com/labs/toronto-ai/DiffusionRenderer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08326 2025-03-25 cs.CV

Omni-RGPT: Unifying Image and Video Region-level Understanding via Token Marks

Miran Heo, Min-Hung Chen, De-An Huang, Sifei Liu, Subhashree Radhakrishnan, Seon Joo Kim, Yu-Chiang Frank Wang, Ryo Hachiuma

Comments CVPR 2025, Project page: https://miranheo.github.io/omni-rgpt/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18219 2025-03-25 cs.CV

Adapter Merging with Centroid Prototype Mapping for Scalable Class-Incremental Learning

Takuma Fukuda, Hiroshi Kera, Kazuhiko Kawamoto

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16153 2025-03-25 cs.CV cs.AI

MotiF: Making Text Count in Image Animation with Motion Focal Loss

Shijie Wang, Samaneh Azadi, Rohit Girdhar, Saketh Rambhatla, Chen Sun, Xi Yin

Comments Accepted by CVPR 2025. Project page: https://wang-sj16.github.io/motif/

Journal ref The IEEE/CVF Conference on Computer Vision and Pattern Recognition 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15867 2025-03-25 cs.CV

IRGS: Inter-Reflective Gaussian Splatting with 2D Gaussian Ray Tracing

Chun Gu, Xiaofei Wei, Zixuan Zeng, Yuxuan Yao, Li Zhang

Comments CVPR 2025. Project page: https://fudan-zvg.github.io/IRGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15213 2025-03-25 cs.CV

Flowing from Words to Pixels: A Noise-Free Framework for Cross-Modality Evolution

Qihao Liu, Xi Yin, Alan Yuille, Andrew Brown, Mannat Singh

Comments CVPR 2025 camera-ready version. Project page: https://cross-flow.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11457 2025-03-25 cs.CV

MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes

Ruijie Lu, Yixin Chen, Junfeng Ni, Baoxiong Jia, Yu Liu, Diwen Wan, Gang Zeng, Siyuan Huang

Comments Accepted by CVPR 2025. Project page: https://jason-aplp.github.io/MOVIS/

详情

展开后加载摘要…

URL PDF HTML 收藏