arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

共收录 11877
2406.12718 2025-03-17 cs.CV cs.AI cs.CL

Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention

Wenbin An, Feng Tian, Sicong Leng, Jiahao Nie, Haonan Lin, QianYing Wang, Ping Chen, Xiaoqin Zhang, Shijian Lu

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19209 2025-03-17 cs.CV cs.AI cs.CL

VideoTree: Adaptive Tree-based Video Representation for LLM Reasoning on Long Videos

Ziyang Wang, Shoubin Yu, Elias Stengel-Eskin, Jaehong Yoon, Feng Cheng, Gedas Bertasius, Mohit Bansal

Comments CVPR 2025; First three authors contributed equally; Project page: https://videotree2024.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17064 2025-03-17 cs.CV cs.AI cs.LG

Continuous, Subject-Specific Attribute Control in T2I Models by Identifying Semantic Directions

Stefan Andreas Baumann, Felix Krause, Michael Neumayr, Nick Stracke, Melvin Sevi, Vincent Tao Hu, Björn Ommer

Comments CVPR 2025. Project page: https://compvis.github.io/attribute-control

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10526 2025-03-14 cs.CV

NeighborRetr: Balancing Hub Centrality in Cross-Modal Retrieval

Zengrong Lin, Zheng Wang, Tianwen Qian, Pan Mu, Sixian Chan, Cong Bai

Comments Accepted at CVPR 2025, 18 pages, 7 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10399 2025-03-14 cs.CV

HSEmotion Team at ABAW-8 Competition: Audiovisual Ambivalence/Hesitancy, Emotional Mimicry Intensity and Facial Expression Recognition

Andrey V. Savchenko

Comments submitted to ABAW CVPR 2025 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10358 2025-03-14 cs.CV cs.LG

ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation

Zirun Guo, Tao Jin

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09590 2025-03-14 cs.CV

BIMBA: Selective-Scan Compression for Long-Range Video Question Answering

Md Mohaiminul Islam, Tushar Nagarajan, Huiyu Wang, Gedas Bertasius, Lorenzo Torresani

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09013 2025-03-14 cs.CV

Arbitrary-steps Image Super-resolution via Diffusion Inversion

Zongsheng Yue, Kang Liao, Chen Change Loy

Comments Accepted by CVPR 2025. Project: https://github.com/zsyOAOA/InvSR

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18466 2025-03-14 cs.CV

Complexity Experts are Task-Discriminative Learners for Any Image Restoration

Eduard Zamfir, Zongwei Wu, Nancy Mehta, Yuedong Tan, Danda Pani Paudel, Yulun Zhang, Radu Timofte

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06214 2025-03-14 cs.CV cs.AI

Towards Generalizable Scene Change Detection

Jaewoo Kim, Uehwan Kim

Comments Camera-ready version. Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10149 2025-03-14 cs.CV

Unlocking Generalization Power in LiDAR Point Cloud Registration

Zhenxuan Zeng, Qiao Wu, Xiyu Zhang, Lin Yuanbo Wu, Pei An, Jiaqi Yang, Ji Wang, Peng Wang

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10143 2025-03-14 cs.CV

GaussHDR: High Dynamic Range Gaussian Splatting via Learning Unified 3D and 2D Local Tone Mapping

Jinfeng Liu, Lingtong Kong, Bo Li, Dan Xu

Comments This paper is accepted by CVPR 2025. Project page is available at https://liujf1226.github.io/GaussHDR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10065 2025-03-14 cs.LG cs.CV

Do We Always Need the Simplicity Bias? Looking for Optimal Inductive Biases in the Wild

Damien Teney, Liangze Jiang, Florin Gogianu, Ehsan Abbasnejad

Comments IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10000 2025-03-14 cs.CV eess.IV

MetricGrids: Arbitrary Nonlinear Approximation with Elementary Metric Grids based Implicit Neural Representation

Shu Wang, Yanbo Gao, Shuai Li, Chong Lv, Xun Cai, Chuankun Li, Hui Yuan, Jinglin Zhang

Comments accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09993 2025-03-14 cs.CV

Channel-wise Noise Scheduled Diffusion for Inverse Rendering in Indoor Scenes

JunYong Choi, Min-Cheol Sagong, SeokYeong Lee, Seung-Won Jung, Ig-Jae Kim, Junghyun Cho

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09962 2025-03-14 cs.CV

Modeling Thousands of Human Annotators for Generalizable Text-to-Image Person Re-identification

Jiayu Jiang, Changxing Ding, Wentao Tan, Junhong Wang, Jin Tao, Xiangmin Xu

Comments CVPR 2025. Project website: https://github.com/sssaury/HAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09950 2025-03-14 cs.CV cs.AI cs.LG

MoFlow: One-Step Flow Matching for Human Trajectory Forecasting via Implicit Maximum Likelihood Estimation based Distillation

Yuxiang Fu, Qi Yan, Lele Wang, Ke Li, Renjie Liao

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09669 2025-03-14 cs.CV cs.AI cs.CR

Silent Branding Attack: Trigger-free Data Poisoning Attack on Text-to-Image Diffusion Models

Sangwon Jang, June Suk Choi, Jaehyeong Jo, Kimin Lee, Sung Ju Hwang

Comments CVPR 2025. Project page: https://silent-branding.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00746 2025-03-14 cs.CV

DoF-Gaussian: Controllable Depth-of-Field for 3D Gaussian Splatting

Liao Shen, Tianqi Liu, Huiqiang Sun, Jiaqi Li, Zhiguo Cao, Wei Li, Chen Change Loy

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07589 2025-03-14 cs.CV

DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation

Jianzong Wu, Chao Tang, Jingbo Wang, Yanhong Zeng, Xiangtai Li, Yunhai Tong

Comments [CVPR 2025] The project page is https://jianzongwu.github.io/projects/diffsensei/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08202 2025-03-14 cs.CV cs.CL

Mono-InternVL: Pushing the Boundaries of Monolithic Multimodal Large Language Models with Endogenous Visual Pre-training

Gen Luo, Xue Yang, Wenhan Dou, Zhaokai Wang, Jiawen Liu, Jifeng Dai, Yu Qiao, Xizhou Zhu

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03346 2025-03-14 cs.CV

Enhancing Vision-Language Pre-training with Rich Supervisions

Yuan Gao, Kunyu Shi, Pengkai Zhu, Edouard Belval, Oren Nuriel, Srikar Appalaraju, Shabnam Ghadar, Vijay Mahadevan, Zhuowen Tu, Stefano Soatto

Comments Accepted to CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02249 2025-03-14 cs.CV cs.AI

Non-autoregressive Sequence-to-Sequence Vision-Language Models

Kunyu Shi, Qi Dong, Luis Goncalves, Zhuowen Tu, Stefano Soatto

Comments Accepted to CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12736 2025-03-14 cs.CV

$ShiftwiseConv:$ Small Convolutional Kernel with Large Kernel Effect

Dachong Li, Li Li, Zhuangzhuang Chen, Jianqiang Li

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09594 2025-03-13 cs.CV cs.RO

SimLingo: Vision-Only Closed-Loop Autonomous Driving with Language-Action Alignment

Katrin Renz, Long Chen, Elahe Arani, Oleg Sinavski

Comments CVPR 2025. 1st Place @ CARLA Challenge 2024. Challenge tech report (preliminary version of SimLingo): arXiv:2406.10165

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09556 2025-03-13 cs.CV

Electromyography-Informed Facial Expression Reconstruction for Physiological-Based Synthesis and Analysis

Tim Büchner, Christoph Anders, Orlando Guntinas-Lichius, Joachim Denzler

Comments Accepted at CVPR 2025, 41 pages, 37 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09491 2025-03-13 cs.CV eess.IV

DAMM-Diffusion: Learning Divergence-Aware Multi-Modal Diffusion Model for Nanoparticles Distribution Prediction

Junjie Zhou, Shouju Wang, Yuxia Tang, Qi Zhu, Daoqiang Zhang, Wei Shao

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09122 2025-03-13 cs.CV

Training Data Provenance Verification: Did Your Model Use Synthetic Data from My Generative Model for Training?

Yuechen Xie, Jie Song, Huiqiong Wang, Mingli Song

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20256 2025-03-13 cs.CV

Do computer vision foundation models learn the low-level characteristics of the human visual system?

Yancheng Cai, Fei Yin, Dounia Hammou, Rafal Mantiuk

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00071 2025-03-13 cs.LG cs.AI cs.CL cs.CV

COAP: Memory-Efficient Training with Correlation-Aware Gradient Projection

Jinqi Xiao, Shen Sang, Tiancheng Zhi, Jing Liu, Qing Yan, Yuqian Zhang, Linjie Luo, Bo Yuan

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏