arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Computer Vision · 会议 · Computer Vision

共收录 4772
2506.18527 2025-07-15 cs.CV

Auto-Regressively Generating Multi-View Consistent Images

JiaKui Hu, Yuxiao Yang, Jialun Liu, Jinbo Wu, Chen Zhao, Yanye Lu

机构 * Institute of Medical Technology, Peking University Health Science Center, Peking University(北京大学医学部医学技术研究所) Baidu VIS(百度VIS) Biomedical Engineering Department, College of Future Technology, Peking University(未来技术学院生物医学工程系) National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心) Tsinghua University(清华大学)

Comments Accepted by ICCV 2025. Code is at https://github.com/MILab-PKU/MVAR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12720 2025-07-15 cs.CV

Towards Open-World Generation of Stereo Images and Unsupervised Matching

Feng Qiao, Zhexiao Xiong, Eric Xing, Nathan Jacobs

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10701 2025-07-15 cs.CV cs.RO

Video Individual Counting for Moving Drones

Yaowu Fan, Jia Wan, Tao Han, Antoni B. Chan, Andy J. Ma

机构 * Sun Yat-sen University(中山大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Hong Kong University of Science and Technology(香港科学大学) City University of Hong Kong(香港城市大学)

Comments This work has been accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06471 2025-07-15 cs.CV

Online Dense Point Tracking with Streaming Memory

Qiaole Dong, Yanwei Fu

机构 * School of Data Science, Fudan University(数据科学学院,复旦大学)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10059 2025-07-15 cs.CV

RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control

Teng Li, Guangcong Zheng, Rui Jiang, Shuigen Zhan, Tao Wu, Yehao Lu, Yining Lin, Chuanyun Deng, Yepan Xiong, Min Chen, Lin Cheng, Xi Li

机构 * College of Computer Science & Technology, Zhejiang University(浙江大学计算机科学与技术学院) Central Media Technology Institute, 2012 Lab, Huawei(华为2012实验室)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05242 2025-07-15 cs.CV

SEGS-SLAM: Structure-enhanced 3D Gaussian Splatting SLAM with Appearance Embedding

Tianci Wen, Zhiang Liu, Yongchun Fang

机构 * IRAIS, tjKLIR, College of Artificial Intelligence, Nankai University(IRAIS、tjKLIR、人工智能学院、南开大学) IITRS, Shenzhen Research Institute, Nankai University(IITRS、深圳研究所、南开大学)

Comments ICCV 2025 accept;code, video, demos, and project are available at Project page https://segs-slam.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14379 2025-07-15 cs.CV

HA-RDet: Hybrid Anchor Rotation Detector for Oriented Object Detection

Phuc D. A. Nguyen

机构 * University of Information Technology(信息科技大学)

Comments Bachelor thesis, Accepted to ICCV'25 SEA

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16313 2025-07-15 cs.AI cs.LG

CATP-LLM: Empowering Large Language Models for Cost-Aware Tool Planning

Duo Wu, Jinghe Wang, Yuan Meng, Yanning Zhang, Le Sun, Zhi Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Department of Computer Science, Tsinghua University(清华大学计算机系)

Comments Accepted to ICCV 2025. Codes and dataset are available at: https://github.com/duowuyms/OpenCATP-LLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08626 2025-07-14 cs.SD eess.AS

Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection

Davide Salvi, Viola Negroni, Sara Mandelli, Paolo Bestagini, Stefano Tubaro

Comments Accepted at ICCV Workshop - Authenticity & Provenance in the age of Generative AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11992 2025-07-14 cs.CV

SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations

Songchun Zhang, Huiyao Xu, Sitong Guo, Zhongwei Xie, Hujun Bao, Weiwei Xu, Changqing Zou

机构 * ZJU(浙江大学) HKUST(香港科技大学) Zhejiang Lab(浙江实验室)

Comments Accepted by ICCV 2025. 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20287 2025-07-14 cs.CV

InsViE-1M: Effective Instruction-based Video Editing with Elaborate Dataset Construction

Yuhui Wu, Liyi Chen, Ruibin Li, Shihao Wang, Chenxi Xie, Lei Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学) OPPO Research Institute(OPPO研究院)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17414 2025-07-14 cs.CV

X-Dancer: Expressive Music to Human Dance Video Generation

Zeyuan Chen, Hongyi Xu, Guoxian Song, You Xie, Chenxu Zhang, Xin Chen, Chao Wang, Di Chang, Linjie Luo

机构 * UC San Diego(圣迭戈大学) ByteDance(字节跳动) University of Southern California(南加州大学)

Comments ICCV 2025. Project Page: https://zeyuan-chen.com/X-Dancer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08555 2025-07-14 cs.CV

Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion

Enyu Liu, En Yu, Sijia Chen, Wenbing Tao

机构 * Huazhong University of Science and Technology(华中科技大学)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08380 2025-07-14 cs.CV

From Enhancement to Understanding: Build a Generalized Bridge for Low-light Vision via Semantically Consistent Unsupervised Fine-tuning

Sen Wang, Shao Zeng, Tianjun Gu, Zhizhong Zhang, Ruixin Zhang, Shouhong Ding, Jingyun Zhang, Jun Wang, Xin Tan, Yuan Xie, Lizhuang Ma

机构 * East China Normal University(东华师范大学) Tencent Youtu Lab(腾讯云视频实验室) Tencent WeChat Pay Lab(腾讯微信支付实验室)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08044 2025-07-14 cs.CV cs.AI

ConsNoTrainLoRA: Data-driven Weight Initialization of Low-rank Adapters using Constraints

Debasmit Das, Hyoungwoo Park, Munawar Hayat, Seokeon Choi, Sungrack Yun, Fatih Porikli

机构 * Qualcomm AI Research(高通人工智能研究)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08525 2025-07-14 cs.CV cs.AI

GTR: Guided Thought Reinforcement Prevents Thought Collapse in RL-based VLM Agent Training

Tong Wei, Yijun Yang, Junliang Xing, Yuanchun Shi, Zongqing Lu, Deheng Ye

机构 * Tsinghua University(清华大学) Tencent(腾讯) Peking University(北京大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09626 2025-07-14 cs.CV

FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion

Haonan Qiu, Shiwei Zhang, Yujie Wei, Ruihang Chu, Hangjie Yuan, Xiang Wang, Yingya Zhang, Ziwei Liu

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学)

Comments ICCV 2025, Project Page: http://haonanqiu.com/projects/FreeScale.html, Code Repo: https://github.com/ali-vilab/FreeScale

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00136 2025-07-14 cs.CV cs.AI cs.LG

FonTS: Text Rendering with Typography and Style Controls

Wenda Shi, Yiren Song, Dengming Zhang, Jiaming Liu, Xingxing Zou

机构 * The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) Zhejiang University(浙江大学) Tiamat AI

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10715 2025-07-14 cs.CV

EVT: Efficient View Transformation for Multi-Modal 3D Object Detection

Yongjin Lee, Hyeon-Mun Jeong, Yurim Jeon, Sanghyun Kim

机构 * ThorDrive Co., Ltd(ThorDrive公司) Seoul National University(首尔国立大学)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24204 2025-07-14 cs.CV

GeoSplatting: Towards Geometry Guided Gaussian Splatting for Physically-based Inverse Rendering

Kai Ye, Chong Gao, Guanbin Li, Wenzheng Chen, Baoquan Chen

机构 * School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) State Key Laboratory of Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07483 2025-07-11 cs.CV cs.CR

Temporal Unlearnable Examples: Preventing Personal Video Data from Unauthorized Exploitation by Object Tracking

Qiangqiang Wu, Yi Yu, Chenqi Kong, Ziquan Liu, Jia Wan, Haoliang Li, Alex C. Kot, Antoni B. Chan

机构 * City University of Hong Kong(香港城市大学) ROSE Lab, Nanyang Technological University(南洋理工大学ROSE实验室) Queen Mary University of London(伦敦大学玛丽女王学院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07424 2025-07-11 cs.CV

Corvid: Improving Multimodal Large Language Models Towards Chain-of-Thought Reasoning

Jingjing Jiang, Chao Ma, Xurui Song, Hanwang Zhang, Jun Luo

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02398 2025-07-11 cs.CV cs.AI

Beyond Spatial Frequency: Pixel-wise Temporal Frequency-based Deepfake Video Detection

Taehoon Kim, Jongwook Choi, Yonghyun Jeong, Haeun Noh, Jaejun Yoo, Seungryul Baek, Jongwon Choi

机构 * GS. of AI, Chung-Ang Univ, Korea(人工智能研究生院, Chung-Ang 大学,韩国) Dept. of Advanced Imaging, Chung-Ang Univ, Korea(先进成像系, Chung-Ang 大学,韩国) NAVER Cloud, Korea(NAVER 云,韩国) AI Graduate School, UNIST, Korea(人工智能研究生院, UNIST,韩国)

Comments accepted by iccv 2025. code is will be available at https://github.com/rama0126/PwTF-DVD

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21513 2025-07-11 cs.CV

GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation

Wentao Hu, Shunkai Li, Ziqiao Peng, Haoxian Zhang, Fan Shi, Xiaoqiang Liu, Pengfei Wan, Di Zhang, Hui Tian

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Kuaishou Technology(快手科技) Renmin University of China(中国人民大学)

Comments ICCV 2025, Project page: https://vincenthu19.github.io/GGTalker/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10252 2025-07-11 cs.CV

SVIP: Semantically Contextualized Visual Patches for Zero-Shot Learning

Zhi Chen, Zecheng Zhao, Jingcai Guo, Jingjing Li, Zi Huang

机构 * University of Southern Queensland(南昆士兰大学) University of Queensland(昆士兰大学) The Hong Kong Polytechnic University(香港理工大学) University of Electronic Science and Technology of China(中国电子科学技术研究中心)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07374 2025-07-11 cs.CV

PacGDC: Label-Efficient Generalizable Depth Completion with Projection Ambiguity and Consistency

Haotian Wang, Aoran Xiao, Xiaoqin Zhang, Meng Yang, Shijian Lu

机构 * Xi’an Jiaotong University(西安交通大学) Nanyang Technological University(南洋理工大学) Zhejiang University of Technology(浙江工业大学)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07262 2025-07-11 cs.CV

DisenQ: Disentangling Q-Former for Activity-Biometrics

Shehreen Azad, Yogesh S Rawat

机构 * Center for Research in Computer Vision(计算机视觉研究中心) University of Central Florida(中央佛罗里达大学)

Comments Accepted in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07230 2025-07-11 cs.CV

Colors See Colors Ignore: Clothes Changing ReID with Color Disentanglement

Priyank Pathak, Yogesh S. Rawat

机构 * Center for Research in Computer Vision, University of Central Florida(计算机视觉研究中心,中央佛罗里达大学)

Comments ICCV'25 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06856 2025-07-10 cs.CV cs.AI

IAP: Invisible Adversarial Patch Attack through Perceptibility-Aware Localization and Perturbation Optimization

Subrat Kishore Dutta, Xiao Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全研究中心)

Comments Published in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06651 2025-07-10 cs.CV

Diff$^2$I2P: Differentiable Image-to-Point Cloud Registration with Diffusion Prior

Juncheng Mu, Chengwei Ren, Weixiang Zhang, Liang Pan, Xiao-Ping Zhang, Yue Gao

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏