arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Computer Vision · 会议 · Computer Vision

共收录 4770
2509.10463 2025-09-16 cs.LG cs.CV

The 1st International Workshop on Disentangled Representation Learning for Controllable Generation (DRL4Real): Methods and Results

Qiuyu Chen, Xin Jin, Yue Song, Xihui Liu, Shuai Yang, Tao Yang, Ziqiang Li, Jianguo Huang, Yuntao Wei, Ba'ao Xie, Nicu Sebe, Wenjun, Zeng, Jooyeol Yun, Davide Abati, Mohamed Omran, Jaegul Choo, Amir Habibian, Auke Wiggers, Masato Kobayashi, Ning Ding, Toru Tamaki, Marzieh Gheisari, Auguste Genovesio, Yuheng Chen, Dingkun Liu, Xinyao Yang, Xinping Xu, Baicheng Chen, Dongrui Wu, Junhao Geng, Lexiang Lv, Jianxin Lin, Hanzhe Liang, Jie Zhou, Xuanxin Chen, Jinbao Wang, Can Gao, Zhangyi Wang, Zongze Li, Bihan Wen, Yixin Gao, Xiaohan Pan, Xin Li, Zhibo Chen, Baorui Peng, Zhongming Chen, Haoran Jin

Comments Workshop summary paper for ICCV 2025, 9 accepted papers, 9 figures, IEEE conference format, covers topics including diffusion models, controllable generation, 3D-aware disentanglement, autonomous driving applications, and EEG analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10441 2025-09-15 cs.CV

InfGen: A Resolution-Agnostic Paradigm for Scalable Image Synthesis

Tao Han, Wanghan Xu, Junchao Gong, Xiaoyu Yue, Song Guo, Luping Zhou, Lei Bai

机构 * Hong Kong University of Science and Technology(香港科技大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of Sydney(悉尼大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07890 2025-09-15 cs.CV

Can Generative Geospatial Diffusion Models Excel as Discriminative Geospatial Foundation Models?

Yuru Jia, Valerio Marsocci, Ziyang Gong, Xue Yang, Maarten Vergauwen, Andrea Nascetti

机构 * KU Leuven(鲁汶大学) KTH(皇家理工学院) European Space Agency(欧洲航天局) Shanghai AI Lab(上海人工智能实验室) SJTU(上海交通大学)

Comments ICCV 2025, camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09584 2025-09-12 cs.CV cs.RO

Visual Grounding from Event Cameras

Lingdong Kong, Dongyue Lu, Ao Liang, Rong Li, Yuhao Dong, Tianshuai Hu, Lai Xing Ng, Wei Tsang Ooi, Benoit R. Cottereau

机构 * NUS(新加坡国立大学) HKUST(GZ)(香港科技大学(广州)) NTU(南洋理工大学) HKUST(香港科技大学) I 2 R, A*STAR(新加坡科技研究局) IPAL, CNRS(法国国家科学研究中心IPAL) CerCo, CNRS(法国国家科学研究中心CerCo)

Comments Abstract Paper (Non-Archival) @ ICCV 2025 NeVi Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05211 2025-09-12 cs.CV

VFlowOpt: A Token Pruning Framework for LMMs with Visual Information Flow-Guided Optimization

Sihan Yang, Runsen Xu, Chenhang Cui, Tai Wang, Dahua Lin, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09190 2025-09-12 cs.CV

VQualA 2025 Challenge on Visual Quality Comparison for Large Multimodal Models: Methods and Results

Hanwei Zhu, Haoning Wu, Zicheng Zhang, Lingyu Zhu, Yixuan Li, Peilin Chen, Shiqi Wang, Chris Wei Zhou, Linhan Cao, Wei Sun, Xiangyang Zhu, Weixia Zhang, Yucheng Zhu, Jing Liu, Dandan Zhu, Guangtao Zhai, Xiongkuo Min, Zhichao Zhang, Xinyue Li, Shubo Xu, Anh Dao, Yifan Li, Hongyuan Yu, Jiaojiao Yi, Yiding Tian, Yupeng Wu, Feiran Sun, Lijuan Liao, Song Jiang

Comments ICCV VQualA Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09183 2025-09-12 cs.CV cs.AI

Dark-ISP: Enhancing RAW Image Processing for Low-Light Object Detection

Jiasheng Guo, Xin Gao, Yuxiang Yan, Guanghao Li, Jian Pu

机构 * Institute of Science and Technology for Brain-inspired Intelligence, Fudan University(脑启发智能科学与技术研究院,复旦大学)

Comments 11 pages, 6 figures, conference

Journal ref ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09143 2025-09-12 cs.CV cs.AI cs.GR

Objectness Similarity: Capturing Object-Level Fidelity in 3D Scene Evaluation

Yuiko Uchida, Ren Togo, Keisuke Maeda, Takahiro Ogawa, Miki Haseyama

机构 * Hokkaido University(北海道大学)

Comments Accepted by the ICCV 2025 UniLight Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08940 2025-09-12 cs.CV

Discovering Divergent Representations between Text-to-Image Models

Lisa Dunlap, Joseph E. Gonzalez, Trevor Darrell, Fabian Caba Heilbron, Josef Sivic, Bryan Russell

Comments Accepted to ICCV 2025. Code available at https://github.com/adobe-research/CompCon

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08829 2025-09-12 cs.CY cs.AI cs.IR

PerFairX: Is There a Balance Between Fairness and Personality in Large Language Model Recommendations?

Chandan Kumar Sah

Comments 10 pages, 5 figures. Accepted to the Workshop on Multimodal Continual Learning (MCL) at ICCV 2025. @2025 IEEE/CVF International Conference on Computer Vision Workshops (ICCVW), ICCV's 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08777 2025-09-11 cs.CV cs.CL

Calibrating MLLM-as-a-judge via Multimodal Bayesian Prompt Ensembles

Eric Slyman, Mehrab Tanjim, Kushal Kafle, Stefan Lee

机构 * Adobe(Adobe公司) Oregon State University(俄勒冈州立大学)

Comments 17 pages, 8 figures, Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08764 2025-09-11 cs.CV

ArgoTweak: Towards Self-Updating HD Maps through Structured Priors

Lena Wild, Rafael Valencia, Patric Jensfelt

机构 * KTH Royal Institute of Technology(皇家理工学院) TRATON

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08621 2025-09-11 cs.CV

AdsQA: Towards Advertisement Video Understanding

Xinwei Long, Kai Tian, Peng Xu, Guoli Jia, Jingxuan Li, Sa Yang, Yihua Shao, Kaiyan Zhang, Che Jiang, Hao Xu, Yang Liu, Jiaheng Ma, Bowen Zhou

机构 * Tsinghua University(清华大学) Peking University(北京大学) CASIA(中国科学院自动化所) Harvard University(哈佛大学) Shanghai Artificial Intelligence Lab(上海人工智能实验室)

Comments ICCV-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08388 2025-09-11 cs.CV cs.AI

Semantic Causality-Aware Vision-Based 3D Occupancy Prediction

Dubing Chen, Huan Zheng, Yucheng Zhou, Xianfei Li, Wenlong Liao, Tao He, Pai Peng, Jianbing Shen

机构 * SKL-IOTSC, CIS, University of Macau(澳门大学SKL-IOTSC研究所、CIS学院) COWAROBOT Co. Ltd.(COWAROBOT公司)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09151 2025-09-11 cs.CV cs.AI

Reangle-A-Video: 4D Video Generation as Video-to-Video Translation

Hyeonho Jeong, Suhyeon Lee, Jong Chul Ye

机构 * KAIST(韩国科学技术院) Adobe Research(Adobe研究)

Comments ICCV 2025, Project page: https://hyeonho99.github.io/reangle-a-video/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01137 2025-09-11 cs.CV

TextSSR: Diffusion-based Data Synthesis for Scene Text Recognition

Xingsong Ye, Yongkun Du, Yunbo Tao, Zhineng Chen

机构 * College of Computer Science and Artificial Intelligence, Fudan University, China(计算机科学与人工智能学院,复旦大学) Institute of Trustworthy Embodied AI, Fudan University, China(可信具身人工智能研究院,复旦大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07725 2025-09-11 cs.CV

ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions

Dubing Chen, Jin Fang, Wencheng Han, Xinjing Cheng, Junbo Yin, Chenzhong Xu, Fahad Shahbaz Khan, Jianbing Shen

机构 * SKL-IOTSC, CIS, University of Macau(澳门大学智能物联网与智能系统中心,计算机科学与信息学院) CEMSE Division, King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹大学科学与技术学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Linköping University(林雪平大学)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21197 2025-09-11 cs.CV

GCAV: A Global Concept Activation Vector Framework for Cross-Layer Consistency in Interpretability

Zhenghao He, Sanchit Sinha, Guangzhi Xiong, Aidong Zhang

机构 * University of Virginia(弗吉尼亚大学)

Comments Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07920 2025-09-10 cs.CV

ScoreHOI: Physically Plausible Reconstruction of Human-Object Interaction via Score-Guided Diffusion

Ao Li, Jinpeng Liu, Yixuan Zhu, Yansong Tang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Tsinghua University(清华大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07917 2025-09-10 cs.CV

Object-level Correlation for Few-Shot Segmentation

Chunlin Wen, Yu Zhang, Jie Fan, Hongyuan Zhu, Xiu-Shen Wei, Yijun Wang, Zhiqiang Kou, Shuzhou Sun

机构 * School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) Samsung Electronics (China) R&D Centre(三星电子(中国)研发中心) Shanghai AI Laboratory(上海人工智能实验室) Institute for Infocomm Research (I2R), A*STAR Singapore(资讯通信研究院(I2R),新加坡A*STAR) Center for Machine Vision and Signal Analysis (CMVS), University of Oulu(图像与信号分析中心(CMVS),奥卢大学)

Comments This paper was accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07879 2025-09-10 cs.CV cs.AI

Active Membership Inference Test (aMINT): Enhancing Model Auditability with Multi-Task Learning

Daniel DeAlcala, Aythami Morales, Julian Fierrez, Gonzalo Mancera, Ruben Tolosana, Javier Ortega-Garcia

机构 * Biometrics and Data Pattern Analytics Lab, Universidad Autonoma de Madrid, Spain(生物度量与数据模式分析实验室,马德里自治大学)

Comments In Proc. IEEE/CVF Intenational Conference on Computer Vision, ICCV, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07647 2025-09-10 cs.CV

Semantic Watermarking Reinvented: Enhancing Robustness and Generation Quality with Fourier Integrity

Sung Ju Lee, Nam Ik Cho

机构 * Dept. of ECE & INMC, Seoul National University, Korea(电子工程系及智能纳米材料中心,首尔国立大学)

Comments Accepted to the IEEE/CVF International Conference on Computer Vision (ICCV) 2025. Project page: https://thomas11809.github.io/SFWMark/ Code: https://github.com/thomas11809/SFWMark

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07472 2025-09-10 cs.CV

ANYPORTAL: Zero-Shot Consistent Video Background Replacement

Wenshuo Gao, Xicheng Lan, Shuai Yang

机构 * Wangxuan Institute of Computer Technology, State Key Laboratory of Multimedia Information Processing, Peking University, Beijing, China(王轩计算机技术研究所,多媒体信息处理国家重点实验室,北京大学,北京)

Comments 8 pages, ICCV 2025, Website: https://gaowenshuo.github.io/AnyPortal/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07456 2025-09-10 cs.CV cs.AI

Bias-Aware Machine Unlearning: Towards Fairer Vision Models via Controllable Forgetting

Sai Siddhartha Chary Aylapuram, Veeraraju Elluru, Shivang Agarwal

机构 * BITS Pilani Dubai Campus(比斯帕尼迪拜校区) IIT Jodhpur(印度理工学院乔德普尔)

Comments Accepted for publication at ICCV 2025 UnMe workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06570 2025-09-10 cs.CV

Evolving from Unknown to Known: Retentive Angular Representation Learning for Incremental Open Set Recognition

Runqing Yang, Yimin Fu, Changyuan Wu, Zhunga Liu

Comments 10 pages, 6 figures, 2025 IEEE/CVF International Conference on Computer Vision Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18463 2025-09-10 cs.CV

DIP: Unsupervised Dense In-Context Post-training of Visual Representations

Sophia Sirko-Galouchenko, Spyros Gidaris, Antonin Vobecky, Andrei Bursuc, Nicolas Thome

机构 * Sorbonne Université, CNRS, ISIR(索邦大学、国家科学研究中心、ISIR) FEE CTU(捷克技术大学电子工程系) CIIRC CTU Prague(捷克技术大学普拉格研究所) Institut universitaire de France (IUF)(法国国家科学院)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16013 2025-09-10 cs.RO cs.CV

GraspCoT: Integrating Physical Property Reasoning for 6-DoF Grasping under Flexible Language Instructions

Xiaomeng Chu, Jiajun Deng, Guoliang You, Wei Liu, Xingchen Li, Jianmin Ji, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) The University of Adelaide(阿德莱德大学)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10781 2025-09-10 cs.CV

Large-scale Pre-training for Grounded Video Caption Generation

Evangelos Kazakos, Cordelia Schmid, Josef Sivic

机构 * Czech Institute of Informatics, Robotics and Cybernetics at the Czech Technical University in Prague(捷克信息技术、机器人与自动化研究所(捷克技术大学)) Inria, École normale supérieure, CNRS, PSL Research University(法国国家信息与自动化研究所、法国高等师范学校、法国国家科学研究中心、巴黎-萨克勒大学)

Comments Accepted at ICCV 2025. Erratum: An earlier version reported ablations (Table 6 & Fig. 6) with pre-training on a 50k subset of HowToGround1M + fine-tuning on iGround. In the ICCV camera-ready, Table 6 already used the full dataset, but Fig. 6 and a sentence in the text were mistakenly left on 50k. All now use the full HowToGround1M

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01370 2025-09-10 cs.CV cs.CL

Understanding Museum Exhibits using Vision-Language Reasoning

Ada-Astrid Balauca, Sanjana Garai, Stefan Balauca, Rasesh Udayakumar Shetty, Naitik Agrawal, Dhwanil Subhashbhai Shah, Yuqian Fu, Xi Wang, Kristina Toutanova, Danda Pani Paudel, Luc Van Gool

机构 * ETH Zürich, Switzerland(苏黎世联邦理工学院,瑞士) Indian Institute of Technology, Varanasi (IIT BHU)(印度瓦拉纳西理工学院(IIT BHU)) Google DeepMind(谷歌DeepMind)

Comments Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06950 2025-09-09 cs.GR cs.CV

Scaling Transformer-Based Novel View Synthesis Models with Token Disentanglement and Synthetic Data

Nithin Gopalakrishnan Nair, Srinivas Kaza, Xuan Luo, Vishal M. Patel, Stephen Lombardi, Jungyeon Park

机构 * Johns Hopkins University(约翰霍普金斯大学) Google(谷歌公司)

Comments Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏