arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Computer Vision · 会议 · Computer Vision

共收录 4770
2504.07955 2025-10-01 cs.CV

BoxDreamer: Dreaming Box Corners for Generalizable Object Pose Estimation

Yuanhong Yu, Xingyi He, Chen Zhao, Junhao Yu, Jiaqi Yang, Ruizhen Hu, Yujun Shen, Xing Zhu, Xiaowei Zhou, Sida Peng

机构 * Zhejiang University(浙江大学) Xiangjiang Laboratory(湘江实验室) Ant Group(蚂蚁集团) EPFL(苏黎世联邦理工学院) Chongqing University(重庆大学) Northwestern Polytechnical University(西北工业大学) Shenzhen University(深圳大学)

Comments ICCV 2025 Camera Ready, Project page: https://zju3dv.github.io/boxdreamer

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26231 2025-10-01 cs.CV

IMG: Calibrating Diffusion Models via Implicit Multimodal Guidance

Jiayi Guo, Chuanhao Yan, Xingqian Xu, Yulin Wang, Kai Wang, Gao Huang, Humphrey Shi

机构 * Tsinghua University(清华大学)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25745 2025-10-01 cs.CV cs.CL cs.MM

FinCap: Topic-Aligned Captions for Short-Form Financial YouTube Videos

Siddhant Sukhani, Yash Bhardwaj, Riya Bhadani, Veer Kejriwal, Michael Galarnyk, Sudheer Chava

机构 * Stanford University(斯坦福大学) Georgia Institute of Technology(佐治亚理工学院)

Comments ICCV Short Video Understanding Workshop Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10156 2025-10-01 cs.CV

LayerLock: Non-collapsing Representation Learning with Progressive Freezing

Goker Erdogan, Nikhil Parthasarathy, Catalin Ionescu, Drew A. Hudson, Alexander Lerchner, Andrew Zisserman, Mehdi S. M. Sajjadi, Joao Carreira

机构 * Google DeepMind(谷歌DeepMind) University of Oxford(牛津大学)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10169 2025-10-01 cs.CV cs.AI cs.LG

Modeling Saliency Dataset Bias

Matthias Kümmerer, Harneet Singh Khanuja, Matthias Bethge

机构 * Tübingen AI Center University of Tübingen(图宾根人工智能中心 图宾根大学)

Comments published at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06637 2025-10-01 cs.MM

SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas

Chenghao Ma, Haihong E., Junpeng Ding, Jun Zhang, Ziyan Ma, Huang Qing, Bofei Gao, Liang Chen, Yifan Zhu, Meina Song

Comments Submitted to ICCV 2025. 11 pages (including references)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12649 2025-10-01 cs.LG cs.AI

FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization

Hao Mark Chen, Shell Xu Hu, Wayne Luk, Timothy Hospedales, Hongxiang Fan

机构 * Imperial College London, UK(伦敦帝国学院) Samsung AI Center, Cambridge, UK(三星AI研究中心)

Comments Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25134 2025-09-30 cs.GR cs.CV

LayerD: Decomposing Raster Graphic Designs into Layers

Tomoyuki Suzuki, Kang-Jun Liu, Naoto Inoue, Kota Yamaguchi

机构 * CyberAgent Tohoku University(东北大学)

Comments ICCV 2025, Project page: https://cyberagentailab.github.io/LayerD/ , GitHub: https://github.com/CyberAgentAILab/LayerD

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24318 2025-09-30 cs.CV

Similarity-Aware Selective State-Space Modeling for Semantic Correspondence

Seungwook Kim, Minsu Cho

机构 * Pohang University of Science and Technology (POSTECH)(浦项科学技术大学)

Comments 23 pages, 11 figures. Accepted as Oral presentation for ICCV 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23284 2025-09-30 cs.CV

Bidirectional Likelihood Estimation with Multi-Modal Large Language Models for Text-Video Retrieval

Dohwan Ko, Ji Soo Lee, Minhyuk Choi, Zihang Meng, Hyunwoo J. Kim

机构 * Korea University(韩国大学) Meta GenAI(Meta 生成人工智能) KAIST(韩国科学技术院)

Comments ICCV 2025 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20294 2025-09-30 cs.CV cs.AI cs.RO

GLEAM: Learning Generalizable Exploration Policy for Active Mapping in Complex 3D Indoor Scenes

Xiao Chen, Tai Wang, Quanyi Li, Tao Huang, Jiangmiao Pang, Tianfan Xue

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai AI Laboratory(上海人工智能实验室)

Comments Accepted by ICCV 2025. Project page: https://xiao-chen.tech/gleam/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04740 2025-09-30 cs.CV cs.AI

SCRAMBLe : Enhancing Multimodal LLM Compositionality with Synthetic Preference Data

Samarth Mishra, Kate Saenko, Venkatesh Saligrama

机构 * Boston University(波士顿大学)

Comments ICCV 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13723 2025-09-30 cs.LG cs.AI

Beyond Losses Reweighting: Empowering Multi-Task Learning via the Generalization Perspective

Hoang Phan, Lam Tran, Quyen Tran, Ngoc N. Tran, Tuan Truong, Qi Lei, Nhat Ho, Dinh Phung, Trung Le

机构 * New York University(纽约大学) Qualcomm AI Research(高通人工智能研究) Vanderbilt University(范德比大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) Monash University(墨尔本大学)

Comments ICCV 2025 highlight paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23849 2025-09-30 cs.CV

CE-FAM: Concept-Based Explanation via Fusion of Activation Maps

Michihiro Kuroki, Toshihiko Yamasaki

机构 * The University of Tokyo(东京大学)

Comments This paper has been accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23594 2025-09-30 cs.CR cs.CV

StolenLoRA: Exploring LoRA Extraction Attacks via Synthetic Data

Yixu Wang, Yan Teng, Yingchun Wang, Xingjun Ma

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23393 2025-09-30 cs.CV

Generative Modeling of Shape-Dependent Self-Contact Human Poses

Takehiko Ohkawa, Jihyun Lee, Shunsuke Saito, Jason Saragih, Fabian Prado, Yichen Xu, Shoou-I Yu, Ryosuke Furuta, Yoichi Sato, Takaaki Shiratori

机构 * Codec Avatars Lab, Meta(Meta 形态生成实验室) The University of Tokyo(东京大学) KAIST(韩国科学技术院)

Comments Accepted to ICCV 2025. Project page: https://tkhkaeio.github.io/projects/25-scgen

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22909 2025-09-30 cs.CV cs.AI cs.LG

TY-RIST: Tactical YOLO Tricks for Real-time Infrared Small Target Detection

Abdulkarim Atrash, Omar Moured, Yufan Chen, Jiaming Zhang, Seyda Ertekin, Omur Ugur

机构 * Middle East Technical University(中东技术大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

Comments Acctepted at the ICCV 2025 MIRA workshop, 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22697 2025-09-30 cs.CV cs.AI cs.LG

Learning Hyperspectral Images with Curated Text Prompts for Efficient Multimodal Alignment

Abhiroop Chatterjee, Susmita Ghosh

机构 * Jadavpur University(贾瓦帕尔大学)

Comments Accepted at the IEEE/CVF International Conference on Computer Vision (ICCV 2025), Workshop on Curated Data for Efficient Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18873 2025-09-30 cs.CV

Efficient Self-Supervised Adaptation for Medical Image Analysis

Moein Sorkhei, Emir Konuk, Jingyu Guo, Chanjuan Meng, Christos Matsoukas, Kevin Smith

机构 * KTH Royal Institute of Technology(皇家理工学院) Science for Life Laboratory(生命科学实验室)

Comments Accepted to ICCV CVAMD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01812 2025-09-30 cs.CV

Leveraging BEV Paradigm for Ground-to-Aerial Image Synthesis

Junyan Ye, Jun He, Weijia Li, Zhutao Lv, Yi Lin, Jinhua Yu, Haote Yang, Conghui He

机构 * Sun Yat-Sen University(中山大学) Shanghai AI Laboratory(上海人工智能实验室) Sensetime Research(商汤科技研究院)

Comments Accepted to ICCV 2025, 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22019 2025-09-29 cs.CV

EgoInstruct: An Egocentric Video Dataset of Face-to-face Instructional Interactions with Multi-modal LLM Benchmarking

Yuki Sakai, Ryosuke Furuta, Juichun Yen, Yoichi Sato

机构 * The University of Tokyo(东京大学)

Comments Accepted to the I-HFM Workshop at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15363 2025-09-29 eess.IV cs.AI cs.CV cs.LG

Recent Advancements in Microscopy Image Enhancement using Deep Learning: A Survey

Debasish Dutta, Neeharika Sonowal, Risheraj Barauh, Deepjyoti Chetia, Sanjib Kr Kalita

机构 * Dept. of Computer Science(计算机科学系) Gauhati University(果阿大学)

Comments 7 pages, 3 figures and 1 table. 2024 IEEE International Conference on Computer Vision and Machine Intelligence (CVMI). IEEE, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13019 2025-09-29 cs.RO cs.AI cs.CL cs.CV

Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities

Liuyi Wang, Xinyuan Xia, Hui Zhao, Hanqing Wang, Tai Wang, Yilun Chen, Chengju Liu, Qijun Chen, Jiangmiao Pang

机构 * Tongji University(同济大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) State Key Laboratory of Autonomous Intelligent Unmanned Systems(自主智能无人系统国家重点实验室)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10563 2025-09-29 cs.CV

Data Augmentation Through Random Style Replacement

Qikai Yang, Cheng Ji, Huaiying Luo, Panfeng Li, Zhicheng Ding

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Cornell University(康奈尔大学) University of Michigan(密歇根大学) Columbia University(哥伦比亚大学)

Comments Accepted by 2025 6th International Conference on Computer Vision, Image and Deep Learning

Journal ref Proceedings of the 2025 6th International Conference on Computer Vision, Image and Deep Learning (CVIDL), 2025, pp. 693-696

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15216 2025-09-29 cs.CV

UIP2P: Unsupervised Instruction-based Image Editing via Edit Reversibility Constraint

Enis Simsar, Alessio Tonioni, Yongqin Xian, Thomas Hofmann, Federico Tombari

机构 * ETH Zürich - DALAB(苏黎世联邦理工学院- DALAB) Technical University of Munich(慕尼黑技术大学) Google Switzerland(瑞士谷歌)

Comments Accepted to ICCV'25. Project page: https://uip2p.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21251 2025-09-26 cs.CV cs.AI

Instruction-tuned Self-Questioning Framework for Multimodal Reasoning

You-Won Jang, Yu-Jung Heo, Jaeseok Kim, Minsu Lee, Du-Seong Chang, Byoung-Tak Zhang

Comments This paper was accepted to the "CLVL: 5th Workshop on Closing the Loop Between Vision and Language (ICCV 2023 CLVL workshop)."

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21136 2025-09-26 cs.AI

Embodied Representation Alignment with Mirror Neurons

Wentao Zhu, Zhining Zhang, Yuwei Ren, Yin Huang, Hao Xu, Yizhou Wang

机构 * Center on Frontiers of Computing Studies, School of Compter Science, Peking University(前沿计算研究中心,计算机科学学院,北京大学) Eastern Institute of Technology, Ningbo(宁波技术研究所) Qualcomm AI Research(高通人工智能研究) Inst. for Artificial Intelligence, Peking University(人工智能研究所,北京大学)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20807 2025-09-26 cs.CV

Federated Domain Generalization with Domain-specific Soft Prompts Generation

Jianhan Wu, Xiaoyang Qu, Zhangcheng Huang, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司)

Comments Accepted to the IEEE/CVF International Conference on Computer Vision (ICCV 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20400 2025-09-26 cs.GR

SeHDR: Single-Exposure HDR Novel View Synthesis via 3D Gaussian Bracketing

Yiyu Li, Haoyuan Wang, Ke Xu, Gerhard Petrus Hancke, Rynson W. H. Lau

Comments ICCV 2025 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17651 2025-09-26 cs.CV

CNS-Bench: Benchmarking Image Classifier Robustness Under Continuous Nuisance Shifts

Olaf Dünkel, Artur Jesslen, Jiahao Xie, Christian Theobalt, Christian Rupprecht, Adam Kortylewski

Comments ICCV 2025. Project page: https://genintel.github.io/CNS

详情

展开后加载摘要…

URL PDF HTML 收藏