arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Computer Vision · 会议 · Computer Vision

2025-07-16 至 2025-07-16 共收录 17
2507.11533 2025-07-16 cs.CV

CharaConsist: Fine-Grained Consistent Character Generation

Mengyu Wang, Henghui Ding, Jianing Peng, Yao Zhao, Yunpeng Chen, Yunchao Wei

机构 * Institute of Information Science, Beijing Jiaotong University(信息科学学院,北京交通大学) Institute of Big Data, Fudan University(大数据学院,复旦大学) Visual Intelligence + X International Joint Laboratory of the Ministry of Education(教育部视觉智能+X国际联合实验室) Alkaid Pte. Ltd., Singapore(新加坡Alkaid公司)

Comments ICCV 2025 accepted paper, project page: https://murray-wang.github.io/CharaConsist/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11333 2025-07-16 cs.CV

MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network

Jianfei Jiang, Qiankun Liu, Haochen Yu, Hongyuan Liu, Liyong Wang, Jiansheng Chen, Huimin Ma

机构 * University of Science and Technology Beijing(北京科技大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11296 2025-07-16 cs.RO

Diffusion-Based Imaginative Coordination for Bimanual Manipulation

Huilin Xu, Jian Ding, Jiakun Xu, Ruixiang Wang, Jun Chen, Jinjie Mai, Yanwei Fu, Bernard Ghanem, Feng Xu, Mohamed Elhoseiny

Comments 15 pages, including 10 figures and 16 tables. Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11287 2025-07-16 cs.CV cs.RO

Task-Oriented Human Grasp Synthesis via Context- and Task-Aware Diffusers

An-Lun Liu, Yu-Wei Chao, Yi-Ting Chen

机构 * National Yang Ming Chiao Tung University(阳明交通大学) NVIDIA(英伟达)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09291 2025-07-16 cs.CV cs.LG

Supercharging Floorplan Localization with Semantic Rays

Yuval Grader, Hadar Averbuch-Elor

机构 * Tel Aviv University(特拉维夫大学) Cornell University(康奈尔大学)

Comments Accepted at ICCV 2025. https://tau-vailab.github.io/SemRayLoc/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12753 2025-07-16 cs.CV

Stronger, Steadier & Superior: Geometric Consistency in Depth VFM Forges Domain Generalized Semantic Segmentation

Siyu Chen, Ting Han, Changshe Zhang, Xin Luo, Meiliu Wu, Guorong Cai, Jinhe Su

机构 * Jimei University(集美大学) Sun Yat-sen University(中山大学) University of Glasgow(格拉斯哥大学) Xidian University(西安电子科技大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03666 2025-07-16 cs.CV

QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning

Haoxuan Wang, Yuzhang Shang, Zhihang Yuan, Junyi Wu, Junchi Yan, Yan Yan

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) University of Central Florida(中央佛罗里达大学) Shanghai Jiao Tong University(上海交通大学) Houmo AI

Comments ICCV 2025. Code is available at https://github.com/hatchetProject/QuEST

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11030 2025-07-16 cs.CV

Personalized OVSS: Understanding Personal Concept in Open-Vocabulary Semantic Segmentation

Sunghyun Park, Jungsoo Lee, Shubhankar Borse, Munawar Hayat, Sungha Choi, Kyuwoong Hwang, Fatih Porikli

机构 * Qualcomm AI Research(高通人工智能研究)

Comments Accepted to ICCV 2025; 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10855 2025-07-16 cs.CV

Sparse Fine-Tuning of Transformers for Generative Tasks

Wei Chen, Jingxi Yu, Zichen Miao, Qiang Qiu

Comments Accepted by International Conference on Computer Vision 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10737 2025-07-16 cs.CV

Integrating Biological Knowledge for Robust Microscopy Image Profiling on De Novo Cell Lines

Jiayuan Chen, Thai-Hoang Pham, Yuanlong Wang, Ping Zhang

机构 * The Ohio State University(俄亥俄州立大学)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10689 2025-07-16 cs.CV

CWNet: Causal Wavelet Network for Low-Light Image Enhancement

Tongshun Zhang, Pingping Liu, Yubing Lu, Mengen Cai, Zijian Zhang, Zhe Zhang, Qiuzhan Zhou

机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education(教育部符号计算与知识工程重点实验室) College of Communication Engineering, Jilin University(吉林大学通信工程学院)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23367 2025-07-16 cs.CV cs.AI

PAN-Crafter: Learning Modality-Consistent Alignment for PAN-Sharpening

Jeonghyeok Do, Sungpyo Kim, Geunhyuk Youk, Jaehyup Lee, Munchurl Kim

机构 * KAIST(韩国科学技术院) Kyungpook National University(庆北国立大学)

Comments ICCV 2025 (camera-ready version). Please visit our project page https://kaist-viclab.github.io/PAN-Crafter_site

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02008 2025-07-16 q-bio.QM cs.AI

Test-time Adaptation for Foundation Medical Segmentation Model without Parametric Updates

Kecheng Chen, Xinyu Luo, Tiexin Qin, Jie Liu, Hui Liu, Victor Ho Fun Lee, Hong Yan, Haoliang Li

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10596 2025-07-16 cs.CV

GroundingSuite: Measuring Complex Multi-Granular Pixel Grounding

Rui Hu, Lianghui Zhu, Yuxuan Zhang, Tianheng Cheng, Lei Liu, Heng Liu, Longjin Ran, Xiaoxin Chen, Wenyu Liu, Xinggang Wang

机构 * School of EIC, Huazhong University of Science & Technology(华中科技大学电子信息学院) vivo AI Lab(vivo人工智能实验室)

Comments To appear at ICCV 2025. Code: https://github.com/hustvl/GroundingSuite

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10225 2025-07-16 cs.CV

Unveiling the Invisible: Reasoning Complex Occlusions Amodally with AURA

Zhixuan Li, Hyunse Yoon, Sanghoon Lee, Weisi Lin

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算与数据科学学院) Department of Electrical and Electronic Engineering, Yonsei University, Korea(延世大学电子与电气工程系)

Comments Accepted by ICCV 2025, 17 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15858 2025-07-16 cs.CV

SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition

Yongkun Du, Zhineng Chen, Hongtao Xie, Caiyan Jia, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI, Fudan University, China(可信具身人工智能研究院,复旦大学) School of Information Science and Technology, USTC, China(信息科学与技术学院,中国科学技术大学) School of Computer Science and Technology, Beijing Jiaotong University, China(计算机科学与技术学院,北京交通大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06109 2025-07-16 cs.CV

PerLDiff: Controllable Street View Synthesis Using Perspective-Layout Diffusion Models

Jinhua Zhang, Hualian Sheng, Sijia Cai, Bing Deng, Qiao Liang, Wen Li, Ying Fu, Jieping Ye, Shuhang Gu

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏