arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Computer Vision · 会议 · Computer Vision

2025-07-14 至 2025-07-14 共收录 12
2507.08626 2025-07-14 cs.SD eess.AS

Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection

Davide Salvi, Viola Negroni, Sara Mandelli, Paolo Bestagini, Stefano Tubaro

Comments Accepted at ICCV Workshop - Authenticity & Provenance in the age of Generative AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11992 2025-07-14 cs.CV

SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations

Songchun Zhang, Huiyao Xu, Sitong Guo, Zhongwei Xie, Hujun Bao, Weiwei Xu, Changqing Zou

机构 * ZJU(浙江大学) HKUST(香港科技大学) Zhejiang Lab(浙江实验室)

Comments Accepted by ICCV 2025. 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20287 2025-07-14 cs.CV

InsViE-1M: Effective Instruction-based Video Editing with Elaborate Dataset Construction

Yuhui Wu, Liyi Chen, Ruibin Li, Shihao Wang, Chenxi Xie, Lei Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学) OPPO Research Institute(OPPO研究院)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17414 2025-07-14 cs.CV

X-Dancer: Expressive Music to Human Dance Video Generation

Zeyuan Chen, Hongyi Xu, Guoxian Song, You Xie, Chenxu Zhang, Xin Chen, Chao Wang, Di Chang, Linjie Luo

机构 * UC San Diego(圣迭戈大学) ByteDance(字节跳动) University of Southern California(南加州大学)

Comments ICCV 2025. Project Page: https://zeyuan-chen.com/X-Dancer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08555 2025-07-14 cs.CV

Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion

Enyu Liu, En Yu, Sijia Chen, Wenbing Tao

机构 * Huazhong University of Science and Technology(华中科技大学)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08380 2025-07-14 cs.CV

From Enhancement to Understanding: Build a Generalized Bridge for Low-light Vision via Semantically Consistent Unsupervised Fine-tuning

Sen Wang, Shao Zeng, Tianjun Gu, Zhizhong Zhang, Ruixin Zhang, Shouhong Ding, Jingyun Zhang, Jun Wang, Xin Tan, Yuan Xie, Lizhuang Ma

机构 * East China Normal University(东华师范大学) Tencent Youtu Lab(腾讯云视频实验室) Tencent WeChat Pay Lab(腾讯微信支付实验室)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08044 2025-07-14 cs.CV cs.AI

ConsNoTrainLoRA: Data-driven Weight Initialization of Low-rank Adapters using Constraints

Debasmit Das, Hyoungwoo Park, Munawar Hayat, Seokeon Choi, Sungrack Yun, Fatih Porikli

机构 * Qualcomm AI Research(高通人工智能研究)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08525 2025-07-14 cs.CV cs.AI

GTR: Guided Thought Reinforcement Prevents Thought Collapse in RL-based VLM Agent Training

Tong Wei, Yijun Yang, Junliang Xing, Yuanchun Shi, Zongqing Lu, Deheng Ye

机构 * Tsinghua University(清华大学) Tencent(腾讯) Peking University(北京大学)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09626 2025-07-14 cs.CV

FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion

Haonan Qiu, Shiwei Zhang, Yujie Wei, Ruihang Chu, Hangjie Yuan, Xiang Wang, Yingya Zhang, Ziwei Liu

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学)

Comments ICCV 2025, Project Page: http://haonanqiu.com/projects/FreeScale.html, Code Repo: https://github.com/ali-vilab/FreeScale

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00136 2025-07-14 cs.CV cs.AI cs.LG

FonTS: Text Rendering with Typography and Style Controls

Wenda Shi, Yiren Song, Dengming Zhang, Jiaming Liu, Xingxing Zou

机构 * The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) Zhejiang University(浙江大学) Tiamat AI

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10715 2025-07-14 cs.CV

EVT: Efficient View Transformation for Multi-Modal 3D Object Detection

Yongjin Lee, Hyeon-Mun Jeong, Yurim Jeon, Sanghyun Kim

机构 * ThorDrive Co., Ltd(ThorDrive公司) Seoul National University(首尔国立大学)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24204 2025-07-14 cs.CV

GeoSplatting: Towards Geometry Guided Gaussian Splatting for Physically-based Inverse Rendering

Kai Ye, Chong Gao, Guanbin Li, Wenzheng Chen, Baoquan Chen

机构 * School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) State Key Laboratory of Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏