arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Winter Conference on Applications of Computer Vision · 会议 · Computer Vision

2025-12-01 至 2025-12-01 共收录 8
2511.23405 2025-12-01 cs.CV

MANTA: Physics-Informed Generalized Underwater Object Tracking

MANTA:融合物理的通用水下目标跟踪

Suhas Srinath, Hemang Jamadagni, Aditya Chadrasekar, Prathosh AP

机构 * Indian Institute of Science(印度科学研究院) National Institute of Technology Karnataka(卡纳塔克国家理工学院)

AI总结 MANTA通过融合物理的框架,结合对比学习与多阶段流程,实现水下目标跟踪的鲁棒性和高效性。

Comments Accepted to the IEEE/CVF WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22908 2025-12-01 cs.CV

ViGG: Robust RGB-D Point Cloud Registration using Visual-Geometric Mutual Guidance

ViGG: 基于视觉-几何互指导的鲁棒RGB-D点云配准

Congjia Chen, Shen Yan, Yufu Qu

机构 * Beihang University(北航大学) China Agricultural University(中国农业大学)

AI总结 ViGG通过视觉-几何互指导策略提升RGB-D点云配准的鲁棒性,优于现有方法。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09864 2025-12-01 cs.GR cs.CV cs.LG

Leveraging Semantic Attribute Binding for Free-Lunch Color Control in Diffusion Models

利用语义属性绑定实现扩散模型中的免费午餐颜色控制

Héctor Laria, Alexandra Gomez-Villa, Jiang Qin, Muhammad Atif Butt, Bogdan Raducanu, Javier Vazquez-Corral, Joost van de Weijer, Kai Wang

机构 * Computer Vision Center, Spain(西班牙计算机视觉中心) Universitat Autònoma de Barcelona(巴塞罗那自治大学) Harbin Institute of Technology(哈尔滨工业大学) City University of Hong Kong(香港城市大学) Program of Computer Science, City University of Hong Kong (Dongguan)(香港城市大学(东莞)计算机科学项目)

AI总结 ColorWave通过语义属性绑定实现扩散模型中精确的颜色控制,无需微调,提升颜色指定的准确性和适用性。

Comments WACV 2026. Project page: https://hecoding.github.io/colorwave-page

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22064 2025-12-01 cs.CV

DNA: Dual-branch Network with Adaptation for Open-Set Online Handwriting Generation

DNA:具有适应性的双分支网络用于开放集在线手写生成

Tsai-Ling Huang, Nhat-Tuong Do-Tran, Ngoc-Hoang-Lam Le, Hong-Han Shuai, Ching-Chun Huang

机构 * National Yang Ming Chiao Tung University

AI总结 本文提出DNA双分支网络,通过适应性风格和内容分支生成开放集在线手写体,实现未见过字符的有效生成。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21231 2025-12-01 cs.CV

Occlusion Boundary and Depth: Mutual Enhancement via Multi-Task Learning

遮挡边界与深度:通过多任务学习实现相互增强

Lintao Xu, Yinghao Wang, Chaohui Wang

机构 * LIGM, Univ Gustave Eiffel, École des Ponts, CNRS, France(巴黎理工大学埃菲尔大学LIGM研究所,法国国家科学研究中心) INFRES, Télécom Paris, Institute Polytechnique de Paris, France(巴黎理工学院INFRES研究所,法国)

AI总结 本文提出MoDOT框架,通过多任务学习联合估计遮挡边界与深度,提升两者的一致性与精度。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20138 2025-12-01 cs.LG cs.AI

Guided Model Merging for Hybrid Data Learning: Leveraging Centralized Data to Refine Decentralized Models

引导式模型融合用于混合数据学习:利用集中数据优化分布式模型

Junyi Zhu, Ruicong Yao, Taha Ceritli, Savas Ozkan, Matthew B. Blaschko, Eunchung Noh, Jeongwon Min, Cho Jung Min, Mete Ozay

机构 * Samsung R&D Institute UK (SRUK)(三星英国研发中心) KU Leuven, Belgium(比利时鲁文大学) Samsung Electronics Korea(三星韩国电子)

AI总结 本文提出了一种引导式模型融合框架,结合联邦学习和模型融合技术,通过集中数据优化分布式模型,提升混合数据环境下的训练效果。

Comments Accepted at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13911 2025-12-01 cs.CV

GraspDiffusion: Synthesizing Realistic Whole-body Hand-Object Interaction

GraspDiffusion: 合成逼真的全身手-物体交互

Patrick Kwon, Chen Chen, Hanbyul Joo

机构 * University of Central Florida(中央佛罗里达大学) Seoul National University(首尔国立大学)

AI总结 GraspDiffusion通过结合身体和手姿态的生成先验知识,生成逼真的全身手-物体交互场景,优于现有方法。

Comments Paper has been accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18773 2025-12-01 cs.CV

Spacewalk-18: A Benchmark for Multimodal and Long-form Procedural Video Understanding in Novel Domains

Spacewalk-18:多模态和长形式程序视频理解的基准测试,用于新领域

Zitian Tang, Rohan Myer Krishnan, Zhiqiu Yu, Chen Sun

机构 * Brown University(布朗大学)

AI总结 Spacewalk-18是一个用于多模态和长形式程序视频理解的新领域基准测试,通过步骤识别和视频问答任务评估模型在新领域和长时序上下文中的泛化能力。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏