arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Winter Conference on Applications of Computer Vision · 会议 · Computer Vision

2025-12-03 至 2025-12-03 共收录 7
2512.02952 2025-12-03 cs.CV

Layout Anything: One Transformer for Universal Room Layout Estimation

布局万物:一种用于通用房间布局估计的变换器

Md Sohag Mia, Muhammad Abdullah Adnan

机构 * Nanjing University of Information Science and Technology(南京信息工程大学) Bangladesh University of Engineering and Technology(孟加拉国工程与技术大学)

AI总结 Layout Anything通过整合任务条件查询和对比学习,提出了一种基于变换器的通用房间布局估计框架,实现了高速推理和高精度性能。

Comments Published at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02737 2025-12-03 cs.CV cs.LG

Beyond Paired Data: Self-Supervised UAV Geo-Localization from Reference Imagery Alone

超越配对数据:仅从参考影像进行无人机地理定位的自监督方法

Tristan Amadei, Enric Meinhardt-Llopis, Benedicte Bascle, Corentin Abgrall, Gabriele Facciolo

机构 * Thales LAS Universite Paris-Saclay(巴黎萨克雷大学) ENS Paris-Saclay(巴黎萨克雷高等学院) CNRS(国家科学研究中心) Centre Borelli(Borelli中心)

AI总结 本文提出了一种无需配对数据的自监督无人机地理定位方法,通过卫星参考影像训练,有效提升了在GNSS拒止环境下的定位性能。

Comments Accepted at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02727 2025-12-03 cs.CV cs.AI cs.LG

DF-Mamba: Deformable State Space Modeling for 3D Hand Pose Estimation in Interactions

DF-Mamba:用于手姿估计的可变形状态空间建模

Yifan Zhou, Takehiko Ohkawa, Guwenxiao Zhou, Kanoko Goto, Takumi Hirose, Yusuke Sekikawa, Nakamasa Inoue

机构 * Institute of Science Tokyo(东京科学研究所) Denso IT Laboratory(Denso IT实验室) The University of Tokyo(东京大学)

AI总结 DF-Mamba通过可变形状态空间建模提升3D手姿估计的鲁棒性和精度,优于现有方法。

Comments Accepted to WACV 2026. Project page: https://tkhkaeio.github.io/projects/25-dfmamba/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08294 2025-12-03 cs.CV

SkelSplat: Robust Multi-view 3D Human Pose Estimation with Differentiable Gaussian Rendering

SkelSplat: 基于可微高斯渲染的鲁棒多视角3D人体姿态估计

Laura Bragagnolo, Leonardo Barcellona, Stefano Ghidoni

机构 * University of Padova(帕多瓦大学) University of Amsterdam(阿姆斯特丹大学)

AI总结 SkelSplat通过可微高斯渲染实现多视角3D人体姿态估计,无需3D真实数据监督,有效提升跨数据集泛化能力与遮挡鲁棒性。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02438 2025-12-03 cs.CV cs.AI

Boosting Medical Vision-Language Pretraining via Momentum Self-Distillation under Limited Computing Resources

通过有限计算资源下的动量自蒸馏提升医学视觉-语言预训练

Phuc Pham, Nhu Pham, Ngoc Quoc Ly

机构 * Faculty of Information Technology, University of Science, Ho Chi Minh City, Vietnam(信息科技学院,科学大学,胡志明市,越南) Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学,胡志明市,越南)

AI总结 本研究通过动量自蒸馏与梯度累积提升医学视觉-语言预训练效率,实现高效多模态学习并提升零样本分类和少量样本适应性能。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13922 2025-12-03 eess.IV cs.CV cs.LG cs.MM

Self-Supervised Compression and Artifact Correction for Streaming Underwater Imaging Sonar

面向流式水下成像声纳的自监督压缩与伪影校正

Rongsheng Qian, Chi Xu, Xiaoqiang Ma, Hao Fang, Yili Jin, William I. Atlas, Jiangchuan Liu

机构 * Simon Fraser University(西蒙弗雷泽大学) Douglas College(道格拉斯学院) McGill University(麦吉尔大学) Wild Salmon Center(野生鲑鱼中心)

AI总结 SCOPE通过自监督方法实现低比特率水下声纳流式传输,有效压缩并校正声纳伪影,提升实时检测性能。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19478 2025-12-03 cs.CV

Permutation-Aware Action Segmentation via Unsupervised Frame-to-Segment Alignment

通过无监督帧到段对齐实现感知-aware的动作分割

Quoc-Huy Tran, Ahmed Mehmood, Muhammad Ahmed, Muhammad Naufil, Anas Zafar, Andrey Konin, M. Zeeshan Zia

机构 * Retrocausal, Inc.(Retrocausal公司)

AI总结 本文提出一种无监督框架,通过帧到段对齐实现感知-aware的动作分割,利用变换器模型和伪标签提升分割性能。

Comments Accepted to WACV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏