arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Winter Conference on Applications of Computer Vision · 会议 · Computer Vision

2025-12-25 至 2025-12-25 共收录 10
2512.21237 2025-12-25 cs.CV

SegMo: Segment-aligned Text to 3D Human Motion Generation

SegMo:基于段落的文本到3D人体运动生成

Bowen Dang, Lin Wu, Xiaohang Yang, Zheng Yuan, Zhixiang Chen

机构 * University of Sheffield(谢菲尔德大学) University of Glasgow(格拉斯哥大学) Queen Mary University of London(伦敦大学Queen Mary)

AI总结 SegMo通过段落对齐实现文本与3D人体运动的精细生成与对齐,提升生成效果并拓展应用范围。

Comments The IEEE/CVF Winter Conference on Applications of Computer Vision 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21150 2025-12-25 cs.CV

ORCA: Object Recognition and Comprehension for Archiving Marine Species

ORCA:面向档案化海洋物种的对象识别与理解

Yuk-Kwan Wong, Haixin Liang, Zeyu Ma, Yiwei Chen, Ziqiang Zheng, Rinaldi Gotama, Pascal Sebastian, Lauren D. Sparks, Sai-Kit Yeung

机构 * Hong Kong University of Science and Technology(香港科技大学) University of Electronic Science and Technology of China(电子科学与技术大学) Indo Ocean Foundation Project(印度洋基金会项目)

AI总结 ORCA提出一个多模态基准数据集,用于提升海洋物种识别与理解的研究水平,通过细粒度视觉和文本注释推动领域内方法学进展。

Comments Accepted by The IEEE/CVF Winter Conference on Applications of Computer Vision (WACV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21126 2025-12-25 cs.CV cs.DB

MarineEval: Assessing the Marine Intelligence of Vision-Language Models

MarineEval: 评估视觉-语言模型的海洋智能

YuK-Kwan Wong, Tuan-An To, Jipeng Zhang, Ziqiang Zheng, Sai-Kit Yeung

机构 * Hong Kong University of Science and Technology(香港科技大学)

AI总结 MarineEval首次构建大规模海洋VLM数据集和基准,评估现有VLM在回答海洋领域问题上的能力与局限性。

Comments Accepted by The IEEE/CVF Winter Conference on Applications of Computer Vision (WACV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21054 2025-12-25 cs.CV cs.AI cs.HC cs.LG

DexAvatar: 3D Sign Language Reconstruction with Hand and Body Pose Priors

DexAvatar: 基于手部和身体姿态先验的3D手语重建

Kaustubh Kundu, Hrishav Bakul Barua, Lucy Robertson-Bell, Zhixi Cai, Kalin Stefanov

机构 * Monash University(墨尔本大学)

AI总结 DexAvatar通过学习的3D手部和身体先验,实现了对野外单目手语视频中细粒度手部动作和身体运动的高精度重建,提升了手语姿态估计的性能。

Comments Accepted in WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20746 2025-12-25 cs.CV cs.LG

TrashDet: Iterative Neural Architecture Search for Efficient Waste Detection

TrashDet: 为高效垃圾检测的迭代神经架构搜索

Tony Tran, Bin Hu

机构 * Department of Research Computing(研究计算系) University of Houston(休斯敦大学) Department of Engineering Technology(工程技术系)

AI总结 TrashDet通过迭代神经架构搜索在资源受限设备上实现高效垃圾检测,提供多种参数规模的检测器,显著提升精度与能效。

Comments 10 pages. The paper has been accepted by the WACV 2026 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12870 2025-12-25 cs.CV

View-aware Cross-modal Distillation for Multi-view Action Recognition

视点感知的多模态知识蒸馏用于多视图动作识别

Trung Thanh Nguyen, Yasutomo Kawanishi, Vijay John, Takahiro Komamizu, Ichiro Ide

机构 * Nagoya University(名古屋大学) Guardian Robot Project, R-IH, RIKEN(守护机器人项目,RIIH,理化学研究所) Lawrence Technological University(劳伦斯技术大学)

AI总结 ViCoKD通过视点感知的多模态知识蒸馏方法,在多视图动作识别中提升模型性能,有效解决视点不一致问题。

Comments IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11662 2025-12-25 cs.CV

AGENet: Adaptive Edge-aware Geodesic Distance Learning for Few-Shot Medical Image Segmentation

AGENet: 适应性边缘感知测地距离学习用于少样本医学图像分割

Ziyuan Gao

机构 * University College London(伦敦大学学院)

AI总结 AGENet通过边缘感知测地距离学习,提升少样本医学图像分割的边界精度与计算效率。

Comments Accepted for publication in WACV 2026 (Round 2)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06433 2025-12-25 cs.CV

Diagnose Like A REAL Pathologist: An Uncertainty-Focused Approach for Trustworthy Multi-Resolution Multiple Instance Learning

像真正的病理科医生一样诊断:一种以不确定性为核心的多分辨率多实例学习方法

Sungrae Hong, Sol Lee, Jisu Shin, Jiwon Jeong, Mun Yong Yi

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 本文提出UFC-MIL方法,通过多分辨率图像和不确定性校准,提升多实例学习的诊断可靠性。

Comments Accepted by IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11953 2025-12-25 cs.CV

SPOC: Spatially-Progressing Object State Change Segmentation in Video

SPOC: 视频中空间性推进的对象状态变化分割

Priyanka Mandikal, Tushar Nagarajan, Alex Stoken, Zihui Xue, Kristen Grauman

AI总结 SPOC提出空间性推进的对象状态变化分割任务,通过伪标签和动态约束方法,解决视频中对象变化位置和速度的精确定位问题。

Comments Accepted at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02913 2025-12-25 cs.CV

Pointmap-Conditioned Diffusion for Consistent Novel View Synthesis

基于点图的扩散模型用于一致的新型视角合成

Thang-Anh-Quan Nguyen, Nathan Piasco, Luis Roldão, Moussab Bennehar, Dzmitry Tsishkou, Laurent Caraffa, Jean-Philippe Tarel, Roland Brémond

机构 * Noah’s Ark, Huawei Paris Research Center(Noah’s Ark,华为巴黎研究中心) COSYS, Gustave Eiffel University(COSYS,格拉夫-埃菲尔大学) LASTIG, IGN-ENSG, Gustave Eiffel University(LASTIG,IGN-ENSG,格拉夫-埃菲尔大学)

AI总结 PointmapDiff通过利用点图作为条件信号,结合预训练的2D扩散模型,实现城市驾驶场景中一致的新型视角合成,并能生成高质量结果。

Comments WACV 2026. Project page: https://ntaquan0125.github.io/pointmap-conditioned-diffusion

详情

展开后加载摘要…

URL PDF HTML 收藏