arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Winter Conference on Applications of Computer Vision · 会议 · Computer Vision

2025-12-11 至 2025-12-11 共收录 6
2512.09847 2025-12-11 cs.CV

From Detection to Anticipation: Online Understanding of Struggles across Various Tasks and Activities

从检测到预判:跨多种任务和活动的在线理解挣扎

Shijia Feng, Michael Wray, Walterio Mayol-Cuevas

机构 * University of Bristol(布里斯托大学) Amazon(亚马逊)

AI总结 本文提出了一种在线检测和预判挣扎的方法,通过改进模型实现跨任务和活动的实时应用,提升辅助系统的响应能力。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09792 2025-12-11 cs.CV

FastPose-ViT: A Vision Transformer for Real-Time Spacecraft Pose Estimation

FastPose-ViT:一种用于实时航天器姿态估计的视觉Transformer

Pierre Ancey, Andrew Price, Saqib Javed, Mathieu Salzmann

机构 * EPFL(瑞士联邦理工学院) Swiss Data Science Center(瑞士数据科学中心)

AI总结 FastPose-ViT提出了一种基于视觉Transformer的实时航天器姿态估计方法,通过直接回归6DoF姿态,实现了高效且高精度的姿态估计。

Comments Accepted to WACV 2026. Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09095 2025-12-11 cs.CV

Food Image Generation on Multi-Noun Categories

多名词类别的食物图像生成

Xinyue Pan, Yuhao Chen, Jiangpeng He, Fengqing Zhu

机构 * Purdue University(普渡大学) University of Waterloo(滑铁卢大学)

AI总结 本文提出FoCULR方法,通过整合食品领域知识和早期引入核心概念,解决多名词类别食物图像生成中的语义误解和布局错误问题。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17353 2025-12-11 cs.CE

RoadBench: A Vision-Language Foundation Model and Benchmark for Road Damage Understanding

RoadBench: 一种用于道路损伤理解的视觉-语言基础模型和基准

Xi Xiao, Yunbei Zhang, Janet Wang, Lin Zhao, Yuxiang Wei, Hengjia Li, Yanshu Li, Xinyuan Song, Xiao Wang, Swalpa Kumar Roy, Hao Xu, Tianyang Wang

AI总结 RoadBench通过整合视觉与文本信息,提出RoadCLIP模型,显著提升道路损伤识别性能,为基础设施监测提供新基准。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03848 2025-12-11 eess.IV cs.CV

INRetouch: Context Aware Implicit Neural Representation for Photography Retouching

INRetouch: 基于上下文的隐式神经表示用于摄影修图

Omar Elezabi, Marcos V. Conde, Zongwei Wu, Radu Timofte

机构 * Computer Vision Lab, CAIDAS & IFI, University of Würzburg(计算机视觉实验室、CAIDAS与IFI、乌尔姆大学)

AI总结 INRetouch通过基于上下文的隐式神经表示,实现高保真度的摄影修图,并提升图像重建性能。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08979 2025-12-11 cs.CV cs.AI

What Happens When: Learning Temporal Orders of Events in Videos

当什么发生时:学习视频中事件的时间顺序

Daechul Ahn, Yura Choi, Hyeonbeom Choi, Seongwon Cho, San Kim, Jonghyun Choi

机构 * Seoul National University(首尔国立大学) Imperial College London(帝国理工学院伦敦分校)

AI总结 本文提出MECOT方法,通过事件级描述训练和思维链提示提升视频模型对事件时间顺序的理解能力。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏