arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

期刊&会议

Conference on Computer Vision and Pattern Recognition · 会议 · Computer Vision

2026-03-27 至 2026-03-27 共收录 63
2511.20525 2026-03-27 cs.CV

Mistake Attribution: Fine-Grained Mistake Understanding in Egocentric Videos

错误归因:第一性错误理解在第一人称视频中

Yayuan Li, Aadit Jain, Filippos Bellos, Jason J. Corso

机构 * University of Michigan(密歇根大学) Voxel51

AI总结 本文提出MATT任务,通过细粒度分析第一人称视频中的人类错误,开发MisEngine数据引擎生成带有归因注释的错误样本,并提出MisFormer模型在语义、时间和空间维度上实现统一的错误归因,实验表明其在视频语言理解等任务上优于现有方法。

Comments 12 pages, 5 figures, 7 tables. Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02803 2026-03-27 cs.CV cs.GR

HyperGaussians: High-Dimensional Gaussian Splatting for High-Fidelity Animatable Face Avatars

HyperGaussians: 高维高斯点云用于高质量可动画人脸仿生体

Gent Serifi, Marcel C. Buehler

机构 * ETH Zurich(苏黎世联邦理工学院)

AI总结 本文提出HyperGaussians,一种高维多变量高斯点云的扩展,用于生成高质量可动画人脸仿生体。通过引入可学习的局部嵌入条件,提升表达能力,解决传统3DGS在非线性变形和细节表现上的不足。

Comments CVPR 2026, Project page: https://gserifi.github.io/HyperGaussians, Code: https://github.com/gserifi/HyperGaussians

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07507 2026-03-27 cs.CV

PE3R: Perception-Efficient 3D Reconstruction

PE3R:感知高效的3D重建

Jie Hu, Shizun Wang, Xinchao Wang

机构 * xML Lab, National University of Singapore(新加坡国立大学xML实验室)

AI总结 PE3R提出一种无需调优的框架,通过集成多视图几何与2D语义先验,实现跨场景的高效3D语义重建,提升推理速度并取得新的SOTA精度。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏