arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-21 至 2025-11-21 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 效率与蒸馏 2 篇

2509.23584 2025-11-21 cs.CV 79%

VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement

VividFace: 高质量和高效的一步扩散用于视频面部增强

Shulian Zhang, Yong Guo, Long Peng, Ziyang Wang, Ye Chen, Wenbo Li, Xiao Zhang, Yulun Zhang, Jian Chen

机构 * South China University of Technology(华南理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) Nanjing University of Science and Technology(南京理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

AI总结 VividFace通过单步扩散框架和联合训练策略,高效提升视频面部增强的高质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16047 2025-11-21 cs.CV 57%

AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive Transformers

AMS-KV: 多尺度视觉自回归变换器中的自适应KV缓存

Boxun Xu, Yu Wang, Zihu Wang, Peng Li

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

AI总结 AMS-KV通过自适应KV缓存策略提升多尺度视觉自回归变换器的生成质量和效率

详情

展开后加载摘要…

URL PDF HTML 收藏