arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-25 至 2026-08-25 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 图像修复 2 篇

2606.06158 2026-08-25 cs.CV 版本更新 79%

Adaptive Tokenisation Via Temporal Redundancy Masking And Latent Inpainting

通过时间冗余掩码和潜在修复的自适应分词

Kevin Dave, Sai Aditya Patkuri, Chhaya Kumar Das, Gouranga Bala, Rajeshkumar SA, R. Venkatesh Babu

机构 * Phronetic AI IISc Bangalore IIT Bombay

专题命中 图像修复 :inpainting(title,abstract);分类 cs.CV

AI总结 提出一种无参数的自适应视频分词机制,利用冻结连续分词器的潜在空间中的时间冗余,通过阈值丢弃冗余位置,并使用轻量级潜在修复变压器重建,实现内容驱动的令牌分配和高效推理。

Comments Accepted at BMVC 2026. Project page: this https URL (https://apatkuri.github.io/adaptive-tokenisation-bmvc-2026/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24136 2026-08-25 cs.CV eess.IV 版本更新 79%

Bridging Restoration and Generation in One-step Diffusion for Real-World Image Super-Resolution

连接恢复与生成流形的单步扩散在现实世界超分辨率中的应用

Shyang-En Weng, Yi-Cheng Liao, Yu-Syuan Xu, Chia-Hung Yuan, Wei-Chen Chiu, Ching-Chun Huang

机构 * National Yang Ming Chiao Tung University, Hsinchu, Taiwan MediaTek Inc., Taiwan

专题命中 图像修复 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出IDaS-SR框架,通过Manifold Inversion Noise Estimator和CHARIOT机制,解决单步扩散中恢复与生成流形的匹配问题,提升现实世界超分辨率的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏