arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-25 至 2026-08-25 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 5 篇

2608.22780 2026-08-25 cs.CV 新提交 83%

Can We Perform Online RL for Image Editing without Editing Rewards?

我们能否在无编辑奖励的情况下进行图像编辑的在线强化学习?

Qichao Ma, Jikang Cheng, Ling Liang, Zhaofei Yu, Tiejun Huang, Renye Yan

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出Lever-Edit框架,将文本到图像(T2I)奖励生态系统迁移至图像编辑,在无编辑奖励的情况下优化编辑策略,实验效果优于直观迁移基线且接近基于编辑奖励的微调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24844 2026-08-25 cs.CV 版本更新 79%

Bridging the Manifold Gap: Riemannian Residual Line Search for One-Step Image Editing

弥合流形差距:黎曼残差线搜索用于一步图像编辑

Hongzhu Yi, Zhongtian Luo, Tong Li, Yiyan Fan, Jungang Xu

机构 * UCAS(中国科学院大学) WashU(华盛顿大学) SHU(上海大学)

专题命中 图像编辑 :image editing(title);diffusion(abstract);分类 cs.CV

AI总结 针对一步扩散编辑中固定更新强度无法兼顾目标提示和源图像保真度的问题,提出黎曼残差线搜索方法,通过局部时间曲率估计和残差路径选择,在PIE-Bench++上达到SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23024 2026-08-25 cs.CV 新提交 70%

When the Edit Changes the Patient: Measuring Identity Preservation in Counterfactual Retinal Images

当编辑改变患者时:在反事实视网膜图像中测量身份保留情况

Andrea Posada, Wenke Karbole, Bach Ngoc Doan, Alexander Weers, Solmaz Abdolrahimzadeh, Maria Patsiamanidi, Kahkashan Haider, Vaishali Khare, Daniel Rueckert, Andrew Lotery, Sobha Sivaprasad, Martin J. Menten

机构 * Technical University of Munich(慕尼黑工业大学) TUM University Hospital(慕尼黑工业大学医院) Munich Center of Machine Learning (MCML)(慕尼黑机器学习中心) Munich Data Science Institute (MDSI)(慕尼黑数据科学研究所) Sapienza University of Rome(罗马第一大学) Faculty of Medicine, University of Southampton(南安普顿大学医学院) Moorfields Eye Hospital NHS Foundation Trust(摩尔菲尔兹眼科医院NHS信托基金) Imperial College London(伦敦帝国学院)

专题命中 图像编辑 :image generation(abstract);image editing(abstract);分类 cs.CV

AI总结 本研究针对视网膜OCT图像,用裁判分类器等方法对比三类文本条件编辑方法的身份保留效果,发现配对训练法身份保留最佳,建议未来医学反事实生成需明确报告身份保留情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09130 2026-08-25 cs.GR cs.CV cs.MM 版本更新 67%

Reference-free Human-Object Interaction Editing

无参考的人机交互编辑

Jiun Tian Hoe, Weipeng Hu, Wei Zhou, Chao Xie, Ziwei Wang, Xudong Jiang, Yap-Peng Tan, Chee Seng Chan

专题命中 图像编辑 :image editing(abstract);分类 cs.CV、cs.GR、cs.MM

AI总结 本文提出InteractEdit框架,通过分解场景组件、结合选择性反转与SeRA策略实现无参考HOI编辑,引入IEBench基准及对应指标,实验显示其优于23种现有方法,为HOI编辑研究提供强基线。

Comments Website: this https URL (https://jiuntian.github.io/interactedit), Paper: this https URL (https://www.sciencedirect.com/science/article/abs/pii/S0925231226022678)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21776 2026-08-25 cs.CV 新提交 57%

SpatialDiff: 3D-Aware Object Movement via Implicit Spatial Modeling

SpatialDiff:基于隐式空间建模的三维感知物体运动

Zheng Liu, Zijian He, Huiguo He, Weizhi Zhong, Yejun Tang, Huan Yang, Kun Gai, Guanbin Li

机构 * Sun Yat-sen University(中山大学) South China University of Technology(华南理工大学) Kuaishou Technology(快手科技) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 SpatialDiff通过隐式三维空间建模和全局空间监督,解决了现有图像编辑方法难以处理复杂场景中物体空间运动的问题,提升了空间运动的准确性与保真度。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏