arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-05 至 2026-01-05 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 2 篇

2512.23245 2026-01-05 cs.CV 70%

ASemConsist: Adaptive Semantic Feature Control for Training-Free Identity-Consistent Generation

ASemConsist: 基于自适应语义特征控制的无训练身份一致生成

Shin Seong Kim, Minjung Shin, Hyunin Cho, Youngjung Uh

机构 * Yonsei University(延世大学)

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 ASemConsist通过自适应语义特征控制实现无训练身份一致生成,提升文本到图像生成的一致性和对齐性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23537 2026-01-05 cs.CV cs.AI 57%

AnyMS: Bottom-up Attention Decoupling for Layout-guided and Training-free Multi-subject Customization

AnyMS: 从下到上注意力解耦用于布局引导和无训练多主体定制

Binhe Yu, Zhen Wang, Kexin Li, Yuqian Yuan, Wenqiao Zhang, Long Chen, Juncheng Li, Jun Xiao, Yueting Zhuang

机构 * Zhejiang University(浙江大学) HKUST(香港科技大学) Zhejiang Tobacco Monopoly Administration(浙江烟草专卖局)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 AnyMS通过从下到上的双层注意力解耦机制,实现无训练的布局引导多主体定制,有效解决文本对齐、主体身份保持和布局控制的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏