arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-19 至 2026-01-19 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2506.12198 2026-01-19 cs.CV 88%

ViSTA: Visual Storytelling using Multi-modal Adapters for Text-to-Image Diffusion Models

ViSTA: 基于多模态适配器的文本到图像扩散模型用于视觉叙事

Sibo Dong, Ismail Shaheen, Maggie Shen, Rupayan Mallick, Sarah Adel Bargal

机构 * Department of Computer Science, Georgetown University(计算机科学系,乔治城大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 ViSTA通过多模态历史适配器提升文本到图像扩散模型在视觉叙事中的生成一致性与文本对齐能力。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10803 2026-01-19 cs.CR cs.AI cs.CV 70%

Beyond Known Fakes: Generalized Detection of AI-Generated Images via Post-hoc Distribution Alignment

超越已知伪造:通过事后分布对齐实现AI生成图像的通用检测

Li Wang, Wenyu Chen, Xiangtao Meng, Zheng Li, Shanqing Guo

机构 * School of Cyber Science and Technology, Shandong University(网络安全科学与技术学院,山东大学) State Key Laboratory of Cryptography and Digital Economy Security, Shandong University(密码与数字经济安全国家重点实验室,山东大学) Shandong Key Laboratory of Artificial Intelligence Security, Shandong University(人工智能安全山东省重点实验室,山东大学)

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出PDA框架,通过事后分布对齐实现对未知生成器AI图像的通用检测,实验显示其在16种生成模型上的检测准确率达96.69%。

详情

展开后加载摘要…

URL PDF HTML 收藏