arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-21 至 2026-01-21 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 4 篇

2601.13846 2026-01-21 cs.AI cs.CY cs.LG 78%

Virtual Urbanism: An AI-Driven Framework for Quantifying Urban Identity. A Tokyo-Based Pilot Study Using Diffusion-Generated Synthetic Environments

虚拟城市主义:一种基于AI的量化城市身份框架。以东京为基础的试点研究,使用扩散生成的合成环境

Glinskaya Maria

专题命中 个性化与一致性 :diffusion(title,abstract)

AI总结 本文提出虚拟城市主义框架,利用AI生成合成环境量化城市身份,通过东京试点研究验证其有效性,揭示核心身份形成元素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12895 2026-01-21 cs.CV cs.LG 57%

TwoHead-SwinFPN: A Unified DL Architecture for Synthetic Manipulation, Detection and Localization in Identity Documents

TwoHead-SwinFPN:一种统一的深度学习架构,用于身份文档中的合成操纵、检测和定位

Chan Naseeb, Adeel Ashraf Cheema, Hassan Sami, Tayyab Afzal, Muhammad Omair, Usman Habib

机构 * IBM Germany(IBM德国分公司) FAST NUCES(FAST努赛斯大学) Askolay Pakistan(Askolay巴基斯坦)

专题命中 个性化与一致性 :inpainting(abstract);分类 cs.CV

AI总结 TwoHead-SwinFPN通过双头架构和Swin Transformer结合FPN与Unet解码器,实现身份文档中合成操纵的高效检测与定位,具有高精度和计算效率。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13861 2026-01-21 cs.CV 57%

PositionIC: Unified Position and Identity Consistency for Image Customization

PositionIC: 统一的位置和身份一致性用于图像定制

Junjie Hu, Tianyang Han, Kai Ma, Jialin Gao, Song Yang, Xianhua He, Junfeng Luo, Xiaoming Wei, Wenqiang Zhang

机构 * MeiGen AI Team, Meituan(美团MeiGen AI团队) Shanghai Key Lab of Intelligent Information Processing, College of Computer Science and Artificial Intelligence, Fudan University(上海智能信息处理关键实验室,计算机科学与人工智能学院,复旦大学) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 PositionIC通过统一框架实现高保真、空间可控的多主体图像定制,引入BMPDS数据合成和可视化感知注意力机制,提升空间精度与身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11635 2026-01-21 cs.CV 57%

Now You See Me, Now You Don't: A Unified Framework for Expression Consistent Anonymization in Talking Head Videos

现在你看见了,现在你又看不见:一种用于说话头视频中表达一致匿名化的统一框架

Anil Egin, Andrea Tangherloni, Antitza Dantcheva

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 Anon-NET通过基于扩散的生成模型和视频驱动动画,实现说话头视频中表达一致的匿名化,同时保留视觉真实性和时间一致性。

Journal ref Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) Workshops, IEEE/CVF, Oct 2025, Hawaii-Honolulu, United States. pp.5925-5934

详情

展开后加载摘要…

URL PDF HTML 收藏