arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-13 至 2026-01-13 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 5 篇

2601.06605 2026-01-13 cs.CV 85%

Sissi: Zero-shot Style-guided Image Synthesis via Semantic-style Integration

Sissi:通过语义-风格整合实现零样本风格引导图像合成

Yingying Deng, Xiangyu He, Fan Tang, Weiming Dong, Xucheng Yin

专题命中 可控生成 :image synthesis(title);image generation(abstract);diffusion(abstract);inpainting(abstract)

AI总结 Sissi通过语义-风格整合实现零样本风格引导图像合成,采用上下文学习框架提升风格化效果与语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14031 2026-01-13 cs.CV 83%

FashionMAC: Deformation-Free Fashion Image Generation with Fine-Grained Model Appearance Customization

FashionMAC: 无变形的时尚图像生成与细粒度模型外观定制

Rong Zhang, Jinxiao Li, Jingnan Wang, Zhiwen Zuo, Jianfeng Dong, Wei Li, Chi Wang, Weiwei Xu, Xun Wang

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 FashionMAC通过无变形的扩散框架实现高质量可控的时尚图像生成,采用RADA机制和链式掩码注入策略提升细粒度外观可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06823 2026-01-13 cs.HC 78%

Generative Modeling of Human-Computer Interfaces with Diffusion Processes and Conditional Control

基于扩散过程和条件控制的人机界面生成模型

Rui Liu, Liuqingqing Yang, Runsheng Zhang, Shixiao Wang

专题命中 可控生成 :diffusion(title,abstract)

AI总结 本文提出基于扩散过程和条件控制的界面生成模型,通过整合用户意图和任务约束,提升界面生成的多样性、合理性和智能化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07660 2026-01-13 cs.CV 57%

StdGEN++: A Comprehensive System for Semantic-Decomposed 3D Character Generation

StdGEN++: 一种用于语义分解3D人物生成的综合性系统

Yuze He, Yanning Zhou, Wang Zhao, Jingwen Ye, Zhongkai Wu, Ran Yi, Yong-Jin Liu

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Tencent AIPD(腾讯AIPD) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 StdGEN++是一种基于双分支语义感知模型的综合性系统,通过语义分解和高效生成技术,实现高保真3D人物生成,适用于自动化角色资产生产。

Comments 13 pages, 12 figures. Extended version of CVPR 2025 paper arXiv:2411.05738

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06049 2026-01-13 cs.CY cs.AI 50%

The Violation State: Safety State Persistence in a Multimodal Language Model Interface

违规状态:多模态语言模型接口中的安全状态持续

Bentley DeVilling

专题命中 可控生成 :image generation(abstract)

AI总结 研究发现多模态语言模型在面对版权拒绝后,会持续拒绝无关图像生成请求,揭示了会话级安全状态的持续性问题。

Comments 19 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏