arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-02 至 2025-12-02 共收录 9 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 9 篇

2510.21775 2025-12-02 cs.CV cs.AI eess.IV 88%

Face-MakeUpV2: Facial Consistency Learning for Controllable Text-to-Image Generation

Face-MakeUpV2:面向可控文本到图像生成的面部一致性学习

Dawei Dai, Yinxiu Zhou, Chenghang Li, Guolai Jiang, Chengfang Zhang

专题命中 可控生成 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

AI总结 Face-MakeUpV2通过引入3D面部渲染和全局面部特征通道,解决文本到图像生成中的面部属性泄露和物理一致性问题,实现更可控的面部生成。

Comments Some errors in the critical data presented in Table 1 and Table 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00075 2025-12-02 cs.CV eess.IV 85%

Adapter Shield: A Unified Framework with Built-in Authentication for Preventing Unauthorized Zero-Shot Image-to-Image Generation

Adapter Shield: 一种集成了认证机制的统一框架,用于防止未经授权的零样本图像到图像生成

Jun Jia, Hongyi Miao, Yingjie Zhou, Wangqiu Zhou, Jianbo Zhang, Linhan Cao, Dandan Zhu, Hua Yang, Xiongkuo Min, Wei Sun, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Shandong University(山东大学) Hefei University of Technology(合肥工业大学) East China Normal University(华东师范大学)

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 Adapter Shield通过集成认证机制的统一框架,防止未经授权的零样本图像生成,实现安全的图像访问控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12168 2025-12-02 cs.CV cs.GR 62%

Sketch-guided Cage-based 3D Gaussian Splatting Deformation

基于草图的基于笼子的3D高斯点扩散变形

Tianhao Xie, Noam Aigerman, Eugene Belilovsky, Tiberiu Popa

机构 * Concordia University(康科德大学) Université de Montréal(蒙特利尔大学) Mila(Mila研究院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 本文提出了一种基于草图的3D GS变形系统,结合笼子变形与神经雅可比场,实现对3D模型几何的精细控制,并通过实验展示其在静态模型动画化中的应用。

Comments 10 pages, 9 figures, accepted at WACV 26, project page: https://tianhaoxie.github.io/project/gs_deform/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01686 2025-12-02 cs.CV 57%

DreamingComics: A Story Visualization Pipeline via Subject and Layout Customized Generation using Video Models

DreamingComics: 通过主体和布局定制生成实现故事可视化管道

Patrick Kwon, Chen Chen

机构 * Center for Research in Computer Vision, University of Central Florida(计算机视觉研究中心,中央佛罗里达大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 DreamingComics通过结合视频模型和布局生成技术,实现了基于主体和布局定制的高效故事可视化方法,提升了角色一致性和风格相似性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12170 2025-12-02 cs.CV cs.AI 57%

Rethinking Multimodal Point Cloud Completion: A Completion-by-Correction Perspective

重新思考多模态点云补全:一种补全-修正视角

Wang Luo, Di Wu, Hengyuan Na, Yinlin Zhu, Miao Hu, Guocong Quan

机构 * Wang Luo, Di Wu, Hengyuan Na, Yinlin Zhu, Miao Hu, Guocong Quan(作者)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

AI总结 PGNet通过补全-修正范式,结合多阶段框架和双特征编码,实现更鲁棒的点云补全,提升重建精度与结构一致性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22643 2025-12-02 cs.CV 57%

SPIRAL: Semantic-Aware Progressive LiDAR Scene Generation and Understanding

SPIRAL: 基于语义的渐进式LiDAR场景生成与理解

Dekai Zhu, Yixuan Hu, Youquan Liu, Dongyue Lu, Lingdong Kong, Slobodan Ilic

机构 * Technical University of Munich(慕尼黑技术大学) Fudan University(复旦大学) National University of Singapore(新加坡国立大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 Spiral提出了一种基于范围视图的LiDAR扩散模型,能够同时生成深度、反射图像和语义地图,实现高效的3D场景生成与理解。

Comments NeurIPS 2025; 24 pages, 10 figures, 9 tables; Code at https://github.com/worldbench/SPIRAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07247 2025-12-02 eess.IV cs.CV cs.LG 57%

GuideGen: A Text-Guided Framework for Paired Full-torso Anatomy and CT Volume Generation

GuideGen: 一种基于文本引导的完整躯干解剖和CT体积生成框架

Linrui Dai, Rongzhao Zhang, Yongrui Yu, Xiaofan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 GuideGen通过文本引导生成完整躯干解剖和CT体积,提升医学影像数据合成效率与质量。

Comments accepted as AAAI 2026 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00355 2025-12-02 cs.CV 57%

SMamDiff: Spatial Mamba for Stochastic Human Motion Prediction

SMamDiff: 基于空间Mamba的随机人体运动预测

Junqiao Fan, Pengfei Liu, Haocong Rao

机构 * School of Computer Science, Nanyang Technological University(计算机科学学院,南洋理工大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 SMamDiff通过空间Mamba和余数-DCT编码提升随机人体运动预测的时空一致性,实现更高效且准确的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20706 2025-12-02 cond-mat.mtrl-sci 50%

Vacancy Engineering in Metals and Alloys

金属与合金中的空位工程

Sreenivas Raguraman, Homero Reyes Pulido, Christopher Hutchinson, Arun Devaraj, Marc H. Weber, Michael L. Falk, Timothy P. Weihs

专题命中 可控生成 :diffusion(abstract)

AI总结 本文探讨了通过空位工程优化金属和合金性能的方法,强调了空位在微观结构调控中的关键作用。

Comments 21 pages, 5 display items

详情

展开后加载摘要…

URL PDF HTML 收藏