arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-27 至 2025-11-27 共收录 8 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 8 篇

2511.21691 2025-11-27 cs.CV 85%

Canvas-to-Image: Compositional Image Generation with Multimodal Controls

画布到图像:利用多模态控制的组合图像生成

Yusuf Dalva, Guocheng Gordon Qian, Maya Goldenberg, Tsai-Shien Chen, Kfir Aberman, Sergey Tulyakov, Pinar Yanardag, Kuan-Chieh Jackson Wang

机构 * Snap Inc. UC Merced(加州大学默塞德分校) Virginia Tech(弗吉尼亚理工大学)

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 Canvas-to-Image通过统一框架整合多模态控制,提升图像生成的组合性和控制精度。

Comments 24 pages; webpage: https://snap-research.github.io/canvas-to-image/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21129 2025-11-27 cs.CV cs.GR 81%

CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion

通过统一多模态视频扩散实现可控视频生成

Dianbing Xi, Jiepeng Wang, Yuanzhi Liang, Xi Qiu, Jialun Liu, Hao Pan, Yuchi Huo, Rui Wang, Haibin Huang, Chi Zhang, Xuelong Li

机构 * State Key Laboratory of CAD&CG(计算机辅助设计与图形学国家重点实验室) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院) Tsinghua University(清华大学)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 CtrlVDiff通过统一多模态视频扩散模型,实现可控视频生成,支持多模态输入并提升生成的可控性和保真度。

Comments 27 pages, 18 figures, 9 tables. Project page: https://tele-ai.github.io/CtrlVDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02465 2025-11-27 cs.CV 79%

Towards Consistent and Controllable Image Synthesis for Face Editing

面向面部编辑的图像合成一致性与可控性研究

Mengting Wei, Tuomas Varanka, Yante Li, Xingxun Jiang, Huai-Qian Khor, Guoying Zhao

机构 * Center for Machine Vision and Signal Analysis, Faculty of Information Technology and Electrical Engineering, University of Oulu(机器视觉与信号分析中心,信息科技与电气工程学院,奥卢大学) Key Laboratory of Child Development and Learning Science of Ministry of Education, School of Biological Sciences and Medical Engineering, Southeast University(教育部儿童发展与学习科学重点实验室,生物科学与医学工程学院,东南大学)

专题命中 可控生成 :image synthesis(title);diffusion(abstract);分类 cs.CV

AI总结 RigFace通过结合SD模型和3D面部模型,实现面部图像的光照、表情和姿态可控,提升身份保持和图像真实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21024 2025-11-27 cs.CV 70%

CameraMaster: Unified Camera Semantic-Parameter Control for Photography Retouching

CameraMaster: 用于摄影修饰的统一相机语义-参数控制

Qirui Yang, Yang Yang, Ying Zeng, Xiaobin Hu, Bo Li, Huanjing Yue, Jingyu Yang, Peng-Tao Jiang

机构 * Tianjin University(天津大学) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司) NUS(国立大学)

专题命中 可控生成 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 CameraMaster通过统一相机感知框架实现精确摄影修饰,通过解耦相机指令和参数嵌入,提升多参数控制与语义-参数对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21146 2025-11-27 cs.MM cs.CV cs.SD 62%

AV-Edit: Multimodal Generative Sound Effect Editing via Audio-Visual Semantic Joint Control

AV-Edit: 通过音频-视觉语义联合控制实现多模态生成式声音效果编辑

Xinyue Guo, Xiaoran Yang, Lipan Zhang, Jianxuan Yang, Zhao Wang, Jian Luan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 AV-Edit通过联合利用视觉、音频和文本语义,实现多模态生成式声音效果编辑,提升音频编辑的精度和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21043 2025-11-27 cs.CV 57%

PG-ControlNet: A Physics-Guided ControlNet for Generative Spatially Varying Image Deblurring

PG-ControlNet:一种用于生成空间变化图像去模糊的物理引导ControlNet

Hakki Motorcu, Mujdat Cetin

机构 * 1 Computer Science Department, University of Rochester 2 Goergen Institute for Data Science \& AIS, University of Rochester Computer Engineering Department, University of Rochester

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 PG-ControlNet通过结合物理约束与生成模型,提升空间变化图像去模糊的物理准确性和感知真实感。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20784 2025-11-27 cs.CV 57%

One Patch is All You Need: Joint Surface Material Reconstruction and Classification from Minimal Visual Cues

一个补丁就够了:从最小的视觉线索联合表面材料重建与分类

Sindhuja Penchala, Gavin Money, Gabriel Marques, Samuel Wood, Jessica Kirschman, Travis Atkison, Shahram Rahimi, Noorbakhsh Amiri Golilarz

机构 * Department of Computer Science, The University of Alabama(计算机科学系,阿拉巴马大学)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

AI总结 SMARC通过单个补丁实现表面材料重建与分类,以应对稀疏视觉输入下的挑战,取得最佳性能。

Comments 9 pages,3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21469 2025-11-27 math.AP 50%

A Hamilton-Jacobi Framework in a Field-Road System with Unidirectional Advection under Wentzell-Type Boundary Condition

一个带有单向输运和Wentzell型边界条件的场-路系统中的Hamilton-Jacobi框架

Xinye Xiao, Haomin Huang

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种用于分析场-路系统中单向输运和Wentzell型边界条件的Hamilton-Jacobi框架,通过变分方法和数值模拟揭示了传播行为的临界转变。

详情

展开后加载摘要…

URL PDF HTML 收藏