arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-30 至 2025-09-30 共收录 8 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 8 篇

2506.06802 2025-09-30 cs.CV 88%

Training-Free Diffusion Framework for Stylized Image Generation with Identity Preservation

Mohammad Ali Rezaei, Helia Hajikazem, Saeed Khanehgir, Mahdi Javanmardi

机构 * Computer Vision Group, Part AI Research Center(部分人工智能研究中心计算机视觉组) Department of Computer Engineering, Amirkabir University of Technology(阿米卡比尔技术大学计算机工程系)

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04421 2025-09-30 cs.CV cs.AI cs.LG 79%

Disentangling Regional Primitives for Image Generation

Zhengting Chen, Lei Cheng, Lianghui Ding, Liang Lin, Quanshi Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23924 2025-09-30 cs.CL cs.AI 78%

Taming Masked Diffusion Language Models via Consistency Trajectory Reinforcement Learning with Fewer Decoding Step

Jingyi Yang, Guanxu Chen, Xuhao Hu, Jing Shao

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 个性化与一致性 :diffusion(title,abstract)

Comments 10 pages, 4 figures, 7 tables. Code: https://github.com/yjyddq/EOSER-ASS-RL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25058 2025-09-30 cs.GR cs.CV 62%

CharGen: Fast and Fluent Portrait Modification

Jan-Niklas Dihlmann, Arnela Killguss, Hendrik P. A. Lensch

机构 * University of Tübingen Germany(图宾根大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Project page: https://chargen.jdihlmann.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25172 2025-09-30 cs.CV cs.LG 57%

Personalized Vision via Visual In-Context Learning

Yuxin Jiang, Yuchao Gu, Yiren Song, Ivor Tsang, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) A*STAR, Singapore(新加坡科技研究局)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Project page: https://yuxinn-j.github.io/projects/PICO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24878 2025-09-30 cs.CV cs.RO 57%

ThermalGen: Style-Disentangled Flow-Based Generative Models for RGB-to-Thermal Image Translation

Jiuhong Xiao, Roshan Nayak, Ning Zhang, Daniel Tortei, Giuseppe Loianno

机构 * New York University(纽约大学) Technology Innovation Institute(技术创新研究所) University of California, Berkeley(加州大学伯克利分校)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments 23 pages including the checklist and appendix. Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23878 2025-09-30 cs.SD cs.AI cs.MM eess.AS 57%

Disentangling Score Content and Performance Style for Joint Piano Rendering and Transcription

Wei Zeng, Junchuan Zhao, Ye Wang

机构 * National University of Singapore(新加坡国立大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.MM

Comments 30 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10678 2025-09-30 cs.GR 57%

T2Bs: Text-to-Character Blendshapes via Video Generation

Jiahao Luo, Chaoyang Wang, Michael Vasilkovsky, Vladislav Shakhrai, Di Liu, Peiye Zhuang, Sergey Tulyakov, Peter Wonka, Hsin-Ying Lee, James Davis, Jian Wang

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏