arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-07 至 2025-11-07 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3 篇

2511.04112 2025-11-07 cs.CV 86%

SpatialLock: Precise Spatial Control in Text-to-Image Synthesis

Biao Liu, Yuanzhi Liang

机构 * The Sugon Group(神舟集团) TeleAI China Telecom(中国电信) Shanghai China(上海中国)

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);分类 cs.CV

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04650 2025-11-07 cs.LG cs.DC 67%

Revisiting Federated Fine-Tuning: A Single Communication Round is Enough for Foundation Models

Ziyao Wang, Bowei Tian, Yexiao He, Zheyu Shen, Guoheng Sun, Yuhan Liu, Luyang Liu, Meng Liu, Ang Li

机构 * University of Maryland, College Park(马里兰大学彭福分校) Queen Mary University of London(伦敦玛丽女王大学) Google DeepMind(谷歌DeepMind)

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01184 2025-11-07 cs.CV cs.LG 57%

Bridging Generative and Discriminative Noisy-Label Learning via Direction-Agnostic EM Formulation

Fengbei Liu, Chong Wang, Yuanhong Chen, Yuyuan Liu, Gustavo Carneiro

机构 * Cornell Tech(康奈尔科技) Cornell University(康奈尔大学) Department of Radiology, Stanford University(斯坦福大学放射科) Oxford University(牛津大学) Centre for Vision, Speech and Signal Processing (CVSSP), University of Surrey(视觉、语音和信号处理中心(CVSSP)、塞维利亚大学)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏