arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-09 至 2025-10-09 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 5 篇

2510.07217 2025-10-09 cs.CV cs.AI 83%

GenPilot: A Multi-Agent System for Test-Time Prompt Optimization in Image Generation

Wen Ye, Zhaocheng Liu, Yuwei Gui, Tingyu Yuan, Yunyue Su, Bowen Fang, Chaoyang Zhao, Qiang Liu, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所模式识别新实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Baichuan Inc.(北川公司) Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所基础模型研究中心) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 文生图 :image generation(title);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 30 pages, 21 figures, accepted to EMNLP 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06525 2025-10-09 cs.LG cs.CR 78%

Text-to-Image Models Leave Identifiable Signatures: Implications for Leaderboard Security

Ali Naseh, Anshuman Suri, Yuefeng Peng, Harsh Chaudhari, Alina Oprea, Amir Houmansadr

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Northeastern University(东北大学)

专题命中 文生图 :text-to-image(title,abstract)

Comments Accepted at Lock-LLM Workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15257 2025-10-09 cs.CV cs.LG 77%

RespoDiff: Dual-Module Bottleneck Transformation for Responsible & Faithful T2I Generation

Silpa Vadakkeeveetil Sreelatha, Sauradip Nag, Muhammad Awais, Serge Belongie, Anjan Dutta

机构 * University of Surrey(塞雷尔大学) Simon Fraser University(西蒙弗雷泽大学) University of Copenhagen(哥本哈根大学)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06827 2025-10-09 cs.CV 77%

StyleKeeper: Prevent Content Leakage using Negative Visual Query Guidance

Jaeseok Jeong, Junho Kim, Gayoung Lee, Yunjey Choi, Youngjung Uh

机构 * Yonsei University(延世大学) NAVER AI Lab(NAVER AI实验室)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to ICCV 2025; CVPRW AI4CC 2024 (Best Paper + Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06664 2025-10-09 cs.CL 67%

ToolMem: Enhancing Multimodal Agents with Learnable Tool Capability Memory

Yunzhong Xiao, Yangmin Li, Hewei Wang, Yunlong Tang, Zora Zhiruo Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Rochester(罗切斯特大学)

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏