arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-21 至 2025-10-21 共收录 115 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 10 篇

2510.17105 2025-10-21 cs.CV 79%

Boosting Fidelity for Pre-Trained-Diffusion-Based Low-Light Image Enhancement via Condition Refinement

Xiaogang Xu, Jian Wang, Yunfan Lu, Ruihang Chu, Ruixing Wang, Jiafei Wu, Bei Yu, Liang Lin

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程系,香港中文大学) Snap Research HKUST (GZ)(香港科技大学(广州)) Alibaba Tongyi Lab(阿里云联合实验室) camera group of DJI(大疆创新相机团队) The University of Hong Kong(香港大学) Sun Yat-Sen University(中山大学)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16772 2025-10-21 cs.CV cs.AI 79%

Region in Context: Text-condition Image editing with Human-like semantic reasoning

Thuy Phuong Vu, Dinh-Cuong Hoang, Minhhuy Le, Phan Xuan Tan

机构 * Greenwich Vietnam FPT University(越南格林威治FPT大学)

专题命中 可控生成 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15874 2025-10-21 cs.GR 79%

Sketch-based Fluid Video Generation Using Motion-Guided Diffusion Models in Still Landscape Images

Hao Jin, Haoran Xie

专题命中 可控生成 :diffusion(title,abstract);分类 cs.GR

Comments 2 pages, 5 figures. SIGGRAPH 2025 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17122 2025-10-21 cs.LG math.OC 78%

Continuous Q-Score Matching: Diffusion Guided Reinforcement Learning for Continuous-Time Control

Chengxiu Hua, Jiawen Gu, Yushun Tang

机构 * Southern University of Science and Technology(南方科技大学) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 可控生成 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16833 2025-10-21 cs.CV cs.GR 62%

From Mannequin to Human: A Pose-Aware and Identity-Preserving Video Generation Framework for Lifelike Clothing Display

Xiangyu Mu, Dongliang Zhou, Jie Hou, Haijun Zhang, Weili Guan

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15873 2025-10-21 cs.GR 57%

Two-Stage Sketch-Based Smoke Illustration Generation using Stream Function

Hengyuan Chang, Xiaoxuan Xie, Syuhei Sato, Haoran Xie

专题命中 可控生成 :diffusion(abstract);分类 cs.GR

Comments 3 pages, 4 figures. SIGGRAPH 2025 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10780 2025-10-21 cs.CV 57%

MaskControl: Spatio-Temporal Control for Masked Motion Synthesis

Ekkasit Pinyoanuntapong, Muhammad Usama Saleem, Korrawe Karunratanakul, Pu Wang, Hongfei Xue, Chen Chen, Chuan Guo, Junli Cao, Jian Ren, Sergey Tulyakov

机构 * University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校) ETH Zürich(苏黎世联邦理工学院) University of Central Florida(中央佛罗里达大学) Snap Inc.(Snap公司)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Camera Ready Version. ICCV2025 (Oral). Change name from ControlMM to MaskControl. project page https://exitudio.github.io/ControlMM-page

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22520 2025-10-21 eess.SY cs.SY 50%

Multi-stage model predictive control for slug flow crystallizers using uncertainty-aware surrogate models

Collin R. Johnson, Stijn de Vries, Kerstin Wohlgemuth, Sergio Lucia

专题命中 可控生成 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16399 2025-10-21 math.NA cs.NA cs.SY eess.SY math.OC 50%

Iterative solvers for partial differential equations with dissipative structure: Operator preconditioning and optimal control

Volker Mehrmann, Manuel Schaller, Martin Stoll

专题命中 可控生成 :diffusion(abstract)

Comments 26 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16035 2025-10-21 cs.LG cs.AI cs.CR 50%

RoBCtrl: Attacking GNN-Based Social Bot Detectors via Reinforced Manipulation of Bots Control Interaction

Yingguang Yang, Xianghua Zeng, Qi Wu, Hao Peng, Yutong Xia, Hao Liu, Bin Chong, Philip S. Yu

机构 * University of Science and Technology of China(科学技术大学) Beihang University(北京航空航天大学) National University of Singapore(国立新加坡大学) Peking University(北京大学) University of Illinois Chicago(伊利诺伊大学香槟分校) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-拉德克利夫研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕尔默研究实验室)

专题命中 可控生成 :diffusion(abstract)

Comments 27 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像修复 2 篇

2508.12808 2025-10-21 nlin.PS 78%

Visual-Neural-Inspired Image Inpainting for Specific Objects-of-Interest Imaging

Yonghao Wu, Chang Liu, Vladimir Filaretov, Dmitry Yukhimets

专题命中 图像修复 :inpainting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16179 2025-10-21 cs.CV 57%

Cost Savings from Automatic Quality Assessment of Generated Images

Xavier Giro-i-Nieto, Nefeli Andreou, Anqi Liang, Manel Baradad, Francesc Moreno-Noguer, Aleix Martinez

机构 * Amazon(亚马逊)

专题命中 图像修复 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 2 篇

2510.16791 2025-10-21 cs.CV 70%

Personalized Image Filter: Mastering Your Photographic Style

Chengxuan Zhu, Shuchen Weng, Jiacong Fang, Peixuan Zhang, Si Li, Chao Xu, Boxin Shi

机构 * State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(国家通用人工智能重点实验室,智能科学与技术学院,北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) State Key Laboratory of Multimedia Information Processing and National Engineering Research Center of Visual Technology, School of Computer Science, Peking University(多媒体信息处理国家重点实验室和视觉技术国家工程研究中心,计算机科学学院,北京大学) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(人工智能学院,北京邮电大学)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16332 2025-10-21 cs.CV 57%

TokenAR: Multiple Subject Generation via Autoregressive Token-level enhancement

Haiyue Sun, Qingdong He, Jinlong Peng, Peng Tang, Jiangning Zhang, Junwei Zhu, Xiaobin Hu, Shuicheng Yan

机构 * National University of Singapore(新加坡国立大学) Tencent Youtu Lab(腾讯优图实验室)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 3 篇

2502.06023 2025-10-21 cs.CV 83%

Dual Caption Preference Optimization for Diffusion Models

Amir Saeidi, Yiran Luo, Agneet Chatterjee, Shamanthak Hegde, Bimsara Pathiraja, Yezhou Yang, Chitta Baral

机构 * School of Computing and Augmented Intelligence(计算与增强智能学院) Arizona State University(亚利桑那州立大学)

专题命中 图像生成评测 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07076 2025-10-21 cs.CV cs.AI 79%

NFIG: Multi-Scale Autoregressive Image Generation via Frequency Ordering

Zhihao Huang, Xi Qiu, Yukuo Ma, Yifu Zhou, Junjie Chen, Hongyuan Zhang, Chi Zhang, Xuelong Li

机构 * TeleAI, China Telecom(TeleAI,中国电信) Northwest Polytechnical University(西北工业大学) University of Hong Kong(香港大学) Beihang University(北京航空航天大学)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments 10 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12335 2025-10-21 cs.CV cs.CR 70%

Is Artificial Intelligence Generated Image Detection a Solved Problem?

Ziqiang Li, Jiazhen Yan, Ziwen He, Kai Zeng, Weiwei Jiang, Lizhi Xiong, Zhangjie Fu

机构 * School of Computer Science, Nanjing University of Information Science and Technology(南京信息工程大学计算机学院) University of Siena(锡耶纳大学)

专题命中 图像生成评测 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2025 Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 6 篇

2510.16983 2025-10-21 cs.CV cs.AI cs.LG 85%

One-step Diffusion Models with Bregman Density Ratio Matching

Yuanzhi Zhu, Eleftherios Tsonis, Lucas Degeorge, Vicky Kalogeiton

机构 * LIX, École Polytechnique, CNRS, IPP(巴黎政治学院LIX研究所,法国国家科学研究中心,IPP) LIGM, École Nationale des Ponts et Chaussées, CNRS, IPP(巴黎综合理工学院LIGM研究所,法国国家科学研究中心,IPP)

专题命中 效率与蒸馏 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16326 2025-10-21 cs.CV cs.LG 83%

DiffusionX: Efficient Edge-Cloud Collaborative Image Generation with Multi-Round Prompt Evolution

Yi Wei, Shunpu Tang, Liang Zhao, Qiangian Yang

机构 * College of Information Science(信息科学学院) Electronic Engineering, Zhejiang University, Hangzhou, China(电子工程,浙江大学,杭州,中国)

专题命中 效率与蒸馏 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09012 2025-10-21 cs.CV 79%

Towards Better & Faster Autoregressive Image Generation: From the Perspective of Entropy

Xiaoxiao Ma, Feng Zhao, Pengyang Ling, Haibo Qiu, Zhixiang Wei, Hu Yu, Jie Huang, Zhixiong Zeng, Lin Ma

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 效率与蒸馏 :image generation(title,abstract);分类 cs.CV

Comments Code is available at https://github.com/krennic999/ARsample

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00537 2025-10-21 eess.IV cs.CV cs.LG 57%

Accelerating MRI with Longitudinally-informed Latent Posterior Sampling

Yonatan Urman, Zachary Shah, Ashwin Kumar, Bruno P. Soares, Kawin Setsompop

机构 * Electrical Engineering , Stanford University , California , USA(电气工程,斯坦福大学,加利福尼亚,美国) Radiology , Stanford University , California , USA(放射学,斯坦福大学,加利福尼亚,美国)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15897 2025-10-21 cs.LG cs.AI stat.ML 50%

ReDi: Rectified Discrete Flow

Jaehoon Yoo, Wonjung Kim, Seunghoon Hong

专题命中 效率与蒸馏 :image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06535 2025-10-21 cs.AI cs.LG stat.ML 50%

Online Feedback Efficient Active Target Discovery in Partially Observable Environments

Anindya Sarkar, Binglin Ji, Yevgeniy Vorobeychik

专题命中 效率与蒸馏 :diffusion(abstract)

Comments 31 pages, 28 figures, Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他图像生成 2 篇

2510.03308 2025-10-21 cs.GR cs.AI cs.CV 62%

Creative synthesis of kinematic mechanisms

Jiong Lin, Jialong Ning, Judah Goldfeder, Hod Lipson

机构 * Creative Machines Lab, Columbia University(创意机器实验室,哥伦比亚大学)

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV、cs.GR

Comments 6pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17657 2025-10-21 cs.CV 57%

Attention (as Discrete-Time Markov) Chains

Yotam Erel, Olaf Dünkel, Rishabh Dabral, Vladislav Golyanik, Christian Theobalt, Amit H. Bermano

机构 * Tel Aviv University(特拉维夫大学) MPI for Informatics, SIC(信息学研究所)

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments NeurIPS 2025. Project page: https://yoterel.github.io/attention_chains/

详情

展开后加载摘要…

URL PDF HTML 收藏