arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-09 至 2025-09-09 共收录 70 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4 篇

2509.06217 2025-09-09 cond-mat.soft 50%

Multi-Scale Modeling and Predictive Control of Active Brownian Particles

Sadra Saremi, Amirhossein Ahmadkhan Kordbacheh

专题命中 可控生成 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06201 2025-09-09 cs.RO cs.AI cs.LG 50%

Grasp-MPC: Closed-Loop Visual Grasping via Value-Guided Model Predictive Control

Jun Yamada, Adithyavairavan Murali, Ajay Mandlekar, Clemens Eppner, Ingmar Posner, Balakumar Sundaralingam

机构 * Applied AI Lab, Oxford Robotics Institute, University of Oxford(应用人工智能实验室、牛津机器人研究所、牛津大学) NVIDIA, USA(NVIDIA公司)

专题命中 可控生成 :diffusion(abstract)

Comments 14 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像修复 4 篇

2504.16893 2025-09-09 cond-mat.mtrl-sci physics.comp-ph 82%

Crystal structure prediction with host-guided inpainting generation and foundation potentials

Peichen Zhong, Xinzhe Dai, Bowen Deng, Gerbrand Ceder, Kristin A. Persson

专题命中 图像修复 :inpainting(title,abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05787 2025-09-09 physics.flu-dyn cs.LG 78%

Vector-based loss functions for turbulent flow field inpainting

Samuel J. Baker, Shubham Goswami, Xiaohang Fang, Felix C. P. Leach

专题命中 图像修复 :inpainting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06413 2025-09-09 cs.CV eess.IV 57%

VQualA 2025 Challenge on Image Super-Resolution Generated Content Quality Assessment: Methods and Results

Yixiao Li, Xin Li, Chris Wei Zhou, Shuo Xing, Hadi Amirpour, Xiaoshuai Hao, Guanghui Yue, Baoquan Zhao, Weide Liu, Xiaoyuan Yang, Zhengzhong Tu, Xinyu Li, Chuanbiao Song, Chenqi Zhang, Jun Lan, Huijia Zhu, Weiqiang Wang, Xiaoyan Sun, Shishun Tian, Dongyang Yan, Weixia Zhang, Junlin Chen, Wei Sun, Zhihua Wang, Zhuohang Shi, Zhizun Luo, Hang Ouyang, Tianxin Xiao, Fan Yang, Zhaowang Wu, Kaixin Deng

机构 * Yixiao Li(* 李夕宵) Xin Li(* 李鑫) Chris Wei Zhou(* 周克里斯) Shuo Xing(* 熊朔) Hadi Amirpour(* 阿米尔普尔) Xiaoshuai Hao(* 郝晓帅) Guanghui Yue(* 袁广会) Baoquan Zhao(* 赵宝全) Weide Liu(* 刘伟德) Xiaoyuan Yang(* 杨晓元) Zhengzhong Tu(* 途正忠) Xinyu Li(* 李新宇) Chuanbiao Song(* 宋传标) Chenqi Zhang(* 张晨琪) Jun Lan(* 兰俊) Huijia Zhu(* 朱会佳) Weiqiang Wang(* 王伟强) Xiaoyan Sun(* 孙晓燕) Shishun Tian(* 天世顺) Dongyang Yan(* 严东阳) Weixia Zhang(* 张伟霞) Junlin Chen(* 陈军林) Wei Sun(* 孙伟) Zhihua Wang(* 王志强) Zhuohang Shi(* 史卓hang) Zhizun Luo(* 罗志军) Hang Ouyang(* 欧hang) Tianxin Xiao(* 肖天心) Fan Yang(* 杨帆) Zhaowang Wu(* 吴昭王) Kaixin Deng(* 邓凯欣)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

Comments 11 pages, 12 figures, VQualA ICCV Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01362 2025-09-09 stat.ML cs.LG 50%

Autoencoders in Function Space

Justin Bunker, Mark Girolami, Hefin Lambley, Andrew M. Stuart, T. J. Sullivan

机构 * Department of Engineering, University of Cambridge and Alan Turing Institute(剑桥大学工程系和艾伦·图灵研究所) Department of Engineering University of Cambridge(剑桥大学工程系) Mathematics Institute University of Warwick(沃里克大学数学系) Computing + Mathematical Sciences California Institute of Technology(加州理工学院计算与数学科学学院) Mathematics Institute & School of Engineering University of Warwick(沃里克大学数学系与工程学院)

专题命中 图像修复 :inpainting(abstract)

Comments 54 pages, 24 figures

Journal ref Journal of Machine Learning Research 26(165):1--54 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 2 篇

2509.05659 2025-09-09 cs.CV 88%

EditIDv2: Editable ID Customization with Data-Lubricated ID Feature Integration for Text-to-Image Generation

Guandong Li, Zhaobin Chu

机构 * iFlyTek(科大讯飞)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06818 2025-09-09 cs.CV cs.LG 57%

UMO: Scaling Multi-Identity Consistency for Image Customization via Matching Reward

Yufeng Cheng, Wenxu Wu, Shaojin Wu, Mengqi Huang, Fei Ding, Qian He

机构 * UXO Team, Intelligent Creation Lab, ByteDance(字节跳动智能创作实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Project page: https://bytedance.github.io/UMO/ Code and model: https://github.com/bytedance/UMO

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 2 篇

2507.16193 2025-09-09 cs.CV cs.MM 81%

LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs

Zitong Xu, Huiyu Duan, Bingnan Liu, Guangji Ma, Jiarui Wang, Liu Yang, Shiqi Gao, Xiaoyu Wang, Jia Wang, Xiongkuo Min, Guangtao Zhai, Weisi Lin

机构 * Institute of Image Communication and Network Engineering, Shanghai JiaoTong University(上海交通大学图像通信与网络工程研究所) University of Electronic and Science Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学)

专题命中 图像生成评测 :image editing(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13394 2025-09-09 cs.LG math.ST stat.ML stat.TH 50%

Flow-based generative models as iterative algorithms in probability space

Yao Xie, Xiuyuan Cheng

机构 * H. Milton Stewart School of Industrial and Systems Engineering (ISyE) at the Georgia Institute of Technology(佐治亚理工学院H.米尔顿·斯图尔特工业与系统工程学院) Mathematics Department at Duke University(杜克大学数学系)

专题命中 图像生成评测 :image generation(abstract)

Comments IEEE Signal Processing Magazine, Special Issue on The Mathematics of Deep Learning, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏