arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-04 至 2025-11-04 共收录 123 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 5 篇

2511.01517 2025-11-04 cs.CV 89%

NSYNC: Negative Synthetic Image Generation for Contrastive Training to Improve Stylized Text-To-Image Translation

Serkan Ozturk, Samet Hicsonmez, Pinar Duygulu

机构 * Dept. of Computer Engineering, Hacettepe University(计算机工程系,哈切特佩大学) University of Luxembourg(卢森堡大学)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00686 2025-11-04 cs.CV cs.AI 83%

Evolve to Inspire: Novelty Search for Diverse Image Generation

Alex Inch, Passawis Chaiyapattanaporn, Yuchen Zhu, Yuan Lu, Ting-Wen Ko, Davide Paglieri

机构 * University College London(伦敦大学学院) University of Oxford(牛津大学) Tesco Technology(百事科技) Microsoft Research(微软研究院)

专题命中 文生图 :image generation(title);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 14 pages, 10 figures, Accepted to Neurips 2025 GenProCC Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21478 2025-11-04 cs.CV cs.AI 83%

Policy Optimized Text-to-Image Pipeline Design

Uri Gadot, Rinon Gal, Yftah Ziser, Gal Chechik, Shie Mannor

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00159 2025-11-04 cs.CV 57%

SonarSplat: Novel View Synthesis of Imaging Sonar via Gaussian Splatting

Advaith V. Sethuraman, Max Rucker, Onur Bagoren, Pou-Chun Kung, Nibarkavi N. B. Amutha, Katherine A. Skinner

机构 * Department of Robotics, University of Michigan(机器人学系,密歇根大学)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01163 2025-11-04 cs.CV 57%

ROVER: Benchmarking Reciprocal Cross-Modal Reasoning for Omnimodal Generation

Yongyuan Liang, Wei Chow, Feng Li, Ziqiao Ma, Xiyao Wang, Jiageng Mao, Jiuhai Chen, Jiatao Gu, Yue Wang, Furong Huang

机构 * University of Maryland, College Park(马里兰大学学院公园分校) University of Pennsylvania(宾夕法尼亚大学) The Hong Kong University of Science and Technology(香港科学与技术大学) University of Michigan(密歇根大学) University of Southern California(南加州大学)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

Comments Project Page: https://roverbench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 2 篇

2504.12704 2025-11-04 cs.CV cs.MM 86%

SmartFreeEdit: Mask-Free Spatial-Aware Image Editing with Complex Instruction Understanding

Qianqian Sun, Jixiang Luo, Dell Zhang, Xuelong Li

机构 * Institute of Artificial Intelligence(TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) The University of Hongkong(香港大学)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00143 2025-11-04 cs.CV 70%

BlurGuard: A Simple Approach for Robustifying Image Protection Against AI-Powered Editing

Jinsu Kim, Yunhun Nam, Minseon Kim, Sangpil Kim, Jongheon Jeong

机构 * Korea University(韩国大学) Microsoft Research Montréal(微软蒙特利尔研究院)

专题命中 图像编辑 :text-to-image(abstract);image editing(abstract);分类 cs.CV

Comments 36 pages; NeurIPS 2025; Code is available at https://github.com/jsu-kim/BlurGuard

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 92 篇

2502.03491 2025-11-04 eess.IV 89%

LanPaint: Training-Free Diffusion Inpainting with Asymptotically Exact and Fast Conditional Sampling

Candi Zheng, Yuan Lan, Yang Wang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01645 2025-11-04 cs.CV 83%

Enhancing Diffusion-based Restoration Models via Difficulty-Adaptive Reinforcement Learning with IQA Reward

Xiaogang Xu, Ruihang Chu, Jian Wang, Kun Zhou, Wenjie Shu, Harry Yang, Ser-Nam Lim, Hao Chen, Liang Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) Snap Research Shenzhen University(深圳大学) HKUST(香港科技大学) University of Central Florida(佛罗里达大学) UC Davis(加州大学戴维斯分校) Sun Yat-Sen University(孙中山大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01466 2025-11-04 cs.CV 83%

SecDiff: Diffusion-Aided Secure Deep Joint Source-Channel Coding Against Adversarial Attacks

Changyuan Zhao, Jiacheng Wang, Ruichen Zhang, Dusit Niyato, Hongyang Du, Zehui Xiong, Dong In Kim, Ping Zhang

机构 * College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Department of Electrical and Electronic Engineering, University of Hong Kong(电子与电气工程系,香港大学) School of Electronics, Electrical Engineering and Computer Science, Queen’s University Belfast(电子、电气工程与计算机科学学院,女王学院贝尔法斯特分校) Department of Electrical and Computer Engineering, Sungkyunkwan University(电气与计算机工程系,成均馆大学) State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications(网络与交换技术国家重点实验室,北京邮电大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07140 2025-11-04 cs.CV 83%

FIRE: Robust Detection of Diffusion-Generated Images via Frequency-Guided Reconstruction Error

Beilin Chu, Xuan Xu, Xin Wang, Yufei Zhang, Weike You, Linna Zhou

机构 * School of CyberSpace Security, Beijing University of Posts and Telecommunications(网络安全学院,北京邮电大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 14 pages, 14 figures. Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00429 2025-11-04 cs.CV cs.AI 83%

Enhancing Frequency Forgery Clues for Diffusion-Generated Image Detection

Daichi Zhang, Tong Zhang, Shiming Ge, Sabine Süsstrunk

机构 * School of Computer and Communication Sciences, EPFL(瑞士联邦理工学院计算机与通信科学学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10978 2025-11-04 cs.CV cs.AI cs.LG 83%

Where and How to Perturb: On the Design of Perturbation Guidance in Diffusion and Flow Models

Donghoon Ahn, Jiwon Kang, Sanghyun Lee, Minjae Kim, Jaewon Min, Wooseok Jang, Sangwu Lee, Sayak Paul, Susung Hong, Seungryong Kim

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted at NeurIPS 2025. Project page: https://cvlab-kaist.github.io/HeadHunter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17955 2025-11-04 cs.CV 83%

Diffusion Classifiers Understand Compositionality, but Conditions Apply

Yujin Jeong, Arnas Uselis, Seong Joon Oh, Anna Rohrbach

机构 * TU Darmstadt(图恩大学) University of Tübingen(图宾根大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments NeurIPS 2025 Datasets and Benchmarks

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12245 2025-11-04 cs.CV 83%

Scalable Autoregressive Image Generation with Mamba

Haopeng Li, Jinyue Yang, Kexin Wang, Xuerui Qiu, Yuhong Chou, Xin Li, Guoqi Li

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04687 2025-11-04 cs.CV cs.AI 83%

Targeted Attack Improves Protection against Unauthorized Diffusion Customization

Boyang Zheng, Chumeng Liang, Xiaoyu Wu

机构 * Shanghai Jiao Tong University(上海交通大学) University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments ICLR 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.12935 2025-11-04 cs.LG cs.AI cs.CV 83%

ERA-Solver: Error-Robust Adams Solver for Fast Sampling of Diffusion Probabilistic Models

Shengming Li, Luping Liu, Runnan Li, Xu Tan

机构 * Zhejiang University(浙江大学) Microsoft Azure Speech(微软Azure语音) Microsoft Research Asia(微软亚洲研究院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00011 2025-11-04 cs.CV cs.AI cs.HC 83%

Generative human motion mimicking through feature extraction in denoising diffusion settings

Alexander Okupnik, Johannes Schneider, Kyriakos Flouris

机构 * University of Liechtenstein(列支敦士登大学) University of Cambridge(剑桥大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08271 2025-11-04 cs.GR cs.CV cs.LG 81%

SViM3D: Stable Video Material Diffusion for Single Image 3D Generation

Andreas Engelhardt, Mark Boss, Vikram Voleti, Chun-Han Yao, Hendrik P. A. Lensch, Varun Jampani

机构 * Stability AI University of Tübingen(图宾根大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted by International Conference on Computer Vision (ICCV 2025). Project page: http://svim3d.aengelhardt.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01795 2025-11-04 cs.LG cs.AI cs.CV cs.RO stat.ML 79%

Fractional Diffusion Bridge Models

Gabriel Nobis, Maximilian Springenberg, Arina Belova, Rembert Daems, Christoph Knochenhauer, Manfred Opper, Tolga Birdal, Wojciech Samek

机构 * Fraunhofer HHI(弗劳恩霍夫研究所) Ghent University–imec FlandersMake–MIRO(根特大学–imec 荷兰弗拉芒Make–MIRO) Technical University of Munich(慕尼黑技术大学) Technical University of Berlin(柏林技术大学) University of Potsdam(波茨坦大学) University of Birmingham(伯明翰大学) Imperial College London(伦敦帝国理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments To appear in NeurIPS 2025 proceedings. This version includes post-camera-ready revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01704 2025-11-04 cs.CV 79%

Learnable Fractional Reaction-Diffusion Dynamics for Under-Display ToF Imaging and Beyond

Xin Qiao, Matteo Poggi, Xing Wei, Pengchao Deng, Yanhui Zhou, Stefano Mattoccia

机构 * Xi’an Jiaotong University(西安交通大学) University of Bologna(博洛尼亚大学) Anyang Institute of Technology(安阳职业技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01307 2025-11-04 cs.CV cs.AI 79%

Perturb a Model, Not an Image: Towards Robust Privacy Protection via Anti-Personalized Diffusion Models

Tae-Young Lee, Juwon Seo, Jong Hwan Ko, Gyeong-Moon Park

机构 * Korea University(韩国大学) Kyung Hee University(庆熙大学) Sungkyunkwan University(成均馆大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 26 pages, 9 figures, 16 tables, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13030 2025-11-04 cs.CV 79%

WildCAT3D: Appearance-Aware Multi-View Diffusion in the Wild

Morris Alper, David Novotny, Filippos Kokkinos, Hadar Averbuch-Elor, Tom Monnier

机构 * Tel Aviv University(特拉维夫大学) Meta AI Cornell University(康奈尔大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025. Project page: https://wildcat3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18932 2025-11-04 cs.CV 79%

ReviveDiff: A Universal Diffusion Model for Restoring Images in Adverse Weather Conditions

Wenfeng Huang, Guoan Xu, Wenjing Jia, Stuart Perry, Guangwei Gao

机构 * Faculty of Engineering and Information Technology, University of Technology Sydney(工程与信息技术学院,技术悉尼大学) PCA Lab, Key Lab of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, School of Computer Science and Engineering, Nanjing University of Science and Technology(智能感知与高维信息系统教育部重点实验室,计算机科学与工程学院,南京理工大学) Key Laboratory of Artificial Intelligence, Ministry of Education(人工智能教育部重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00858 2025-11-04 cs.CV cs.AI cs.LG 79%

Occlusion-Aware Diffusion Model for Pedestrian Intention Prediction

Yu Liu, Zhijie Liu, Zedong Yang, You-Fu Li, He Kong

机构 * Shenzhen Key Laboratory of Control Theory and Intelligent Systems, Southern University of Science and Technology (SUSTech)(控制理论与智能系统深圳重点实验室,南方科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments This manuscript has been accepted to the IEEE Transactions on Intelligent Transportation Systems as a regular paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00815 2025-11-04 cs.CV 79%

TA-LSDiff:Topology-Aware Diffusion Guided by a Level Set Energy for Pancreas Segmentation

Yue Gou, Fanghui Song, Yuming Xing, Shengzhu Shi, Zhichang Guo, Boying Wu

机构 * Department of Computational Mathematics, School of Mathematics, Harbin Institute of Technology(计算数学系,数学学院,哈尔滨工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00344 2025-11-04 cs.CV 79%

Federated Dialogue-Semantic Diffusion for Emotion Recognition under Incomplete Modalities

Xihang Qiu, Jiarong Cheng, Yuhao Fang, Wanpeng Zhang, Yao Lu, Ye Zhang, Chun Li

机构 * Shenzhen MSU-BIT University(深圳MSU-BIT大学) Beijing Institude of Technology(北京理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24770 2025-11-04 eess.IV cs.AI cs.CV 79%

DMVFC: Deep Learning Based Functionally Consistent Tractography Fiber Clustering Using Multimodal Diffusion MRI and Functional MRI

Bocheng Guo, Jin Wang, Yijie Li, Junyi Wang, Mingyu Gao, Puming Feng, Yuqian Chen, Jarrett Rushmore, Nikos Makris, Yogesh Rathi, Lauren J O'Donnell, Fan Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01161 2025-11-04 cs.LG cs.CV 79%

Split Gibbs Discrete Diffusion Posterior Sampling

Wenda Chu, Zihui Wu, Yifan Chen, Yang Song, Yisong Yue

机构 * California Institute of Technology(加州理工学院) New York University(纽约大学) OpenAI

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01276 2025-11-04 cs.RO 78%

Contact Map Transfer with Conditional Diffusion Model for Generalizable Dexterous Grasp Generation

Yiyao Ma, Kai Chen, Kexin Zheng, Qi Dou

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程系,香港中文大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏