arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-08 至 2025-10-08 共收录 61 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3 篇

2510.05593 2025-10-08 cs.CV cs.AI cs.CL 83%

Improving Chain-of-Thought Efficiency for Autoregressive Image Generation

Zeqi Gu, Markos Georgopoulos, Xiaoliang Dai, Marjan Ghazvininejad, Chu Wang, Felix Juefei-Xu, Kunpeng Li, Yujun Shi, Zecheng He, Zijian He, Jiawei Zhou, Abe Davis, Jialiang Wang

机构 * Meta Superintelligence Labs(Meta超智能实验室) Meta FAIR Cornell University(康奈尔大学) Stony Brook University(石溪大学)

专题命中 文生图 :image generation(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19378 2025-10-08 cs.CV cs.LG eess.IV 79%

Unified Cross-Modal Medical Image Synthesis with Hierarchical Mixture of Product-of-Experts

Reuben Dorent, Nazim Haouchine, Alexandra Golby, Sarah Frisken, Tina Kapur, William Wells

机构 * Harvard Medical School and the Brigham and Women’s Hospital(哈佛医学院和布里洛妇产科医院) MIND Team, Inria Saclay, Université Paris-Saclay, Palaiseau, France and Sorbonne Université, Institut du Cerveau - Paris Brain Institute - ICM, CNRS, Inria, Inserm, AP-HP, Hôpital de la Pitié Salpêtrière(MIND团队、Inria Saclay、巴黎萨克雷大学、Palaiseau,法国以及索邦大学、巴黎脑研究所-ICM、CNRS、Inria、Inserm、AP-HP、皮蒂埃萨勒普蒂耶医院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 文生图 :image synthesis(title,abstract);分类 cs.CV

Comments Accepted in IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05660 2025-10-08 cs.CV 70%

Teleportraits: Training-Free People Insertion into Any Scene

Jialu Gao, K J Joseph, Fernando De La Torre

机构 * Carnegie Mellon University(卡内基梅隆大学) Adobe Research(Adobe研究院)

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 3 篇

2510.05978 2025-10-08 cs.CV 88%

Diffusion-Based Image Editing for Breaking Robust Watermarks

Yunyi Ni, Finn Carter, Ze Niu, Emily Davis, Bo Zhang

专题命中 图像编辑 :diffusion(title,abstract);image editing(title);image generation(abstract);分类 cs.CV

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15031 2025-10-08 cs.CV 83%

AutoEdit: Automatic Hyperparameter Tuning for Image Editing

Chau Pham, Quan Dao, Mahesh Bhosale, Yunjie Tian, Dimitris Metaxas, David Doermann

机构 * University at Buffalo(布法罗大学) Rutgers University(罗格斯大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Provided code link

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18538 2025-10-08 cs.CV 57%

GeoRemover: Removing Objects and Their Causal Visual Artifacts

Zixin Zhu, Haoxiang Li, Xuelu Feng, He Wu, Chunming Qiao, Junsong Yuan

机构 * University at Buffalo(布法罗大学) Pixocial Technology(Pixocial科技)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted as Spotlight at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 42 篇

2510.05532 2025-10-08 cs.CV cs.GR cs.LG 86%

Teamwork: Collaborative Diffusion with Low-rank Coordination and Adaptation

Sam Sartor, Pieter Peers

机构 * College of William \& Mary Williamsburg USA College of William \& Mary

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12024 2025-10-08 cs.CV 83%

Robust Concept Erasure in Diffusion Models: A Theoretical Perspective on Security and Robustness

Zixuan Fu, Yan Ren, Finn Carter, Chenyue Wen, Le Ku, Daheng Yu, Emily Davis, Bo Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments updated version

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19252 2025-10-08 cs.CV 80%

Inference-Time Text-to-Video Alignment with Diffusion Latent Beam Search

Yuta Oshima, Masahiro Suzuki, Yutaka Matsuo, Hiroki Furuta

机构 * The University of Tokyo(东京大学) Google DeepMind(谷歌DeepMind)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to NeurIPS2025. Website: https://sites.google.com/view/t2v-dlbs and Code: https://github.com/shim0114/T2V-Diffusion-Search

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06131 2025-10-08 cs.CV cs.AI 79%

Discrete Diffusion Models with MLLMs for Unified Medical Multimodal Generation

Jiawei Mao, Yuhan Wang, Lifeng Chen, Can Zhao, Yucheng Tang, Dong Yang, Liangqiong Qu, Daguang Xu, Yuyin Zhou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 16 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05976 2025-10-08 cs.CV cs.AI cs.LG 79%

Diffusion Models for Low-Light Image Enhancement: A Multi-Perspective Taxonomy and Performance Analysis

Eashan Adhikarla, Yixin Liu, Brian D. Davison

机构 * Lehigh University(莱维大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20722 2025-10-08 cs.CV cs.LG 79%

A weakly-supervised deep learning model for fast localisation and delineation of the skeleton, internal organs, and spinal canal on Whole-Body Diffusion-Weighted MRI (WB-DWI)

A. Candito, A. Dragan, R. Holbrey, A. Ribeiro, R. Donners, C. Messiou, N. Tunariu, D. -M. Koh, M. D. Blackledge

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05715 2025-10-08 cs.CV 79%

AgeBooth: Controllable Facial Aging and Rejuvenation via Diffusion Models

Shihao Zhu, Bohan Cao, Ziheng Ouyang, Zhen Li, Peng-Tao Jiang, Qibin Hou

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机学院,南开大学) The Chinese University of Hong Kong(香港中文大学) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21653 2025-10-08 cs.CV 79%

Think Before You Diffuse: Infusing Physical Rules into Video Diffusion

Ke Zhang, Cihan Xiao, Jiacong Xu, Yiqun Mei, Vishal M. Patel

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 19 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13860 2025-10-08 cs.CV eess.IV 79%

DiffCom: Decoupled Sparse Priors Guided Diffusion Compression for Point Clouds

Xiaoge Zhang, Zijie Wu, Mehwish Nasim, Mingtao Feng, Saeed Anwar, Ajmal Mian

机构 * University of Western Australia(西澳大学) Xidian University(西安电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06174 2025-10-08 cs.LG cond-mat.stat-mech 78%

Thermodynamic Performance Limits for Score-Based Diffusion Models

Nathan X. Kodama, Michael Hinczewski

机构 * Case Western Reserve University(凯斯西储大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05965 2025-10-08 physics.flu-dyn 78%

Quantum Lattice Boltzmann Method for Multiple Time Steps Without Reinitialization for Linear Advection-Diffusion Problems

Aaron Nagel, Johannes Löwe

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14483 2025-10-08 cond-mat.stat-mech 78%

Abrupt transitions in the optimization of diffusion with distributed resetting

Pedro Julián-Salgado, Leonardo Dagdug, Denis Boyer

专题命中 扩散模型 :diffusion(title,abstract)

Comments 11 pages, 5 Figures

Journal ref Physical Review E 112, 044110 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10747 2025-10-08 astro-ph.HE astro-ph.GA 78%

Lévy Flights and Leaky Boxes: Anomalous Diffusion of Cosmic Rays

Naixin Liang, Siang Peng Oh

专题命中 扩散模型 :diffusion(title,abstract)

Journal ref Mon Not R Astron Soc (2025) 1911-1934

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03042 2025-10-08 astro-ph.HE physics.plasm-ph 78%

Energy Diffusion and Advection Coefficients in Kinetic Simulations of Relativistic Plasma Turbulence

Kai W. Wong, Vladimir Zhdankin, Dmitri A. Uzdensky, Gregory R. Werner, Mitchell C. Begelman

专题命中 扩散模型 :diffusion(title,abstract)

Comments 22 pages, 24 figures, submitted for publication. Comments are welcome!

Journal ref Mon Not R Astron Soc (2025) 1842-1863

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05717 2025-10-08 cs.LG 78%

DiffSDA: Unsupervised Diffusion Sequential Disentanglement Across Modalities

Hedi Zisling, Ilan Naiman, Nimrod Berman, Supasorn Suwajanakorn, Omri Azencot

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05689 2025-10-08 math.PR 78%

Hedging of exotic options in Hawkes jump-diffusion models by Malliavin calculus

Ayub Ahmadi, Mahdieh Tahmasebi

专题命中 扩散模型 :diffusion(title,abstract)

Comments 2 tables and 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05205 2025-10-08 cs.LG astro-ph.CO 78%

A Data-Driven Prism: Multi-View Source Separation with Diffusion Model Priors

Sebastian Wagner-Carena, Aizhan Akhmetzhanova, Sydney Erickson

机构 * Center for Computational Astrophysics, Flatiron Institute(Flatiron Institute 计算天文中心) Center for Data Science, New York University(纽约大学数据科学中心) Department of Physics, Harvard University(哈佛大学物理系) Department of Physics, Stanford University(斯坦福大学物理系)

专题命中 扩散模型 :diffusion(title,abstract)

Comments Accepted to main conference of NeurIPS 2025. Code available at https://github.com/swagnercarena/ddprism

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13983 2025-10-08 cs.SD eess.AS 78%

Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement

Hao Shi, Xugang Lu, Kazuki Shimada, Tatsuya Kawahara

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究科) National Institute of Information and Communications Technology(信息通信技术国家研究所)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06416 2025-10-08 cs.LG 78%

Unifying Autoregressive and Diffusion-Based Sequence Generation

Nima Fathi, Torsten Scholak, Pierre-André Noël

机构 * ServiceNow Research(ServiceNow研究)

专题命中 扩散模型 :diffusion(title,abstract)

Comments Published as a conference paper at COLM 2025 Website: https://hdlm-colm.github.io/

Journal ref Second Conference on Language Modeling, https://openreview.net/forum?id=rgq9BFXSFl (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01899 2025-10-08 cs.LG 78%

Cross-Domain Graph Data Scaling: A Showcase with Diffusion Models

Wenzhuo Tang, Haitao Mao, Danial Dervovic, Ivan Brugere, Saumitra Mishra, Yuying Xie, Jiliang Tang

机构 * Michigan State University(密歇根州立大学) Amazon(亚马逊) J.P. Morgan AI Research(摩根大通人工智能研究)

专题命中 扩散模型 :diffusion(title,abstract)

Comments NeurIPS'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05828 2025-10-08 cs.SD cs.CV cs.LG cs.MM eess.AS 62%

StereoSync: Spatially-Aware Stereo Audio Generation from Video

Christian Marinoni, Riccardo Fosco Gramaccioni, Kazuki Shimada, Takashi Shibuya, Yuki Mitsufuji, Danilo Comminiello

机构 * Sapienza University of Rome(罗马萨皮恩扎大学) Sony AI(索尼人工智能) Sony Group Corporation(索尼集团)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.MM

Comments Accepted at IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06145 2025-10-08 cs.CV cs.AI cs.LG 57%

Bimanual 3D Hand Motion and Articulation Forecasting in Everyday Images

Aditya Prakash, David Forsyth, Saurabh Gupta

机构 * University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments Project page: https://ap229997.github.io/projects/forehand4d

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03498 2025-10-08 cs.CV 57%

OneCAT: Decoder-Only Auto-Regressive Model for Unified Understanding and Generation

Han Li, Xinyu Peng, Yaoming Wang, Zelin Peng, Xin Chen, Rongxiang Weng, Jingang Wang, Xunliang Cai, Wenrui Dai, Hongkai Xiong

机构 * Meituan Inc(美团公司) Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments technical report, project url:https://onecat-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06012 2025-10-08 cs.SI cs.MA physics.soc-ph 50%

Emergent Directedness in Social Contagion

Fabian Tschofenig, Douglas Guilbeault

专题命中 扩散模型 :diffusion(abstract)

Comments 36 pages, 6 figures, plus 30-page appendix with 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏