arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-08-08 至 2025-08-08 共收录 55 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 34 篇

2508.05076 2025-08-08 physics.optics 50%

MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface Design

Hao Li, Andrey Bogdanov

专题命中 扩散模型 :diffusion(abstract)

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04843 2025-08-08 cs.LG 50%

Unified Flow Matching for Long Horizon Event Forecasting

Xiao Shou

机构 * Pater Patel Schneider(帕特·帕特·施耐德) Sunil Issar(辛格·伊萨尔) J. Scott Penberthy(J. 斯科特·彭伯思比) George Ferguson(乔治·费格森) Hans Guesgen(汉斯·格斯根) Francisco Cruz(弗朗西斯科·克鲁兹) Marc Pujol-Gonzalez(马克·普伊尔-冈萨雷斯)

专题命中 扩散模型 :diffusion(abstract)

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04824 2025-08-08 q-bio.NC 50%

Delay-constrained re-entry governs large-scale brain seizures and other network pathologies

Paul Triebkorn, Huifang E. Wang, Marmaduke Woodman, Maxime Guye, Fabrice Bartolomei, Viktor Jirsa

专题命中 扩散模型 :diffusion(abstract)

Comments 26 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04806 2025-08-08 physics.plasm-ph 50%

Electrodeless Magnetohydrodynamic Local Force Generator for Aerocapture

Bernard Parent, Felipe Martin Rodriguez Fuentes, Spencer LaFoley

专题命中 扩散模型 :diffusion(abstract)

Comments 14 pages, 12 figures

Journal ref AIAA Journal, Vol. 63, No. 8, 2025, pp. 3035-3047

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04588 2025-08-08 eess.IV cs.AI cs.LG 50%

A Comprehensive Framework for Uncertainty Quantification of Voxel-wise Supervised Models in IVIM MRI

Nicola Casali, Alessandro Brusaferri, Giuseppe Baselli, Stefano Fumagalli, Edoardo Micotti, Gianluigi Forloni, Riaz Hussein, Giovanna Rizzo, Alfonso Mastropietro

机构 * Department of Acute Brain(急性脑和心血管损伤部门) Department of Neuroscience(神经科学部门) Istituto di Ricerche Farmacologiche Mario Negri IRCCS(马里奥·内格里药理研究所) Milan(米兰) Italy(意大利)

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02068 2025-08-08 cs.RO 50%

"Set It Up": Functional Object Arrangement with Compositional Generative Models (Journal Version)

Yiqing Xu, Jiayuan Mao, Linfeng Li, Yilun Du, Tomas Lozáno-Pérez, Leslie Pack Kaelbling, David Hsu

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) CSAIL, Massachusetts Institute of Technology(麻省理工学院计算机科学与人工智能实验室)

专题命中 扩散模型 :diffusion(abstract)

Comments This is the journal version accepted to the International Journal of Robotics Research (IJRR). It extends our prior work presented at Robotics: Science and Systems (RSS) 2024, with a new compositional program induction pipeline from natural language, and expanded evaluations on personalized bookshelf and bedroom furniture layout tasks

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13113 2025-08-08 cond-mat.stat-mech 50%

Quantifying dissipation in flocking dynamics: When tracking internal states matters

Karel Proesmans, Gianmaria Falasco, Atul Tanaji Mohite, Massimiliano Esposito, Étienne Fodor

专题命中 扩散模型 :diffusion(abstract)

Comments 11 pages, 4 figures

Journal ref Phys. Rev. E 112, 024103 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01376 2025-08-08 quant-ph 50%

On the dual structure of the Schrödinger dynamics

Kazuo Takatsuka

专题命中 扩散模型 :diffusion(abstract)

Comments arXiv admin note: substantial text overlap with arXiv:2501.08606

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06011 2025-08-08 astro-ph.HE astro-ph.GA physics.comp-ph 50%

SECRET: Stochasticity Emulator for Cosmic Ray Electrons

Nikolas Frediani, Michael Krämer, Philipp Mertsch, Kathrin Nippel

专题命中 扩散模型 :diffusion(abstract)

Comments 27 pages, 12 figures. Slightly edited. Accepted for publication in JCAP

Journal ref JCAP08(2025)007

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10855 2025-08-08 cs.RO cs.LG 50%

Fast and Robust Visuomotor Riemannian Flow Matching Policy

Haoran Ding, Noémie Jaquier, Jan Peters, Leonel Rozo

机构 * Bosch Center for Artificial Intelligence(博世人工智能中心) Division of Robotics, Perception, and Learning, KTH Royal Institute of Technology(机器人、感知与学习 division,皇家理工学院) Computer Science Department of the Technische Universität Darmstadt(达姆施塔特技术大学计算机科学系)

专题命中 扩散模型 :diffusion(abstract)

Comments Accepted for publication in IEEE T-RO. Project website: https://sites.google.com/view/rfmp 17 pages, 12 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07012 2025-08-08 physics.bio-ph 50%

Fluid flow generates bacterial conjugation hotspots by increasing the rate of shear-driven cell-cell encounters

Matti Zbinden, Jana S. Huisman, Natasha Blitvic, Roman Stocker, Jonasz Słomka

专题命中 扩散模型 :diffusion(abstract)

Journal ref M. Zbinden, J.S. Huisman, N. Blitvic, R. Stocker, and J. Słomka, Proc. Natl. Acad. Sci. U.S.A. 122 (32) e2505446122, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 9 篇

2508.05236 2025-08-08 cs.CV 83%

ArbiViewGen: Controllable Arbitrary Viewpoint Camera Data Generation for Autonomous Driving via Stable Diffusion Models

Yatong Lan, Jingfeng Chen, Yiru Wang, Lei He

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17963 2025-08-08 cs.CV 79%

M$^{2}$Chat: Empowering VLM for Multimodal LLM Interleaved Text-Image Generation

Xiaowei Chi, Junbo Qi, Rongyu Zhang, Shanghang Zhang, Qifeng Liu, Yike Guo

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Waseda University(早稻田大学) Peking University(北京大学)

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16978 2025-08-08 cs.CV cs.AI 77%

PromptDresser: Improving the Quality and Controllability of Virtual Try-On via Generative Textual Prompt and Prompt-aware Mask

Jeongho Kim, Hoiyeong Jin, Sunghyun Park, Jaegul Choo

机构 * KAIST(韩国科学技术院)

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04809 2025-08-08 math.OC 71%

Stochastic Optimal Control with Control-Dependent Diffusion and State Constraints: A Degenerate Elliptic Approach

Anderson O. Calixto, Bernardo Freitas Paulo da Costa, Glauco Valle

专题命中 可控生成 :diffusion(title)

Comments 22 pages. arXiv admin note: substantial text overlap with arXiv:2505.14987

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14054 2025-08-08 cs.CV 70%

PointRegGPT: Boosting 3D Point Cloud Registration using Generative Point-Cloud Pairs for Training

Suyi Chen, Hao Xu, Haipeng Li, Kunming Luo, Guanghui Liu, Chi-Wing Fu, Ping Tan, Shuaicheng Liu

机构 * University of Electronic Science and Technology of China(电子科技大学) The Chinese University of Hong Kong(香港中文大学) Hong Kong University of Science and Technology(香港科技大学) Megvii Technology(商汤科技)

专题命中 可控生成 :diffusion(abstract);inpainting(abstract);分类 cs.CV

Comments To appear at the European Conference on Computer Vision (ECCV) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20471 2025-08-08 cs.CV cs.AI cs.ET cs.LG cs.RO 57%

WeatherEdit: Controllable Weather Editing with 4D Gaussian Field

Chenghao Qian, Wenjing Li, Yuhu Guo, Gustav Markkula

机构 * University of Leeds(利兹大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16948 2025-08-08 cs.CV 57%

Follow-Your-Color: Multi-Instance Sketch Colorization

Yinhan Zhang, Yue Ma, Bingyuan Wang, Qifeng Chen, Zeyu Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06510 2025-08-08 cs.CV cs.AI 57%

AnomalyControl: Learning Cross-modal Semantic Features for Controllable Anomaly Synthesis

Shidan He, Lei Liu, Xiujun Shu, Bo Wang, Yuanhao Feng, Shen Zhao

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03069 2025-08-08 cs.CV cs.AI 57%

TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation

Liao Qu, Huichao Zhang, Yiheng Liu, Xu Wang, Yi Jiang, Yiming Gao, Hu Ye, Daniel K. Du, Zehuan Yuan, Xinglong Wu

机构 * ByteDance(字节跳动)

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments CVPR 2025; Code and models: https://github.com/ByteVisionLab/TokenFlow

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 2 篇

2508.05069 2025-08-08 cs.CV 79%

FLUX-Makeup: High-Fidelity, Identity-Consistent, and Robust Makeup Transfer via Diffusion Transformer

Jian Zhu, Shanyuan Liu, Liuzhuozheng Li, Yue Gong, He Wang, Bo Cheng, Yuhang Ma, Liebucha Wu, Xiaoyu Wu, Dawei Leng, Yuhui Yin, Yang Xu

机构 * Nanjing University of Science and Technology(南京理工大学) AI Research(360人工智能研究院) Beijing University of Aeronautics and Astronautics(北京航空航天大学)

专题命中 个性化与一致性 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04745 2025-08-08 cs.LG 50%

Edge-Assisted Collaborative Fine-Tuning for Multi-User Personalized Artificial Intelligence Generated Content (AIGC)

Nan Li, Wanting Yang, Marie Siew, Zehui Xiong, Binbin Chen, Shiwen Mao, Kwok-Yan Lam

专题命中 个性化与一致性 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 效率与蒸馏 3 篇

2508.05323 2025-08-08 cs.CV 70%

Textual Inversion for Efficient Adaptation of Open-Vocabulary Object Detectors Without Forgetting

Frank Ruis, Gertjan Burghouts, Hugo Kuijf

机构 * TNO(荷兰技术院) Intelligent Imaging(智能成像)

专题命中 效率与蒸馏 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17807 2025-08-08 cs.LG cs.CV 57%

A solvable generative model with a linear, one-step denoiser

Indranil Halder

机构 * Harvard University(哈佛大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Published at International Conference on Machine Learning 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05411 2025-08-08 cs.LG 50%

MolSnap: Snap-Fast Molecular Generation with Latent Variational Mean Flow

Md Atik Ahamed, Qiang Ye, Qiang Cheng

专题命中 效率与蒸馏 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏