arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-15 至 2025-10-15 共收录 64 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 45 篇

2504.01483 2025-10-15 cs.GR cs.CV 62%

GarmageNet: A Multimodal Generative Framework for Sewing Pattern Design and Generic Garment Modeling

Siran Li, Ruiyang Liu, Chen Liu, Zhendong Wang, Gaofeng He, Yong-Lu Li, Xiaogang Jin, Huamin Wang

机构 * Zhejiang Sci-Tech University Style3D Research Hangzhou China State Key Lab of CAD\&CG, Zhejiang University Shanghai Jiao Tong University Shanghai China State Key Lab of CAD\&CG, Zhejiang University Hangzhou China Style3D Research Shanghai Jiao Tong University

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR

Comments 23 pages,20 figures

Journal ref ACM Trans. Graph. 44, 6, Article 216 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12387 2025-10-15 cs.CV 57%

Scene Coordinate Reconstruction Priors

Wenjing Bian, Axel Barroso-Laguna, Tommaso Cavallari, Victor Adrian Prisacariu, Eric Brachmann

机构 * Niantic Spatial University of Oxford(牛津大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments ICCV 2025, Project page: https://nianticspatial.github.io/scr-priors/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12308 2025-10-15 cs.CV 57%

Hybrid Gaussian Splatting for Novel Urban View Synthesis

Mohamed Omran, Farhad Zanjani, Davide Abati, Jens Petersen, Amirhossein Habibian

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments ICCV 2025 RealADSim Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22622 2025-10-15 cs.CV 57%

LongLive: Real-time Interactive Long Video Generation

Shuai Yang, Wei Huang, Ruihang Chu, Yicheng Xiao, Yuyang Zhao, Xianbang Wang, Muyang Li, Enze Xie, Yingcong Chen, Yao Lu, Song Han, Yukang Chen

机构 * NVIDIA MIT(麻省理工学院) HKUST(GZ)(香港科技大学(广州)) HKU(香港大学) THU(清华大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments Code, model, and demos are available at https://github.com/NVlabs/LongLive

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16845 2025-10-15 cs.CV cs.AI cs.LG 57%

NinA: Normalizing Flows in Action. Training VLA Models with Normalizing Flows

Denis Tarasov, Alexander Nikulin, Ilya Zisman, Albina Klepach, Nikita Lyubaykin, Andrei Polubarov, Alexander Derevyagin, Vladislav Kurenkov

机构 * ETH Zürich(苏黎世联邦理工学院) MIPT(莫斯科国立信息安全大学) Skoltech(斯克里普斯基技术大学) Innopolis University(因诺波利斯大学) HSE(俄罗斯高等经济学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments https://github.com/dunnolab/NinA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03334 2025-10-15 cs.CV 57%

Macro-from-Micro Planning for High-Quality and Parallelized Autoregressive Long Video Generation

Xunzhi Xiang, Yabo Chen, Guiyu Zhang, Zhongyu Wang, Zhe Gao, Quanming Xiang, Gonghu Shang, Junqi Liu, Haibin Huang, Yang Gao, Chi Zhang, Qi Fan, Xuelong Li

机构 * Nanjing University(南京大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院) Shanghai Jiao Tong University(上海交通大学) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04913 2025-10-15 astro-ph.GA 50%

Off-lattice Microscopic Monte Carlo Modeling of Molecular Hydrogen Formation on Carbonaceous Dust Grains

N. A. Satonkin, A. B. Ostrovskii, A. A. Mozhegorov, A. F. Punanova, A. I. Vasyunin

专题命中 扩散模型 :diffusion(abstract)

Comments 8 pages, 8 figures, accepted to MNRAS

Journal ref Mon Not R Astron Soc (2025) 2567-2574

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12497 2025-10-15 cs.LG 50%

Mitigating the Noise Shift for Denoising Generative Models via Noise Awareness Guidance

Jincheng Zhong, Boyuan Jiang, Xin Tao, Pengfei Wan, Kun Gai, Mingsheng Long

机构 * School of Software, BNRist, Tsinghua University, China(软件学院、BNRist、清华大学、中国) Kling Team, Kuaishou Technology, China(快手团队、快手科技、中国)

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12392 2025-10-15 cs.RO cs.LG 50%

Improving Generative Behavior Cloning via Self-Guidance and Adaptive Chunking

Junhyuk So, Chiwoong Lee, Shinyoung Lee, Jungseul Ok, Eunhyeok Park

机构 * Department of Computer Science & Engineering(计算机科学与工程系) Graduate School of Artificial Intelligence(人工智能研究生院) POSTECH

专题命中 扩散模型 :diffusion(abstract)

Comments Accepted at NeurIPS25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12352 2025-10-15 hep-th astro-ph.HE nucl-th 50%

The probe limit in MHD and its implications for magnetic transport

Giorgio Frangi, Matej Bajec, Guri K. Buza, Alexander Soloviev, Sašo Grozdanov

专题命中 扩散模型 :diffusion(abstract)

Comments v1: 40+4 pages plus references, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12084 2025-10-15 cs.CR 50%

Elevating Medical Image Security: A Cryptographic Framework Integrating Hyperchaotic Map and GRU

Weixuan Li, Guang Yu, Quanjun Li, Junhua Zhou, Jiajun Chen, Yihang Dong, Mengqian Wang, Zimeng Li, Changwei Gong, Lin Tang, Xuhang Chen

专题命中 扩散模型 :diffusion(abstract)

Comments Accepted By BIBM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12055 2025-10-15 physics.app-ph cond-mat.mtrl-sci hep-ex 50%

Quantification of Electrolyte Degradation in Lithium-ion Batteries with Neutron Imaging Techniques

Yonggang Hu, Yiqing Liao, Lufeng Yang, Ke Zhang, Yufan Peng, Shijun Tang, Shengxiang Wang, Meifang Ding, Jiahao Wu, Jianrong Lin, Jinding Liang, Yimin Wei, Yanting Jin, Zhengliang Gong, Anatoliy Senyshyn, Jie Chen, Yong Yang

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12000 2025-10-15 cs.SD cs.CL cs.LG 50%

UALM: Unified Audio Language Model for Understanding, Generation and Reasoning

Jinchuan Tian, Sang-gil Lee, Zhifeng Kong, Sreyan Ghosh, Arushi Goel, Chao-Han Huck Yang, Wenliang Dai, Zihan Liu, Hanrong Ye, Shinji Watanabe, Mohammad Shoeybi, Bryan Catanzaro, Rafael Valle, Wei Ping

机构 * CMU(卡内基梅隆大学) NVIDIA(英伟达) UMD(马里兰大学)

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11901 2025-10-15 math.AP 50%

Long-time contractivity estimates for kinetic Kolmogorov-Fokker-Planck equations

Nicolò Forcillo, Alessio Porretta

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11749 2025-10-15 cs.CY 50%

Benefits and Limitations of Using GenAI for Political Education and Municipal Elections

Raphael Fischer, Youssef Abdelrahim, Katharina Poitz

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22129 2025-10-15 cond-mat.mtrl-sci 50%

How transparent is graphene? A surface science perspective on remote epitaxy

Zach LaDuca, Anshu Sirohi, Quinn Campbell, Jason K Kawasaki

专题命中 扩散模型 :diffusion(abstract)

Journal ref 2D Mater. 12 043006 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19133 2025-10-15 cs.LG q-bio.QM stat.ML 50%

Riemannian generative decoder

Andreas Bjerregaard, Søren Hauberg, Anders Krogh

机构 * University of Copenhagen(哥本哈根大学) Technical University of Denmark(丹麦技术大学)

专题命中 扩散模型 :diffusion(abstract)

Comments GenBio ICML 2025 (Proceedings of the Workshop on Generative AI for Biology at the 42nd International Conference on Machine Learning, Vancouver, Canada. PMLR 267, 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03578 2025-10-15 cond-mat.soft 50%

Curvature dependent dynamics of a bacterium confined in a giant unilamellar vesicle

Olivia Vincent, Aparna Sreekumari, Manoj Gopalakrishnan, Vishwas V Vasisht, Bibhu Ranjan Sarangi

专题命中 扩散模型 :diffusion(abstract)

Comments 13 Pages, 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06453 2025-10-15 math.AP 50%

Nonlocal degenerate parabolic hyperbolic equations on bounded domains

Nathaël Alibaud, Jørgen Endal, Espen Jakobsen, Ola Mæhlen

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.07470 2025-10-15 q-fin.MF math.OC 50%

On time-consistent equilibrium stopping under aggregation of diverse discount rates

Shuoqing Deng, Xiang Yu, Jiacheng Zhang

专题命中 扩散模型 :diffusion(abstract)

Comments Final version, forthcoming in Mathematics of Operations Research

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 3 篇

2510.11738 2025-10-15 cs.SD cs.AI cs.CV cs.MM 73%

SeeingSounds: Learning Audio-to-Visual Alignment via Text

Simone Carnemolla, Matteo Pennisi, Chiara Russo, Simone Palazzo, Daniela Giordano, Concetto Spampinato

机构 * University of Catania(卡塔尼亚大学)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV、cs.MM

Comments accepted to ACM Multimedia Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12069 2025-10-15 cs.CV 57%

VIDMP3: Video Editing by Representing Motion with Pose and Position Priors

Sandeep Mishra, Oindrila Saha, Alan C. Bovik

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06243 2025-10-15 math.OC math.PR 50%

Verification theorem related to a zero sum stochastic differential game, based on a chain rule for non-smooth functions

Carlo Ciccarella, Francesco Russo

专题命中 可控生成 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 2 篇

2510.12747 2025-10-15 cs.CV 79%

FlashVSR: Towards Real-Time Diffusion-Based Streaming Video Super-Resolution

Junhao Zhuang, Shi Guo, Xin Cai, Xiaohui Li, Yihao Liu, Chun Yuan, Tianfan Xue

机构 * Tsinghua University(清华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 图像修复 :diffusion(title,abstract);分类 cs.CV

Comments Project page with code: https://zhuang2002.github.io/FlashVSR

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11924 2025-10-15 q-bio.NC stat.AP stat.ML 71%

Inpainting the Neural Picture: Inferring Unrecorded Brain Area Dynamics from Multi-Animal Datasets

Ji Xia, Yizi Zhang, Shuqi Wang, Genevera I. Allen, Liam Paninski, Cole Lincoln Hurwitz, Kenneth D. Miller

专题命中 图像修复 :inpainting(title)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 3 篇

2510.12119 2025-10-15 cs.CV 79%

ImageSentinel: Protecting Visual Datasets from Unauthorized Retrieval-Augmented Image Generation

Ziyuan Luo, Yangyi Zhao, Ka Chun Cheung, Simon See, Renjie Wan

机构 * Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系) NVIDIA AI Technology Center, NVIDIA(NVIDIA 人工智能技术中心)

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15058 2025-10-15 cs.SD cs.AI cs.CV cs.GR eess.AS 62%

AsynFusion: Towards Asynchronous Latent Consistency Models for Decoupled Whole-Body Audio-Driven Avatars

Tianbao Zhang, Jian Zhao, Yuer Li, Zheng Zhu, Ping Hu, Zhaoxin Fan, Wenjun Wu, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI)、中国电信) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(未来区块链与隐私计算先进创新中心) School of Artificial Intelligence, Beihang University(北航人工智能学院) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北航) School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) GigaAI

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments 15pages, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12325 2025-10-15 cs.IR cs.AI 50%

Causal Inspired Multi Modal Recommendation

Jie Yang, Chenyang Gu, Zixuan Liu

机构 * National University of Singapore Master of Industrial and Systems Engineering(新加坡国立大学工业与系统工程硕士) East China Normal University Master of Library and Information Science(华东师范大学图书馆与信息科学硕士) Shandong Normal University(山东师范大学)

专题命中 个性化与一致性 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 图像生成评测 1 篇

2510.12015 2025-10-15 cs.AI 50%

Asking Clarifying Questions for Preference Elicitation With Large Language Models

Ali Montazeralghaem, Guy Tennenholtz, Craig Boutilier, Ofer Meshi

机构 * Google(谷歌)

专题命中 图像生成评测 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 效率与蒸馏 5 篇

2510.12231 2025-10-15 cs.CV 79%

BIGFix: Bidirectional Image Generation with Token Fixing

Victor Besnier, David Hurych, Andrei Bursuc, Eduardo Valle

专题命中 效率与蒸馏 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏