arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-03 至 2025-09-03 共收录 120 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 10 篇

2509.00177 2025-09-03 cs.CV 89%

Category-level Text-to-Image Retrieval Improved: Bridging the Domain Gap with Diffusion Models and Vision Encoders

Faizan Farooq Khan, Vladan Stojnić, Zakaria Laskar, Mohamed Elhoseiny, Giorgos Tolias

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒-阿齐兹大学科学与技术大学) Visual Recognition Group(视觉识别组) Faculty of Electrical Engineering(电气工程学院) Czech Technical University in Prague(布拉格捷克技术大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10029 2025-09-03 cs.CV cs.LG 88%

Memory-Efficient Personalization of Text-to-Image Diffusion Models via Selective Optimization Strategies

Seokeon Choi, Sunghyun Park, Hyoungwoo Park, Jeongho Kim, Sungrack Yun

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2025 LIMIT Workshop (4-page short paper). Extended version in preparation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08346 2025-09-03 cs.CV 83%

Pathology-Aware Adaptive Watermarking for Text-Driven Medical Image Synthesis

Chanyoung Kim, Dayun Ju, Jinyeong Kim, Woojung Han, Roberto Alcover-Couso, Seong Jae Hwang

机构 * Department of Artificial Intelligence, Yonsei University(人工智能系,延世大学) Amazon(亚马逊)

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15312 2025-09-03 cs.CV cs.AI 83%

Synergistic Dual Spatial-aware Generation of Image-to-Text and Text-to-Image

Yu Zhao, Hao Fei, Xiangtai Li, Libo Qin, Jiayi Ji, Hongyuan Zhu, Meishan Zhang, Min Zhang, Jianguo Wei

机构 * Tianjin University(天津大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Central South University(中南大学) I 2 R & CFAR, A*STAR(I 2 R与CFAR,A*STAR) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05063 2025-09-03 cs.CV cs.CL cs.LG 83%

CytoDiff: AI-Driven Cytomorphology Image Synthesis for Medical Diagnostics

Jan Carreras Boada, Rao Muhammad Umer, Carsten Marr

机构 * Institute of AI for Health, Helmholtz Zentrum München - German Research Center for Environmental Health(人工智能与健康研究所,慕尼黑德国环境健康研究中心) Department of Medicine III, Ludwig-Maximilian-University Hospital(第三医学部,路德维希-马克西米利安大学医院) DKTK, German Cancer Consortium(德国癌症联盟,DKTK) Escola Superior de Comerç Internacional, Universitat Pompeu Fabra (ESCI-UPF)(国际商业学校,庞培法布拉大学(ESCI-UPF))

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at ICCV 2025, 7-8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00849 2025-09-03 cs.CL 82%

Prompting Away Stereotypes? Evaluating Bias in Text-to-Image Models for Occupations

Shaina Raza, Maximus Powers, Partha Pratim Saha, Mahveen Raza, Rizwan Qureshi

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15227 2025-09-03 cs.HC cs.AI 75%

GenTune: Toward Traceable Prompts to Improve Controllability of Image Refinement in Environment Design

Wen-Fan Wang, Ting-Ying Lee, Chien-Ting Lu, Che-Wei Hsu, Nil Ponsa Campanyà, Yu Chen, Mike Y. Chen, Bing-Yu Chen

机构 * National Taiwan University(国立台湾大学)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);inpainting(abstract)

Comments Accepted ACM Symposium on User Interface Software and Technology (UIST '25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10462 2025-09-03 cs.CV cs.AI cs.GR cs.LG 73%

BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation

Xiaolu Hou, Mingcheng Li, Dingkang Yang, Jiawei Chen, Ziyun Qian, Xiao Zhao, Yue Jiang, Jinjie Wei, Qingyao Xu, Lihua Zhang

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.GR

Comments Accepted by AAAI 2025. Code: https://github.com/SparklingH/BloomScene

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00752 2025-09-03 cs.CV 57%

Multi-Level CLS Token Fusion for Contrastive Learning in Endoscopy Image Classification

Y Hop Nguyen, Doan Anh Phan Huu, Trung Thai Tran, Nhat Nam Mai, Van Toi Giap, Thao Thi Phuong Dao, Trung-Nghia Le

机构 * University of Science, VNU-HCM(越南胡志明市科学大学) Thong Nhat Hospital(通纳特医院)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00549 2025-09-03 cs.CV 57%

A Modality-agnostic Multi-task Foundation Model for Human Brain Imaging

Peirong Liu, Oula Puonti, Xiaoling Hu, Karthik Gopinath, Annabel Sorby-Adams, Daniel C. Alexander, W. Taylor Kimberly, Juan E. Iglesias

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 扩散模型 78 篇

2509.02000 2025-09-03 cs.CV 85%

Palette Aligned Image Diffusion

Elad Aharoni, Noy Porat, Dani Lischinski, Ariel Shamir

机构 * Hebrew University(希伯来大学) Reichman University(雷赫曼大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 14 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02161 2025-09-03 cs.CV 83%

Enhancing Zero-Shot Pedestrian Attribute Recognition with Synthetic Data Generation: A Comparative Study with Image-To-Image Diffusion Models

Pablo Ayuso-Albizu, Juan C. SanMiguel, Pablo Carballeira

机构 * Universidad Autónoma de Madrid(西班牙马德里自治大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Paper accepted at AVSS 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00378 2025-09-03 cs.CV 83%

NoiseCutMix: A Novel Data Augmentation Approach by Mixing Estimated Noise in Diffusion Models

Shumpei Takezaki, Ryoma Bise, Shinnosuke Matsuo

机构 * Kyushu University(九州大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at ICCV2025 Workshop LIMIT

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02308 2025-09-03 cs.AI 82%

Exploring Diffusion Models for Generative Forecasting of Financial Charts

Taegyeong Lee, Jiwon Park, Kyunga Bang, Seunghyun Hwang, Ung-Jin Jang

机构 * FnGuide Inc.(FnGuide公司) GenAI in Finance, MODULABS(金融领域生成式AI,MODULABS) Department of Applied Data Science, Sungkyunkwan University(Sungkyunkwan大学应用数据科学系)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14507 2025-09-03 stat.ML cs.AI cs.LG 82%

Diffusion Models for Time Series Forecasting: A Survey

Chen Su, Zhengzhou Cai, Yuanhe Tian, Zhuochao Chang, Zihong Zheng, Yan Song

机构 * University of Science and Technology of China(中国科学技术大学) Beijing University of Posts and Telecommunications(北京邮电大学) University of Washington(华盛顿大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02357 2025-09-03 cs.CV 79%

Category-Aware 3D Object Composition with Disentangled Texture and Shape Multi-view Diffusion

Zeren Xiong, Zikun Chen, Zedong Zhang, Xiang Li, Ying Tai, Jian Yang, Jun Li

机构 * Nanjing University of Science and Technology(南京理工大学) Nankai University(南开大学) Nanjing University(南京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02099 2025-09-03 cs.CV 79%

A Data-Centric Approach to Pedestrian Attribute Recognition: Synthetic Augmentation via Prompt-driven Diffusion Models

Alejandro Alonso, Sawaiz A. Chaudhry, Juan C. SanMiguel, Álvaro García-Martín, Pablo Ayuso-Albizu, Pablo Carballeira

机构 * Autonomous University of Madrid(马德里自主大学) University of Bordeaux(波尔多大学) Pázmány Péter Catholic University(帕兹曼·彼得天主教大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Paper Acepted at AVSS 2025 conference. Best paper award

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01864 2025-09-03 cs.CV 79%

Latent Gene Diffusion for Spatial Transcriptomics Completion

Paula Cárdenas, Leonardo Manrique, Daniela Vega, Daniela Ruiz, Pablo Arbeláez

机构 * Center for Research and Formation in Artificial Intelligence(人工智能研究与培训中心) Universidad de los Andes(andes大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 8 figures. Accepted to CVAMD Workshop, ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01177 2025-09-03 cs.CV cs.AI cs.HC eess.SP 79%

DynaMind: Reconstructing Dynamic Visual Scenes from EEG by Aligning Temporal Dynamics and Multimodal Semantics to Guided Diffusion

Junxiang Liu, Junming Lin, Jiangtong Li, Jie Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22459 2025-09-03 cs.CV 79%

Exploiting Diffusion Prior for Task-driven Image Restoration

Jaeha Kim, Junghun Oh, Kyoung Mu Lee

机构 * Dept. of ECE&ASRI(电子工程与先进科学研究院部) IPAI(人工智能研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICCV 2025. Code is available at https://github.com/JaehaKim97/EDTR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21541 2025-09-03 cs.CV cs.AI 79%

DiffDecompose: Layer-Wise Decomposition of Alpha-Composited Images via Diffusion Transformers

Zitong Wang, Hang Zhao, Qianyu Zhou, Xuequan Lu, Xiangtai Li, Yiren Song

机构 * Jilin University(吉林大学) University of Western Australia(西澳大学) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12470 2025-09-03 cs.CV 79%

SC-Diff: 3D Shape Completion with Latent Diffusion Models

Simon Schaefer, Juan D. Galvis, Xingxing Zuo, Stefan Leutengger

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) ETH Zurich(苏黎世联邦理工学院) MBZUAI(穆桑比克大学人工智能研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00843 2025-09-03 cs.CV cs.AI 79%

Look Beyond: Two-Stage Scene View Generation via Panorama and Video Diffusion

Xueyang Kang, Zhengkang Xiang, Zezheng Zhang, Kourosh Khoshelham

机构 * University of Melbourne(墨尔本大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 26 pages, 30 figures, 2025 ACM Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00395 2025-09-03 cs.CV 79%

Double-Constraint Diffusion Model with Nuclear Regularization for Ultra-low-dose PET Reconstruction

Mengxiao Geng, Ran Hong, Bingxuan Li, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00065 2025-09-03 cs.RO cs.CV 79%

Hybrid Perception and Equivariant Diffusion for Robust Multi-Node Rebar Tying

Zhitao Wang, Yirong Xiong, Roberto Horowitz, Yanke Wang, Yuxing Han

机构 * Tsinghua University, Shenzhen International Graduate School, Shenzhen, China(清华大学深圳国际研究生院,深圳,中国) Department of Mechanical Engineering, University of California, Berkeley(加州大学伯克利分校机械工程系) Hong Kong Center for Construction Robotics, The Hong Kong University of Science and Technology(香港科技大学建设机器人中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by The IEEE International Conference on Automation Science and Engineering (CASE) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11999 2025-09-03 cs.RO cs.CV cs.SY eess.SY 79%

Diffusion Dynamics Models with Generative State Estimation for Cloth Manipulation

Tongxuan Tian, Haoyang Li, Bo Ai, Xiaodi Yuan, Zhiao Huang, Hao Su

机构 * University of California San Diego(加州大学圣地亚哥分校) Hillbot Inc(Hillbot公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CoRL 2025. Project website: https://uniclothdiff.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02528 2025-09-03 cs.LG math.OC math.PR math.ST stat.ML stat.TH 78%

Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models

Wenlong Mou

机构 * Department of Statistical Sciences, University of Toronto(统计科学系,多伦多大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02397 2025-09-03 cond-mat.soft 78%

Revisiting the diffusion equation derivation in Persson's theory of contact

Yang Xu, Siyuan Yang, Yunong Zhou, Liang Luo

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02341 2025-09-03 cs.LG cs.AI 78%

RDIT: Residual-based Diffusion Implicit Models for Probabilistic Time Series Forecasting

Chih-Yu Lai, Yu-Chien Ning, Duane S. Boning

机构 * Dept. of EECS, MIT(麻省理工学院电子工程与计算机科学系) Harvard University(哈佛大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07058 2025-09-03 math.NA cs.NA 78%

A residual weighted physics informed neural network for forward and inverse problems of reaction diffusion equations

K. Murari, P. Roul, S. Sundar

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏