arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-14 至 2025-10-14 共收录 108 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 8 篇

2510.11650 2025-10-14 cs.CV 70%

InfiniHuman: Infinite 3D Human Creation with Precise Control

Yuxuan Xue, Xianghui Xie, Margaret Kostyrko, Gerard Pons-Moll

机构 * University of Tübingen, Tübingen AI Center(图宾根大学,图宾根人工智能中心) University of Tübingen, Tübingen AI Center, MPI for Informatics, SIC(图宾根大学,图宾根人工智能中心,马克斯·普朗克信息研究所,SIC) University of Tübingen(图宾根大学)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to ACM SIGGRAPH Asia 2025. Project website: https://yuxuan-xue.com/infini-human

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19066 2025-10-14 cs.CV 70%

Concept Steerers: Leveraging K-Sparse Autoencoders for Test-Time Controllable Generations

Dahye Kim, Deepti Ghadiyaram

机构 * Boston University(波士顿大学) Runway

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 23 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09657 2025-10-14 cs.LG cs.AI cs.NA eess.SP math.NA 67%

Generative Models for Helmholtz Equation Solutions: A Dataset of Acoustic Materials

Riccardo Fosco Gramaccioni, Christian Marinoni, Fabrizio Frezza, Aurelio Uncini, Danilo Comminiello

机构 * 1Department of Information Engineering, Electronics Telecommunications (DIET),\ University of Rome, Rome. Italy, \ riccardofosco.gramaccioni

专题命中 可控生成 :image generation(abstract);diffusion(abstract)

Comments Accepted at EUSIPCO 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11649 2025-10-14 cs.CV 57%

PhySIC: Physically Plausible 3D Human-Scene Interaction and Contact from a Single Image

Pradyumna Yalandur Muralidhar, Yuxuan Xue, Xianghui Xie, Margaret Kostyrko, Gerard Pons-Moll

机构 * University of Tübingen, Zuse School ELIZA(图宾根大学Zuse学校ELIZA) University of Tübingen, Tübingen AI Center(图宾根大学图宾根人工智能中心) University of Tübingen, Tübingen AI Center, MPI for Informatics, SIC(图宾根大学图宾根人工智能中心、马克斯·普朗克信息研究所、SIC)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to ACM SIGGraphAsia 2025. Project website: https://yuxuan-xue.com/physic

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10650 2025-10-14 cs.CV cs.AI 57%

DEMO: Disentangled Motion Latent Flow Matching for Fine-Grained Controllable Talking Portrait Synthesis

Peiyin Chen, Zhuowei Yang, Hui Feng, Sheng Jiang, Rui Yan

机构 * College of Artificial Intelligence and Automation, Hohai University(人工智能与自动化学院,河海大学) College of DaYu, Hohai University(大禹学院,河海大学) College of Water Conserwancy and Hydropower Engineering, Hohai University(水利水电工程学院,河海大学) College of Computer Science and Technology, Zhejiang University of Technology(计算机科学与技术学院,浙江工业大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09817 2025-10-14 cs.RO cs.CV 57%

Cross-Sensor Touch Generation

Samanta Rodriguez, Yiming Dou, Miquel Oller, Andrew Owens, Nima Fazeli

机构 * University of Michigan(密歇根大学) Cornell University(康奈尔大学)

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments CoRL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08561 2025-10-14 cs.CV 57%

MultiCOIN: Multi-Modal COntrollable Video INbetweening

Maham Tanveer, Yang Zhou, Simon Niklaus, Ali Mahdavi Amiri, Hao Zhang, Krishna Kumar Singh, Nanxuan Zhao

机构 * Simon Fraser University(西蒙弗雷泽大学) Adobe Research(Adobe研究院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project website: https://multicoinx.github.io/multicoin/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像修复 4 篇

2510.11712 2025-10-14 cs.CV 83%

DiT360: High-Fidelity Panoramic Image Generation via Hybrid Training

Haoran Feng, Dizhe Zhang, Xiangtai Li, Bo Du, Lu Qi

机构 * Insta360 Research(Insta360研究院) Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Wuhan University(武汉大学)

专题命中 图像修复 :image generation(title,abstract);inpainting(abstract);分类 cs.CV

Comments https://fenghora.github.io/DiT360-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10993 2025-10-14 cs.CV 83%

Perspective-aware 3D Gaussian Inpainting with Multi-view Consistency

Yuxin Cheng, Binxiao Huang, Taiqiang Wu, Wenyong Zhou, Chenchen Ding, Zhengwu Liu, Graziano Chesi, Ngai Wong

机构 * The University of Hong Kong(香港大学)

专题命中 图像修复 :inpainting(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20367 2025-10-14 eess.IV cs.LG 78%

DiffNMR: Advancing Inpainting of Randomly Sampled Nuclear Magnetic Resonance Signals

Sen Yan, Fabrizio Gabellieri, Etienne Goffinet, Filippo Castiglione, Thomas Launey

机构 * Technology Innovation Institute(技术创新研究所)

专题命中 图像修复 :inpainting(title);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09924 2025-10-14 cs.CV 57%

HeadsUp! High-Fidelity Portrait Image Super-Resolution

Renjie Li, Zihao Zhu, Xiaoyu Wang, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯农工大学) Topaz Labs(Topaz实验室)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 3 篇

2510.10156 2025-10-14 cs.CV 84%

ReMix: Towards a Unified View of Consistent Character Generation and Editing

Benjia Zhou, Bin Fu, Pei Cheng, Yanru Wang, Jiayuan Fan, Tao Chen

机构 * Tencent GYLab(腾讯GY实验室) Fudan University(复旦大学)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10782 2025-10-14 cs.CV cs.AI 79%

DISC-GAN: Disentangling Style and Content for Cluster-Specific Synthetic Underwater Image Generation

Sneha Varur, Anirudh R Hanchinamani, Tarun S Bagewadi, Uma Mudenagudi, Chaitra D Desai, Sujata C, Padmashree Desai, Sumit Meharwade

机构 * KLE Technological University(KLE技术大学)

专题命中 个性化与一致性 :image generation(title);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10497 2025-10-14 cs.CV 57%

Jigsaw3D: Disentangled 3D Style Transfer via Patch Shuffling and Masking

Yuteng Ye, Zheng Zhang, Qinchuan Zhang, Di Wang, Youjia Zhang, Wenxiao Zhang, Wei Yang, Yuan Liu

机构 * Huawei, Media Innovation Lab(华为媒体创新实验室) Huazhong University of Science & Technology(华中科技大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments 23 pages, 16 figures and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 2 篇

2506.01977 2025-10-14 cs.LG cs.AI 50%

Towards Unsupervised Training of Matching-based Graph Edit Distance Solver via Preference-aware GAN

Wei Huang, Hanchen Wang, Dong Wen, Shaozhen Ma, Wenjie Zhang, Xuemin Lin

机构 * University of New South Wales(新南威尔士大学) University of Technology Sydney(技术与科学大学) Shanghai Jiaotong University(上海交通大学)

专题命中 图像生成评测 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04235 2025-10-14 q-bio.QM cs.AI cs.CE cs.LG q-bio.BM 50%

AbBiBench: A Benchmark for Antibody Binding Affinity Maturation and Design

Xinyan Zhao, Yi-Ching Tang, Akshita Singh, Victor J Cantu, KwanHo An, Junseok Lee, Adam E Stogsdill, Ibraheem M Hamdi, Ashwin Kumar Ramesh, Zhiqiang An, Xiaoqian Jiang, Yejin Kim

机构 * McWilliams School of Biomedical Informatics, UTHealth Houston(麦威廉生物医学信息学学院,UT健康科学中心休斯顿分校) University of Texas Health Science Center(德克萨斯大学健康科学中心) Korea Advanced Institute of Science and Technology(韩国科学技术院) Texas Therapeutics Institute(德克萨斯疗法研究所) Brown Foundation Institute of Molecular Medicine, UTHealth Houston(布朗基金会分子医学研究所,UT健康科学中心休斯顿分校)

专题命中 图像生成评测 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 2 篇

2505.18809 2025-10-14 cs.CV 79%

VORTA: Efficient Video Diffusion via Routing Sparse Attention

Wenhao Sun, Rong-Cheng Tu, Yifu Ding, Zhao Jin, Jingyi Liao, Shunyu Liu, Dacheng Tao

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by NeurIPS 2025. The code is available at https://github.com/wenhao728/VORTA

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12067 2025-10-14 cs.CV 57%

A Comprehensive Survey on Knowledge Distillation

Amir M. Mansourian, Rozhan Ahmadi, Masoud Ghafouri, Amir Mohammad Babaei, Elaheh Badali Golezani, Zeynab Yasamani Ghamchi, Vida Ramezanian, Alireza Taherian, Kimia Dinashi, Amirali Miri, Shohreh Kasaei

机构 * Sharif University of Technology(谢里夫科技大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Published at TMLR (102 pages, 10 figures, 17 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏