arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-08-19 至 2025-08-19 共收录 78 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 59 篇

2508.11898 2025-08-19 cs.RO 50%

OmniD: Generalizable Robot Manipulation Policy via Image-Based BEV Representation

Jilei Mao, Jiarui Guan, Yingjuan Tang, Qirui Hu, Zhihang Li, Junjie Yu, Yongjie Mao, Yunzhe Sun, Shuang Liu, Xiaozhu Ju

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11897 2025-08-19 hep-ph nucl-ex nucl-th 50%

Simulation of heavy quarkonium equilibration in the quark-gluon plasma

Shouxing Zhao, Min He

专题命中 扩散模型 :diffusion(abstract)

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11633 2025-08-19 cs.CG math.AG math.MG 50%

Complementary bodies in sphere packing

Philip W. Kuchel

专题命中 扩散模型 :diffusion(abstract)

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07905 2025-08-19 physics.space-ph 50%

Investigating the Dependence of Normalized Reconnection Rate on Upstream Plasma Parameters

S. V. Heuer, K. J. Genestreti, Y. -H Liu, J. R. Shuster, X. Li, R. B. Torbert, J. L. Burch

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00588 2025-08-19 math.AP cs.NA math.NA 50%

Forward and backward problems for coupled subdiffusion systems

Dian Feng, Yikan Liu, Shuai Lu

专题命中 扩散模型 :diffusion(abstract)

Comments 26 pages, 7 figures

Journal ref Numerical Functional Analysis and Optimization, 46(4-5) (2025), 348-373

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 5 篇

2508.12919 2025-08-19 cs.CV 87%

7Bench: a Comprehensive Benchmark for Layout-guided Text-to-image Models

Elena Izzo, Luca Parolari, Davide Vezzaro, Lamberto Ballan

机构 * Department of Mathematics, University of Padova(帕多瓦大学数学系) Brain Technologies Innovation Division, Brain Technologies srl(Brain Technologies创新部门)

专题命中 可控生成 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);image synthesis(abstract)

Comments Accepted to ICIAP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11904 2025-08-19 cs.CV 86%

SafeCtrl: Region-Based Safety Control for Text-to-Image Diffusion via Detect-Then-Suppress

Lingyun Zhang, Yu Xie, Yanwei Fu, Ping Chen

专题命中 可控生成 :text-to-image(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00360 2025-08-19 cs.CV cs.GR 62%

Shape from Semantics: 3D Shape Generation from Multi-View Semantics

Liangchen Li, Caoliwen Wang, Yuqi Zhou, Bailin Deng, Juyong Zhang

机构 * University of Science and Technology of China(科学技术大学) Cardiff University(卡地夫大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Project page: https://shapefromsemantics.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13153 2025-08-19 cs.CV 57%

IGFuse: Interactive 3D Gaussian Scene Reconstruction via Multi-Scans Fusion

Wenhao Hu, Zesheng Li, Haonan Zhou, Liu Liu, Xuexiang Wen, Zhizhong Su, Xi Li, Gaoang Wang

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Project page: https://whhu7.github.io/IGFuse

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19183 2025-08-19 cs.CV 57%

Segmenting Objectiveness and Task-awareness Unknown Region for Autonomous Driving

Mi Zheng, Guanglei Yang, Zitong Huang, Zhenhua Guo, Kevin Han, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学) Tianyijiaotong Technology Ltd.(天翼交通科技有限公司) Independent Researcher(独立研究者)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 1 篇

2508.12336 2025-08-19 cs.CV 79%

Geometry-Aware Video Inpainting for Joint Headset Occlusion Removal and Face Reconstruction in Social XR

Fatemeh Ghorbani Lohesara, Karen Eguiazarian, Sebastian Knorr

机构 * Technische Universität Berlin(柏林技术大学) Tampere University(塔尔库大学) HTW Berlin(柏林应用技术大学)

专题命中 图像修复 :inpainting(title,abstract);分类 cs.CV

Journal ref Journal of Electronic Imaging 34(5), 051003 (9 August 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 2 篇

2508.11284 2025-08-19 cs.CV 70%

TimeMachine: Fine-Grained Facial Age Editing with Identity Preservation

Yilin Mi, Qixin Yan, Zheng-Peng Duan, Chunle Guo, Hubery Yin, Hao Liu, Chen Li, Chongyi Li

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02055 2025-08-19 cs.CV 57%

Style Ambiguity Loss Using CLIP

James Baker

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments arXiv admin note: substantial text overlap with arXiv:2407.12009

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 图像生成评测 2 篇

2503.14482 2025-08-19 cs.CV 70%

ICE-Bench: A Unified and Comprehensive Benchmark for Image Creating and Editing

Yulin Pan, Xiangteng He, Chaojie Mao, Zhen Han, Zeyinzi Jiang, Jingfeng Zhang, Yu Liu

专题命中 图像生成评测 :image generation(abstract);image editing(abstract);分类 cs.CV

Comments 17 pages. Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12498 2025-08-19 cs.HC 50%

Say It, See It: A Systematic Evaluation on Speech-Based 3D Content Generation Methods in Augmented Reality

Yanming Xiu, Joshua Chilukuri, Shunav Sen, Maria Gorlatova

专题命中 图像生成评测 :image generation(abstract)

Comments Accepted to ISMAR 2025 UNAI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 效率与蒸馏 3 篇

2508.10672 2025-08-19 cs.CV cs.AI 57%

Hybrid Generative Fusion for Efficient and Privacy-Preserving Face Recognition Dataset Generation

Feiran Li, Qianqian Xu, Shilong Bao, Boyu Han, Zhiyong Yang, Qingming Huang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院) BDKM, University of Chinese Academy of Sciences(中国科学院大学BDKM)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments This paper has been accpeted to ICCV 2025 DataCV Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01362 2025-08-19 cs.LG cs.CV 57%

Inverse Bridge Matching Distillation

Nikita Gushchin, David Li, Daniil Selikhanovych, Evgeny Burnaev, Dmitry Baranchuk, Alexander Korotin

机构 * Skolkovo Institute of Science and Technology(斯克尔克沃科学与技术学院) Yandex Research(Yandex研究) HSE University(俄罗斯高等经济大学) Artificial Intelligence Research Institute(人工智能研究 institute) Moscow Institute of Physics and Technology(莫斯科物理技术学院)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13747 2025-08-19 cs.LG stat.ME stat.ML 50%

Reverse Markov Learning: Multi-Step Generative Models for Complex Distributions

Xinwei Shen, Nicolai Meinshausen, Tong Zhang

专题命中 效率与蒸馏 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏