arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-18 至 2025-11-18 共收录 133 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 87 篇

2409.20090 2025-11-18 cond-mat.soft nlin.PS physics.bio-ph 50%

Chemotaxis-induced phase separation

Henrik Weyer, David Muramatsu, Erwin Frey

专题命中 扩散模型 :diffusion(abstract)

Comments 8 pages Main text, 25 pages Supplementary Information; 4 figures; v2: published version

Journal ref Phys. Rev. Lett. 135, 208402 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07097 2025-11-18 quant-ph cond-mat.mtrl-sci physics.app-ph physics.optics 50%

High-purity and stable single-photon emission in bilayer WSe$_2$ via phonon-assisted excitation

Claudia Piccinini, Athanasios Paralikis, José Ferreira Neto, Abdulmalik Abdulkadir Madigawa, Paweł Wyborski, Vikas Remesh, Luca Vannucci, Niels Gregersen, Battulga Munkhbat

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02016 2025-11-18 quant-ph 50%

Brownian Particles and Matter Waves

Nicos Makris

专题命中 扩散模型 :diffusion(abstract)

Journal ref Quantum Reports, MDPI, Vol 7, 54, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12146 2025-11-18 math.PR 50%

Generalized Wright Analysis: Stochastic and Applications

W. Bock, L. Cristofaro, J. L. da Silva

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11957 2025-11-18 astro-ph.EP astro-ph.IM 50%

Functionality of Ice Line Latitudinal EBM Tenacity (FILLET). Protocol Version 1.1

Rory Barnes, Russell Deitrick, Jacob Haqq-Misra, Shintaro Kadoya, Ramses Ramirez, Paolo Simonetti, Vidya Venkatesan, Thomas J. Fauchez

专题命中 扩散模型 :diffusion(abstract)

Comments 5 pages, accepted to PSJ

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11782 2025-11-18 stat.ME math.PR 50%

Approximate Bayesian computation for stochastic hybrid systems with ergodic behaviour

Sascha Desmettre, Agnes Mallinger, Amira Meddah, Irene Tubikanec

专题命中 扩散模型 :diffusion(abstract)

Comments 30 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11762 2025-11-18 cs.LG 50%

Sumudu Neural Operator for ODEs and PDEs

Ben Zelenskiy, Saibilila Abudukelimu, George Flint, Kevin Zhu, Sunishchal Dev

专题命中 扩散模型 :diffusion(abstract)

Comments 5th Annual AAAI Workshop on AI to Accelerate Science and Engineering (AI2ASE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11737 2025-11-18 cs.LG cs.AI cs.CE 50%

DK-Root: A Joint Data-and-Knowledge-Driven Framework for Root Cause Analysis of QoE Degradations in Mobile Networks

Qizhe Li, Haolong Chen, Jiansheng Li, Shuqi Chai, Xuan Li, Yuzhou Hou, Xinhua Shao, Fangfang Li, Kaifeng Han, Guangxu Zhu

机构 * Shenzhen Research Institute of Big Data(深圳大数据研究院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Experience Lab(体验实验室) Huawei Technologies Co., Ltd.(华为技术有限公司) China Telecommunications Group Co., Ltd.(中国电信集团有限公司) China Academy of Information and Communications Technology(信息通信技术研究院)

专题命中 扩散模型 :diffusion(abstract)

Comments 13 pages, submitted for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11734 2025-11-18 cs.LG cs.AI 50%

Physics-Informed Neural ODEs with Scale-Aware Residuals for Learning Stiff Biophysical Dynamics

Kamalpreet Singh Kainth, Prathamesh Dinesh Joshi, Raj Abhijit Dandekar, Rajat Dandekar, Sreedat Panat

机构 * Vizuara AI Labs(Vizuara人工智能实验室)

专题命中 扩散模型 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.13173 2025-11-18 math.ST stat.TH 50%

Nonparametric Drift Estimation from Diffusions with Correlated Brownian Motions

Fabienne Comte, Nicolas Marie

专题命中 扩散模型 :diffusion(abstract)

Comments 29 pages, 4 figures

Journal ref Journal of Multivariate Analysis 198, 23 pages, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 14 篇

2511.11693 2025-11-18 cs.AI cs.CR cs.CV cs.LG 87%

Value-Aligned Prompt Moderation via Zero-Shot Agentic Rewriting for Safe Image Generation

Xin Zhao, Xiaojun Chen, Bingshan Liu, Zeyao Liu, Zhendong Zhao, Xiaoyan Gu

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);generative vision(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10825 2025-11-18 cs.CV 79%

OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding

Dianbing Xi, Jiepeng Wang, Yuanzhi Liang, Xi Qiu, Yuchi Huo, Rui Wang, Chi Zhang, Xuelong Li

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI 2026. Our project page: https://tele-ai.github.io/OmniVDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12032 2025-11-18 cs.CV 79%

Improved Masked Image Generation with Knowledge-Augmented Token Representations

Guotao Liang, Baoquan Zhang, Zhiyuan Wen, Zihao Han, Yunming Ye

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

Comments AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15222 2025-11-18 cs.AI cs.CV cs.MA 70%

See it. Say it. Sorted: Agentic System for Compositional Diagram Generation

Hantao Zhang, Jingyang Liu, Ed Li

机构 * Yale University(耶鲁大学) University of Edinburgh(爱丁堡大学)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00298 2025-11-18 cs.CV 70%

AniMer+: Unified Pose and Shape Estimation Across Mammalia and Aves via Family-Aware Transformer

Liang An, Jin Lyu, Li Lin, Pujin Cheng, Yebin Liu, Xiaoying Tang

机构 * Department of Electronic and Electrical Engineering, Southern University of Science and Technology, Shenzhen, China(南方科技大学电子与电气工程系) Department of Automation, Tsinghua University, Beijing, China(清华大学自动化系) Jiaxing Research Institute, Southern University of Science and Technology, Jiaxing, China(南方科技大学嘉兴研究所) Department of Electrical and Electronic Engineering, the University of Hong Kong, Hong Kong, China(香港大学电子与电气工程系)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to TPAMI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13684 2025-11-18 cs.CV cs.LG 57%

Training-Free Multi-View Extension of IC-Light for Textual Position-Aware Scene Relighting

Jiangnan Ye, Jiedong Zhuang, Lianrui Mu, Wenjie Zheng, Jiaqi Hu, Xingze Zou, Jing Wang, Haoji Hu

机构 * College of Information Science(信息科学学院) Electronic Engineering, Zhejiang University, Hangzhou, 310027, Zhejiang, China(电子工程系,浙江大学,杭州,310027,浙江,中国)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Submitting for Neurocomputing

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13191 2025-11-18 cs.CV 57%

Birth of a Painting: Differentiable Brushstroke Reconstruction

Ying Jiang, Jiayin Lu, Yunuo Chen, Yumeng He, Kui Wu, Yin Yang, Chenfanfu Jiang

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26196 2025-11-18 cs.CV 57%

Sketch2PoseNet: Efficient and Generalized Sketch to 3D Human Pose Prediction

Li Wang, Yiyu Zhuang, Yanwen Wang, Xun Cao, Chuan Guo, Xinxin Zuo, Hao Zhu

机构 * Nanjing University(南京大学) Snap Inc.(Snap公司) Concordia University(Concordia大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments SIGGRAPH Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19946 2025-11-18 cs.CV 57%

SCALAR: Scale-wise Controllable Visual Autoregressive Learning

Ryan Xu, Dongyang Jin, Yancheng Bai, Rui Lan, Xu Duan, Lei Sun, Xiangxiang Chu

机构 * Alibaba Group(阿里巴巴集团)

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15095 2025-11-18 cs.CV 57%

VistaDepth: Improving far-range Depth Estimation with Spectral Modulation and Adaptive Reweighting

Mingxia Zhan, Li Zhang, Yingjie Wang, Xiaomeng Chu, Beibei Wang, Yanyong Zhang

机构 * Hefei University of Technology(合肥工业大学) University of Science and Technology of China(中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12030 2025-11-18 cs.CV 57%

VPHO: Joint Visual-Physical Cue Learning and Aggregation for Hand-Object Pose Estimation

Jun Zhou, Chi Xu, Kaifeng Tang, Yuting Ge, Tingrui Guo, Li Cheng

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 14 pages, 9 figures, extended version of the AAAI 2026 paper "VPHO: Joint Visual-Physical Cue Learning and Aggregation for Hand-Object Pose Estimation"

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.06421 2025-11-18 cs.CV cs.AI cs.LG 57%

Using Self-Supervised Auxiliary Tasks to Improve Fine-Grained Facial Representation

Mahdi Pourmirzaei, Gholam Ali Montazer, Farzaneh Esmaili

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26367 2025-11-18 math.AP math-ph math.MP math.SP 50%

Competition of small targets in planar domains: from Dirichlet to Robin and Steklov boundary condition

Denis S. Grebenkov, Michael J. Ward

专题命中 可控生成 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11909 2025-11-18 q-fin.MF 50%

Modeling and Stabilizing Financial Systemic Risk Using Optimal Control Theory

Jiacheng Wu

专题命中 可控生成 :diffusion(abstract)

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 2 篇

2511.13175 2025-11-18 cs.CV 79%

HDW-SR: High-Frequency Guided Diffusion Model based on Wavelet Decomposition for Image Super-Resolution

Chao Yang, Boqian Zhang, Jinghao Xu, Guang Jiang

机构 * Xidian University(西安电子科技大学)

专题命中 图像修复 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12040 2025-11-18 cs.CV 57%

SRSplat: Feed-Forward Super-Resolution Gaussian Splatting from Sparse Multi-View Images

Xinyuan Hu, Changyue Shi, Chuxiao Yang, Minghao Chen, Jiajun Ding, Tao Wei, Chen Wei, Zhou Yu, Min Tan

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

Comments AAAI2026-Oral. Project Page: https://xinyuanhu66.github.io/SRSplat/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 1 篇

2511.11754 2025-11-18 cs.CV 79%

Batch Transformer Architecture: Case of Synthetic Image Generation for Emotion Expression Facial Recognition

Stanislav Selitskiy

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 图像生成评测 4 篇

2504.14290 2025-11-18 cs.CV 86%

The Path to Reconciling Quality and Safety in Text-to-Image Generation: Dataset, Method, and Evaluation

Shouwei Ruan, Zhenyu Wu, Yao Huang, Ruochen Zhang, Yitong Sun, Caixin Kang, Shiji Zhao, Xingxing Wei

机构 * Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室)

专题命中 图像生成评测 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12675 2025-11-18 cs.CV 57%

Appreciate the View: A Task-Aware Evaluation Framework for Novel View Synthesis

Saar Stern, Ido Sobol, Or Litany

机构 * Technion(技术学院) NVIDIA(英伟达)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments 3DV 2026. Project page: https://saarst.github.io/appreciate-the-view-website

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12363 2025-11-18 cs.CV 57%

Explainable AI-Generated Image Detection RewardBench

Michael Yang, Shijian Deng, William T. Doan, Kai Wang, Tianyu Yang, Harsh Singh, Yapeng Tian

机构 * The University of Texas at Dallas(德克萨斯大学达拉斯分校) University of Toronto(多伦多大学) University of Notre Dame(诺特大学) Stony Brook University(石溪大学)

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏