arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-05 至 2025-12-05 共收录 53 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 32 篇

2512.04648 2025-12-05 cond-mat.stat-mech physics.app-ph 50%

Persson's Theory of Purely Normal Elastic Rough Surface Contact: A Tutorial Based on Stochastic Process Theory

Persson理论中的纯法向弹性粗糙表面接触:基于随机过程理论的教程

Yang Xu, Xiaobao Li, Qi Chen, Yunong Zhou

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文基于随机过程理论,为不熟悉Persson理论的学者提供了一篇详细的教程,澄清了该理论的推导过程和关键假设。

Journal ref Int. J. Solids Struct. 112684 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04675 2025-12-05 cs.CR 50%

Cryptanalysis of Gleeok-128

Gleeok-128的密码分析

Siwei Chen, Peipei Xie, Shengyuan Xu, Xiutao Feng, Zejun Xiang, Xiangyong Zeng

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文对Gleeok-128进行了首次全面的第三方密码分析,提出了基于MILP的两阶段框架和积分密钥恢复方法,揭示了其多分支结构的安全性问题,并优化了线性层参数以提高抗性。

Comments 44 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04639 2025-12-05 cs.SI cs.AI 50%

When GenAI Meets Fake News: Understanding Image Cascade Dynamics on Reddit

当生成式AI遇见假新闻:在Reddit上理解图像级联动态

Saumya Chauhan, Mila Hong, Maria Vazhaeparambil

机构 * Computing + Mathematical Sciences(计算与数学科学) California Institute of Technology(加利福尼亚理工学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究首次分析了Reddit上AI生成图像和虚假信息在不同意识形态社区中的传播动态,通过整合文本情感、视觉属性和扩散指标,预测了即时和长期的病毒传播效果。

Comments Accepted at 2025 MIT Undergraduate Research Technology Conference (URTC'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04631 2025-12-05 cond-mat.mes-hall 50%

Hole to Electron Crossover in a (Cd,Mn)Te Quantum Well through Surface Metallization

(Cd,Mn)Te量子井中通过表面金属化实现空穴到电子的交叉

Amadeusz Dydniański, Mateusz Raczyński, Aleksandra Łopion, Tomasz Kazimierczuk, Jacek Kasprzak, Karolina Ewa Połczyńska, Wojciech Pacuski, Piotr Kossacki

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究发现金和镍通过强结合钝化半导体表面,使(Cd,Mn)Te量子井的局部掺杂从p型转为n型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04381 2025-12-05 cs.RO 50%

FALCON: Actively Decoupled Visuomotor Policies for Loco-Manipulation with Foundation-Model-Based Coordination

FALCON:基于基础模型的解耦视觉-运动政策用于具有基础模型协调的移动- manipulation

Chengyang He, Ge Sun, Yue Bai, Junkai Lu, Jiadong Zhao, Guillaume Sartoretti

机构 * Department of Mechanical Engineering, College of Design and Engineering, National University of Singapore(机械工程系,设计与工程学院,新加坡国立大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 FALCON通过基于基础模型的解耦视觉-运动策略,实现移动- manipulation任务中更高效的协调与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04129 2025-12-05 cs.CR 50%

Tipping the Dominos: Topology-Aware Multi-Hop Attacks on LLM-Based Multi-Agent Systems

推倒多米诺骨牌:面向基于大语言模型的多智能体系统的拓扑感知多跳攻击

Ruichao Liang, Le Yin, Jing Chen, Cong Wu, Xiaoyu Zhang, Huangpeng Gu, Zijian Zhang, Yang Liu

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对基于大语言模型的多智能体系统,提出拓扑感知多跳攻击方法,揭示其内在安全漏洞并提出基于拓扑信任的防御框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16382 2025-12-05 cond-mat.mtrl-sci 50%

Quantifying Phase Transformations in Alloying Anodes via In-Situ Liquid Cell Hard X-ray Spectroscopy and Cryogenic Microscopy

通过原位液态细胞硬X射线光谱和低温显微镜量化合金阳极的相变

Neil Mulcahy, Syeda Ramin Jannat, Yaqi Li, Tigran Simonian, Mariana Palos, James O. Douglas, Jessica M. Walker, Baptiste Gault, Mary P. Ryan, Michele Shelly Conroy

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究通过原位X射线光谱和低温显微镜技术,揭示了铂基合金阳极在锂化过程中的相变机制及界面化学演变,为设计耐用的储能电极提供了新思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16945 2025-12-05 astro-ph.EP 50%

Global magnetohydrodynamic simulations of the inner regions of protoplanetary discs. I. Zero-net flux regime

类星盘内区的全球磁流体动力学模拟。I. 零净通量区

Matthew J. O. Roberts, Henrik N. Latter, Geoffroy Lesur

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究通过全球磁流体动力学模拟,揭示了类星盘内区磁流体动力学过程,包括磁场环形成、压力最大值发展及死区磁场生成,探讨了磁压风驱动吸积机制。

Comments 19 pages, 22 figures

Journal ref Mon Not R Astron Soc (2025) 1284-1303

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03541 2025-12-05 cond-mat.mtrl-sci 50%

Defect analysis of the $β$- to $γ$-Ga$_{2}$O$_{3}$ phase transition

从β相到γ相Ga₂O₃相变的缺陷分析

Umutcan Bektas, Maciej O. Liedke, Huan Liu, Fabian Ganss, Maik Butterling, Nico Klingner, René Hübner, Ilja Makkonen, Andreas Wagner, Gregor Hlawacek

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究通过多种方法分析了Ga₂O₃从β相到γ相相变过程中缺陷的变化及晶体质量。

Journal ref Adv. Funct. Mater. 2025, e09688

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17635 2025-12-05 gr-qc astro-ph.CO hep-ph hep-th 50%

Stochastic origin of primordial fluctuations in the Sky

原初涨落的随机起源:天空

Sayantan Choudhury

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究通过有效场论对随机膨胀的泛化,分析了单场模型中原初黑洞的产生机制,并评估了非高斯参数。

Comments 15 pages (10 pages material + 5 pages references), Essay written and received honorable mention for the Gravity Research Foundation 2025 Awards for Essays on Gravitation, Comments are welcome

Journal ref Int.J.Mod.Phys.D 34 (2025) 16, 2544023

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 5 篇

2511.22421 2025-12-05 cs.NI 85%

Semantic-Aware Caching for Efficient Image Generation in Edge Computing

面向边缘计算的语义感知缓存用于高效图像生成

Hanshuai Cui, Zhiqing Tang, Zhi Yao, Weijia Jia, Wei Zhao

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract)

AI总结 CacheGenius通过语义感知缓存和调度算法,在边缘计算中高效生成图像,减少41%的延迟和48%的计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04248 2025-12-05 cs.CV cs.AI 79%

MVRoom: Controllable 3D Indoor Scene Generation with Multi-View Diffusion Models

MVRoom: 基于多视角扩散模型的可控3D室内场景生成

Shaoheng Fang, Chaohui Yu, Fan Wang, Qixing Huang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) DAMO Academy, Alibaba Group(阿里巴巴达摩院) Hupan Lab(虎斑实验室)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

AI总结 MVRoom通过多视角扩散模型实现可控的3D室内场景生成,结合布局感知的极线注意力机制和迭代框架,提升多视角一致性和生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04534 2025-12-05 cs.CV 57%

Refaçade: Editing Object with Given Reference Texture

Refaçade: 基于给定参考纹理的物体编辑

Youze Huang, Penghui Ruan, Bojia Zi, Xianbiao Qi, Jianan Wang, Rong Xiao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 Refaçade通过纹理去除和局部纹理统计增强,实现精确可控的物体纹理迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04782 2025-12-05 math.AP 50%

Homogenized limits of Stokes flow and advective transport in thin perforated domains

细薄孔隙域中斯托克斯流与对流输运的均质极限

Markus Gahn, Vlad Revnic

专题命中 可控生成 :diffusion(abstract)

AI总结 研究细薄孔隙域中斯托克斯流与对流输运的均质化模型,推导有效方程并分析不同扩散条件下的对流-扩散行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04731 2025-12-05 cs.RO 50%

Bridging Simulation and Reality: Cross-Domain Transfer with Semantic 2D Gaussian Splatting

弥合仿真与现实:基于语义2D高斯点云的跨领域迁移

Jian Tang, Pu Pang, Haowen Sun, Chengzhong Ma, Xingyu Chen, Hua Huang, Xuguang Lan

专题命中 可控生成 :diffusion(abstract)

AI总结 本研究提出语义2D高斯点云方法,通过提取领域不变特征提升机器人操作的仿真到现实迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 2 篇

2512.04709 2025-12-05 eess.IV 75%

Multi Task Denoiser Training for Solving Linear Inverse Problems

多任务去噪器训练用于解决线性反问题

Clément Bled, François Pitié

专题命中 图像修复 :image generation(abstract);diffusion(abstract);inpainting(abstract)

AI总结 本文提出通过多任务训练提升去噪器,使其在解决线性反问题时更高效,实现PSNR提升并减少迭代次数。

Comments 9 pages, incl. 1 page references. Published at CVMP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04283 2025-12-05 cs.CV cs.LG 57%

Plug-and-Play Image Restoration with Flow Matching: A Continuous Viewpoint

即插即用图像恢复与流匹配:连续视角

Fan Jia, Yuhao Huang, Shih-Hsin Wang, Cristina Garcia-Cardona, Andrea L. Bertozzi, Bao Wang

机构 * Department of Mathematics, University of Utah, Salt Lake City, UT 84112, USA(犹他大学数学系) Los Alamos National Laboratory, Los Alamos, USA(洛斯阿拉莫斯国家实验室) Department of Mathematics, University of California, Los Angeles, USA(加州大学洛杉矶分校数学系)

专题命中 图像修复 :inpainting(abstract);分类 cs.CV

AI总结 本文提出基于随机微分方程的即插即用流匹配模型,通过量化误差和加速模型来提升图像恢复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 3 篇

2512.04515 2025-12-05 cs.CV 74%

EgoLCD: Egocentric Video Generation with Long Context Diffusion

EgoLCD:基于长上下文扩散的自体视频生成

Liuzhou Zhang, Jiarui Ye, Yuanlei Wang, Ming Zhong, Mingju Cao, Wanke Xia, Bowen Zeng, Zeyu Zhang, Hao Tang

机构 * Peking University(北京大学) Sun Yat-sen University(中山大学) Zhejiang University(浙江大学) Chinese Academy of Sciences(中国科学院) Tsinghua University(清华大学)

专题命中 个性化与一致性 :diffusion(title);分类 cs.CV

AI总结 EgoLCD通过结合长时稀疏KV缓存和LoRA扩展的注意力机制,实现了高效稳定的自体长上下文视频生成,提升了感知质量和时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05081 2025-12-05 cs.CV 57%

Deep Forcing: Training-Free Long Video Generation with Deep Sink and Participative Compression

深度强制:免训练 长视频生成与深度Sink和参与性压缩

Jung Yi, Wooseok Jang, Paul Hyunbin Cho, Jisu Nam, Heeji Yoon, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 深度强制通过深度Sink和参与性压缩机制,在无需微调的情况下实现长视频生成,提升生成质量与动态效果。

Comments Project Page: https://cvlab-kaist.github.io/DeepForcing/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16667 2025-12-05 q-bio.NC cs.CV eess.IV 57%

BrainPath: A Biologically-Informed AI Framework for Individualized Aging Brain Generation

BrainPath: 一种基于生物信息的AI框架,用于个性化衰老脑生成

Yifan Li, Javad Sohankar, Ji Luo, Jing Li, Yi Su

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 BrainPath通过引入三种架构创新,实现了个性化衰老脑生成,提高了生成准确性和解剖学忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 图像生成评测 1 篇

2512.04660 2025-12-05 cs.CV 79%

I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models

I2I-Bench: 一种全面的图像到图像编辑模型评估套件

Juntong Wang, Jiarui Wang, Huiyu Duan, Jiaxiang Kang, Guangtao Zhai, Xiongkuo Min

机构 * Institute of Image Communication and Network Engineering(图像通信与网络工程研究所) Shanghai Jiao Tong University(上海交通大学)

专题命中 图像生成评测 :image editing(title,abstract);分类 cs.CV

AI总结 I2I-Bench 提出了一种全面的图像到图像编辑模型评估套件,通过多样化的任务、全面的评估维度和严格的对齐验证,评估主流图像编辑模型的性能和权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 效率与蒸馏 1 篇

2512.05015 2025-12-05 cs.NE 50%

Plug-and-Play Homeostatic Spark: Zero-Cost Acceleration for SNN Training Across Paradigms

即插即用的稳态火花:跨范式的零成本加速SNN训练

Rui Chen, Xingyu Chen, Yaoqing Hu, Shihan Kong, Zhiheng Wu, Junzhi Yu

专题命中 效率与蒸馏 :diffusion(abstract)

AI总结 AHSAR通过保持层活动在适度范围内,实现跨范式的零成本加速SNN训练。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他图像生成 1 篇

2512.04109 2025-12-05 cs.CY 50%

ChatGPT-5 in Secondary Education: A Mixed-Methods Analysis of Student Attitudes, AI Anxiety, and Hallucination-Aware Use

ChatGPT-5在中学教育中的应用:学生态度、AI焦虑与幻觉意识使用混合方法分析

Tryfon Sivenas

专题命中 其他图像生成 :image generation(abstract)

AI总结 研究通过混合方法分析ChatGPT-5在中学教育中的应用,探讨学生态度、AI焦虑及幻觉意识使用,揭示教学优势与限制,提出知识保障策略。

详情

展开后加载摘要…

URL PDF HTML 收藏