arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-16 至 2026-02-16 共收录 6 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 6 篇

2602.12205 2026-02-16 cs.CV cs.AI 79%

DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing

DeepGen 1.0: 一种轻量级统一多模态模型,用于推进图像生成与编辑

Dianyi Wang, Ruihang Li, Feng Han, Chaofan Ma, Wei Song, Siyuan Wang, Yibin Wang, Yi Xin, Hongjian Liu, Zhixiong Zhang, Shengyuan Ding, Tianhang Wang, Zhenglin Cheng, Tao Lin, Cheng Jin, Kaicheng Yu, Jingjing Chen, Wenjie Wang, Zhongyu Wei, Jiaqi Wang

机构 * Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Nanjing University(南京大学) University of Southern California(南加州大学)

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

AI总结 DeepGen 1.0通过轻量级统一多模态模型在图像生成与编辑领域实现高性能,采用SCB框架和数据驱动训练策略,超越大参数模型表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05100 2026-02-16 cs.CE cs.CV cs.SC 57%

Rule-Based Spatial Mixture-of-Experts U-Net for Explainable Edge Detection

基于规则的时空专家混合U-Net可解释边缘检测

Bharadwaj Dogga, Kaaustaaub Shankar, Gibin Raju, Wilhelm Louw, Kelly Cohen

机构 * Ph.D. Candidate, AI Bio Lab, Digital Futures, University of Cincinnati, \ , OH 45221, USA e-mail: Research Student, AI Bio Lab, Digital Futures, University of Cincinnati, \ , OH 45221, USA e-mail: Postdoctoral Researcher, Department of Multidisciplinary Engineering, TA\&M University, \ Station, TX 77843, USA e-mail: Research Associate AI Bio Lab, Digital Futures, University of Cincinnati, \ , OH 45221, USA e-mail: Director AI Bio Lab, Digital Futures, University of Cincinnati, \ , OH 45221, USA e-mail

专题命中 可控生成 :image generation(abstract);分类 cs.CV

AI总结 基于规则的时空专家混合U-Net通过融合深度语义特征与启发式边缘信号,实现边缘检测的可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12401 2026-02-16 cs.CV 57%

ZeroDiff++: Substantial Unseen Visual-semantic Correlation in Zero-shot Learning

ZeroDiff++: 零样本学习中显著的未见视觉-语义相关性

Zihan Ye, Shreyank N Gowda, Kaile Du, Weijian Luo, Ling Shao

机构 * UCAS-Terminus AI Lab, University of Chinese Academy of Sciences(中国科学院大学Terminus AI实验室,中国科学院大学) School of Computer Science, the University of Nottingham(诺丁汉大学计算机学院) Southeast University(东南大学) hi-lab of Xiaohongshu Inc(小红书公司hi实验室)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 ZeroDiff++通过扩散生成框架提升零样本学习中视觉-语义相关性,解决虚假相关性和数据稀缺问题。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00741 2026-02-16 eess.IV cs.CV 57%

LesionDiffusion: Towards Text-controlled General Lesion Synthesis

LesionDiffusion:面向文本控制的通用病变合成

Wenhui Lei, Henrui Tian, Linrui Dai, Hanyu Chen, Xiaofan Zhang

机构 * Shanghai Jiaotong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The First Hospital of China Medical University(中国医科大学第一医院)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

AI总结 LesionDiffusion通过文本控制生成3D CT影像中的病变及掩码,提升病变分割性能,支持多种病变类型和器官,优于现有方法。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01504 2026-02-16 cs.LG 50%

Instruction-based Time Series Editing

基于指令的时间序列编辑

Jiaxing Qiu, Dongliang Guo, Brynne Sullivan, Teague R. Henry, Thomas Hartvigsen

机构 * University of Virginia(弗吉尼亚大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 InstructTime是一种基于指令的时间序列编辑器,通过自然语言指令实现灵活且可控的编辑,能够生成高质量的编辑结果并适应新条件。

Comments (KDD 26) Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining V.1

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05748 2026-02-16 cond-mat.mtrl-sci cond-mat.mes-hall 50%

Depth Profiling of Oxygen Migration in Ta/HfO2 Stacks During Ionic Liquid Gating

Ta/HfO2堆叠中氧迁移深度分析:在离子液体栅极下的研究

Beatrice Bednarz, Martin Wortmann, Olga Kuschel, Fabian Kammerbauer, Mathias Kläui, Andreas Hütten, Joachim Wollschläger, Gerhard Jakob, Timo Kuschel

专题命中 可控生成 :diffusion(abstract)

AI总结 研究通过IL栅极技术分析Ta/HfO2堆叠中氧迁移深度,揭示了氧掺杂与电场、氧化物厚度的关系,为磁离子和纳米离子器件设计提供理论依据。

Comments Document containing manuscript and supporting information

Journal ref ACS Appl. Mater. Interfaces 18, 6200 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏