arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-21 至 2026-01-21 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 5 篇

2411.13794 2026-01-21 cs.CV 89%

GalaxyEdit: Large-Scale Image Editing Dataset with Enhanced Diffusion Adapter

GalaxyEdit: 大规模图像编辑数据集与增强扩散适配器

Aniruddha Bala, Rohan Jaiswal, Siddharth Roheda, Rohit Chowdhury, Loay Rashid

机构 * Samsung R&D Institute India(三星印度研发院) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 图像编辑 :image editing(title,abstract);diffusion(title);image generation(abstract);text-to-image(abstract)

AI总结 GalaxyEdit通过自动化数据生成和增强ControlNet-xs,提升大规模图像编辑任务的性能与效率。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14124 2026-01-21 cs.CL cs.AI 78%

Style Transfer as Bias Mitigation: Diffusion Models for Synthetic Mental Health Text for Arabic

风格迁移作为偏见缓解:用于阿拉伯语合成心理健康文本的扩散模型

Saad Mankarious, Aya Zirikly

机构 * School of Engineering and Applied Science(工程与应用科学学院) George Washington University(乔治·华盛顿大学)

专题命中 图像编辑 :diffusion(title,abstract)

AI总结 本文提出基于扩散模型的风格迁移方法,用于生成阿拉伯语心理健康文本,以缓解性别偏见问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13551 2026-01-21 cs.CV 74%

DiffFace-Edit: A Diffusion-Based Facial Dataset for Forgery-Semantic Driven Deepfake Detection Analysis

DiffFace-Edit: 一种基于扩散的面部数据集用于伪造-语义驱动的深度伪造检测分析

Feng Ding, Wenhui Yi, Xinan He, Mengyao Xiao, Jianfeng Xu, Jianqiang Du

机构 * NanChang University(南昌大学)

专题命中 图像编辑 :diffusion(title);分类 cs.CV

AI总结 DiffFace-Edit数据集通过引入细粒度面部编辑和检测器逃避样本分析,提升深度伪造检测的鲁棒性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12234 2026-01-21 cs.GR cs.AI cs.CV 62%

Proc3D: Procedural 3D Generation and Parametric Editing of 3D Shapes with Large Language Models

Proc3D: 基于大语言模型的3D形状过程生成与参数编辑

Fadlullah Raji, Stefano Petrangeli, Matheus Gadelha, Yu Shen, Uttaran Bhattacharya, Gang Wu

专题命中 图像编辑 :image editing(abstract);分类 cs.CV、cs.GR

AI总结 Proc3D利用大语言模型实现3D形状的可编辑生成,通过参数化编辑提升设计效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14259 2026-01-21 cs.CV 57%

ManipShield: A Unified Framework for Image Manipulation Detection, Localization and Explanation

ManipShield: 一种用于图像篡改检测、定位和解释的统一框架

Zitong Xu, Huiyu Duan, Xiaoyu Wang, Zhaolin Cai, Kaiwei Zhang, Qiang Hu, Jing Liu, Xiongkuo Min, Guangtao Zhai

机构 * Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(上海交通大学图像通信与网络工程研究所) University of Electronic and Science Technology of China(电子科技大学) Tianjin University(天津大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 ManipShield基于多模态大语言模型,通过对比学习LoRA微调和任务特定解码器,实现图像篡改的统一检测、定位和解释。

详情

展开后加载摘要…

URL PDF HTML 收藏