arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-06 至 2026-02-06 共收录 73 信号源:cs.CV, cs.GR, cs.MM

1. 图像修复 2 篇

2409.12636 2026-02-06 cs.CV cs.LG eess.IV 79%

Image inpainting for corrupted images by using the semi-super resolution GAN

利用半超分辨率GAN对损坏图像进行图像修复

Mehrshad Momen-Tayefeh, Mehrdad Momen-Tayefeh, Amir Ali Ghafourian Ghahramani

机构 * dept. Computer Engineering Sharif University of Technology International Campus Kish, Iran(计算机工程系 巴尔赫大学技术学院 国际校区 首都伊朗) Computer Engineering University of Tehran Tehran, Iran(计算机工程 技术大学 波斯语)

专题命中 图像修复 :inpainting(title,abstract);分类 cs.CV

AI总结 本文提出了一种半超分辨率GAN模型,用于修复受损图像,通过不同水平的像素损坏训练以提高图像修复的准确性和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18535 2026-02-06 eess.AS cs.SD 78%

Audio Inpainting in Time-Frequency Domain with Phase-Aware Prior

时频域中具有相位意识先验的音频修补

Peter Balušík, Pavel Rajmic

专题命中 图像修复 :inpainting(title,abstract)

AI总结 本文提出了一种基于相位意识先验的时频域音频修补方法,通过优化算法提升重建质量并降低计算成本,优于现有深度神经网络和自回归方法。

Comments submitted to IEEE for review

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 个性化与一致性 7 篇

2602.06043 2026-02-06 cs.LG cs.AI cs.CV 70%

Shared LoRA Subspaces for almost Strict Continual Learning

共享LoRA子空间用于近严格持续学习

Prakhar Kaushik, Ankit Vaidya, Shravan Chaudhari, Rama Chellappa, Alan Yuille

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 Share通过共享低秩子空间实现高效持续学习,减少参数和内存消耗,提升多任务适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05339 2026-02-06 cs.CV cs.LG 70%

Consistency-Preserving Concept Erasure via Unsafe-Safe Pairing and Directional Fisher-weighted Adaptation

通过不安全-安全配对和方向性Fisher加权适应进行一致性保持的概念擦除

Yongwoo Kim, Sungmin Cha, Hyunsoo Kim, Jaewon Lee, Donghyun Kim

机构 * Korea University(韩国大学) New York University(纽约大学) Korea Institute of Science(韩国科学技术院)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出PAIR框架,通过不安全-安全配对和方向性Fisher加权适应,实现对有害概念的精细化擦除,保持生成内容的结构和语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04994 2026-02-06 cs.CV cs.LG 57%

SIDeR: Semantic Identity Decoupling for Unrestricted Face Privacy

SIDeR:语义身份解耦用于无限制面部隐私保护

Zhuosen Bao, Xia Du, Zheng Lin, Jizhe Zhou, Zihan Fang, Jiening Wu, Yuxin Zhang, Zhe Chen, Chi-man Pun, Wei Ni, Jun Luo

机构 * School of Computer and Information Engineering, Xiamen University of Technology(厦门理工学院计算机与信息工程学院) Department of Electrical and Electronic Engineering, University of Hong Kong(香港大学电子与电气工程系) School of Computer Science, Engineering Research Center of Machine Learning and Industry Intelligence, Sichuan University(四川大学计算机科学学院,机器学习与工业智能工程研究中心) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) College of Artificial Intelligence, Southwest University(西南大学人工智能学院) School of Computer Science, Fudan University(复旦大学计算机科学学院) Department of Computer and Information Science, Faculty of Science and Technology, University of Macau(澳门大学科技学院计算机与信息科学系) Data61, CSIRO(CSIRO Data61) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 SIDeR通过语义解耦驱动框架实现面部隐私保护,生成视觉匿名的对抗性样本并保持身份一致性,实验显示其在攻击成功率和恢复质量上均优于现有方法。

Comments 14 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03039 2026-02-06 cs.CV 57%

HP-GAN: Harnessing pretrained networks for GAN improvement with FakeTwins and discriminator consistency

HP-GAN: 利用预训练网络提升GAN性能的FakeTwins与判别器一致性方法

Geonhui Son, Jeong Ryong Lee, Dosik Hwang

机构 * School of Electrical and Electronic Engineering, Yonsei University, Seoul, Republic of Korea(电气电子工程学院,延世大学,首尔,大韩民国) Robotics Institute, Korea Institute of Science and Technology, Seoul, Republic of Korea(机器人研究所,韩国科学技术院,首尔,大韩民国) Department of Oral and Maxillofacial Radiology, Yonsei University College of Dentistry, Seoul, Republic of Korea(口腔和颌面放射科,延世大学牙科学院,首尔,大韩民国)

专题命中 个性化与一致性 :image synthesis(abstract);分类 cs.CV

AI总结 HP-GAN通过FakeTwins和判别器一致性技术提升GAN性能,有效增强图像多样性和质量。

Comments Accepted manuscript. This is the accepted version of the article published in Neural Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05632 2026-02-06 math.NA cs.NA math.AP 50%

Numerical stationary states for nonlocal Fokker-Planck equations via fixed points of consistency maps

通过一致性映射的不动点计算非局部福克-普朗克方程的数值稳态解

José A. Carrillo, Yurij Salmaniw, Antonio León Villares

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 本文提出了一种基于不动点的数值方法,用于计算非局部福克-普朗克方程的稳态解,通过矩阵自由牛顿-克罗内克方法解决有限维问题,并验证了新分支行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05104 2026-02-06 eess.IV 50%

Personalized White Matter Bundle Segmentation for Early Childhood

儿童个性化白质束分割

Elyssa M. McMaster, Michael E. Kim, Nancy R. Newlin, Gaurav Rudravaram, Adam M. Saunders, Aravind R. Krishnan, Jongyeon Yoon, Ji S. Kim, Bryce L. Geeraert, Meaghan V. Perdue, Catherine Lebel, Daniel Moyer, Kurt G. Schilling, Laurie E. Cutting, Bennett A. Landman

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 本文提出一种针对儿童的个性化白质束分割方法,通过改进深度学习模型和评估方法,提高了白质分割的准确性与鲁棒性,为儿童神经发育研究和白质疾病诊断提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04933 2026-02-06 cs.CR cs.CY 50%

The Birthmark Standard: Privacy-Preserving Photo Authentication via Hardware Roots of Trust and Consortium Blockchain

出生烙印标准:通过硬件根信任和联盟区块链实现隐私保护的图像认证

Sam Ryan

专题命中 个性化与一致性 :image generation(abstract)

AI总结 本研究提出一种基于硬件根信任和联盟区块链的图像认证方法,通过传感器熵生成认证密钥,确保隐私安全并提高验证效率。

Comments 32 pages, 2 figures. Technical specification and security analysis for metadata-independent photo authentication. Prototype implementation with Raspberry Pi 4 hardware

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像生成评测 1 篇

2602.05577 2026-02-06 cs.CV 70%

LocateEdit-Bench: A Benchmark for Instruction-Based Editing Localization

LocateEdit-Bench:基于指令的编辑本地化基准测试

Shiyu Wu, Shuyan Li, Jing Li, Jing Liu, Yequan Wang

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) School of EEECS, Queen's University Belfast, Northern Ireland, UK(女王大学 Belfast 电子工程与计算机科学学院) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Peking University, Beijing, China(北京大学)

专题命中 图像生成评测 :image editing(abstract);inpainting(abstract);分类 cs.CV

AI总结 LocateEdit-Bench是一个针对基于指令的编辑本地化问题设计的大规模数据集,整合了四种先进编辑模型,用于评估和推动伪造本地化方法的发展。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 效率与蒸馏 3 篇

2602.05909 2026-02-06 cs.CV 70%

CLIP-Map: Structured Matrix Mapping for Parameter-Efficient CLIP Compression

CLIP-Map: 结构化矩阵映射用于参数高效的CLIP压缩

Kangjie Zhang, Wenxuan Huang, Xin Zhou, Boxiang Zhou, Dejia Song, Yuan Xie, Baochang Zhang, Lizhuang Ma, Nemo Chen, Xu Tang, Yao Hu, Shaohui Lin

机构 * East China Normal University(东华师范大学) Xiaohongshu Inc.(小红书公司) Beihang University(北航大学)

专题命中 效率与蒸馏 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 CLIP-Map通过结构化矩阵映射和克罗内克因子分解实现参数高效的CLIP压缩,有效保留原始权重信息并在高压缩比下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05616 2026-02-06 cs.LG cs.AI 50%

Path-Guided Flow Matching for Dataset Distillation

路径引导的流匹配用于数据集蒸馏

Xuhui Li, Zhengquan Luo, Xiwei Liu, Yongqiang Yu, Zhiqiang Xu

机构 * Department of Machine Learning, MBZUAI, Abu Dhabi, UAE(机器学习系,MBZUAI,阿布扎赫德,阿联酋) Department of Computer Vision, MBZUAI, Abu Dhabi, UAE(计算机视觉系,MBZUAI,阿布扎赫德,阿联酋)

专题命中 效率与蒸馏 :diffusion(abstract)

AI总结 PGFM通过流匹配框架实现高效数据集蒸馏,以更少的采样步骤和更高的效率生成高质量的合成数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05077 2026-02-06 physics.med-ph 50%

Laterally Oscillating Trajectory for Undersampling Slices: LOTUS

横向振荡轨迹用于欠采样切片:LOTUS

Mayuri Sothynathan, Paul I. Dubovan, Corey. A. Baron

专题命中 效率与蒸馏 :diffusion(abstract)

AI总结 LOTUS通过受控非相干混叠降低g因子,提升扩散MRI的重建精度和扫描效率。

Comments 31 pages, 8 figures, 3 supplementary figures, submitted to Magnetic Resonance in Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏