arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-22 至 2025-12-22 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4 篇

2512.17350 2025-12-22 cs.CV 70%

Beyond Semantic Features: Pixel-level Mapping for Generalized AI-Generated Image Detection

超越语义特征:用于通用AI生成图像检测的像素级映射

Chenming Zhou, Jiaan Wang, Yu Li, Lei Li, Juan Cao, Sheng Tang

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出通过像素级映射预处理破坏图像语义特征,提升AI生成图像检测器的跨模型泛化能力。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17040 2025-12-22 cs.CV 57%

Infinite-Homography as Robust Conditioning for Camera-Controlled Video Generation

无限透视作为摄像机控制的鲁棒条件化方法用于摄像机控制的视频生成

Min-Jung Kim, Jeongho Kim, Hoiyeong Jin, Junha Hyung, Jaegul Choo

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 InfCam通过无限透视变形和数据增强管道,实现高姿态保真度的摄像机控制视频生成,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14280 2025-12-22 cs.CV 57%

EasyHOI: Unleashing the Power of Large Models for Reconstructing Hand-Object Interactions in the Wild

EasyHOI: 释放大模型潜力以重建真实场景中的手-物体交互

Yumeng Liu, Xiaoxiao Long, Zemin Yang, Yuan Liu, Marc Habermann, Christian Theobalt, Yuexin Ma, Wenping Wang

机构 * The University of Hong Kong(香港大学) ShanghaiTech University(上海科技大学) Hong Kong University of Science and Technology(香港科学大学) Nanyang Technological University(南洋理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) Texas A&M University(德克萨斯大学奥斯汀分校)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

AI总结 EasyHOI利用大模型实现单视角下手-物体交互的重建,通过先验引导优化提升重建精度。

Comments Project page: https://lym29.github.io/EasyHOI-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17839 2025-12-22 math.OC math.AP 50%

Time Optimal Control Problem for the Landau-Lifshitz-Bloch equation

Landau-Lifshitz-Bloch方程的时间最优控制问题

Sidhartha Patnaik, Kumarasamy Sakthivel

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了Landau-Lifshitz-Bloch方程的时间最优控制问题,通过推导优化条件,为磁态快速操控提供理论基础,并推动高速磁记忆技术发展。

详情

展开后加载摘要…

URL PDF HTML 收藏