arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-23 至 2025-09-23 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 5 篇

2506.23711 2025-09-23 cs.CV 79%

Subjective Camera 1.0: Bridging Human Cognition and Visual Reconstruction through Sequence-Aware Sketch-Guided Diffusion

Haoyang Chen, Dongfang Sun, Caoyuan Ma, Shiqin Wang, Kewei Zhang, Zheng Wang, Zhixiang Wang

机构 * National Engineering Research Center for Multimedia Software, Institute of Artificial Intelligence, School of Computer Science, Wuhan University(国家多媒体软件工程研究中心,人工智能研究院,计算机科学学院,武汉大学) Hubei Key Laboratory of Multimedia and Network Communication Engineering(湖北省多媒体与网络通信工程重点实验室) Zhongguancun Academy, Beijing, China(中关村学院,北京,中国) CyberAgent AI Lab, Japan(CyberAgent AI实验室,日本)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17757 2025-09-23 cs.CV cs.MA 77%

Multi-Agent Amodal Completion: Direct Synthesis with Fine-Grained Semantic Guidance

Hongxing Fan, Lipeng Wang, Haohua Chen, Zehuan Huang, Jiangtao Wu, Lu Sheng

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Beihang University(北京航空航天大学) School of Software(软件学院)

专题命中 可控生成 :diffusion(abstract);image editing(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16806 2025-09-23 cs.CV 77%

FOCUS: Unified Vision-Language Modeling for Interactive Editing Driven by Referential Segmentation

Fan Yang, Yousong Zhu, Xin Li, Yufei Zhan, Hongyin Zhao, Shurong Zheng, Yaowei Wang, Ming Tang, Jinqiao Wang

机构 * Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心) School of Artificial Intelligence, University of Chinese Academy of Science(中国科学院大学人工智能学院) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室) Wuhan AI Research, Wuhan, China(武汉人工智能研究所)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17476 2025-09-23 cs.CV 57%

Stable Video-Driven Portraits

Mallikarjun B. R., Fei Yin, Vikram Voleti, Nikita Drobyshev, Maksim Lapin, Aaryaman Vasishta, Varun Jampani

机构 * Stability AI University of Cambridge(剑桥大学) Cantina

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments https://stable-video-driven-portraits.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16550 2025-09-23 cs.RO cs.AI cs.SY eess.SY 50%

TranTac: Leveraging Transient Tactile Signals for Contact-Rich Robotic Manipulation

Yinghao Wu, Shuhong Hou, Haowen Zheng, Yichen Li, Weiyi Lu, Xun Zhou, Yitian Shao

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen, Shenzhen, China(计算机科学与技术学院,哈尔滨工业大学深圳校区) State Key Laboratory of Smart Farm Technologies and Systems, Harbin, China(智能农业技术与系统国家重点实验室,哈尔滨,中国)

专题命中 可控生成 :diffusion(abstract)

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏