arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-20 至 2025-10-20 共收录 69 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 6 篇

2510.15783 2025-10-20 cs.CV 57%

ReCon: Region-Controllable Data Augmentation with Rectification and Alignment for Object Detection

Haowei Zhu, Tianxiang Pan, Rui Qin, Jun-Hai Yong, Bin Wang

机构 * Tsinghua University(清华大学) Li Auto Inc.(力汽车公司) BNRist(BNR机构)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025 (spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15564 2025-10-20 cs.CV 57%

Imaginarium: Vision-guided High-Quality 3D Scene Layout Generation

Xiaoming Zhu, Xu Huang, Qinghongbing Xie, Zhi Deng, Junsheng Yu, Yirui Guan, Zhongyuan Liu, Lin Zhu, Qijun Zhao, Ligang Liu, Long Zeng

机构 * Tsinghua University(清华大学) Tencent(腾讯) Southeast University(东南大学) University of Science and Technology of China(中国科学技术大学)

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14952 2025-10-20 cs.RO cs.CV 57%

From Language to Locomotion: Retargeting-free Humanoid Control via Motion Latent Guidance

Zhe Li, Cheng Chi, Yangyang Wei, Boan Zhu, Yibo Peng, Tao Huang, Pengwei Wang, Zhongyuan Wang, Shanghang Zhang, Chang Xu

机构 * University of Sydney(悉尼大学) BAAI(北京人工智能研究院) Harbin Institute of Technology(哈尔滨工业大学) Hong Kong University of Science and Technology(香港科学与技术大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像修复 1 篇

2509.14777 2025-10-20 cs.CV 57%

Dataset Distillation for Super-Resolution without Class Labels and Pre-trained Models

Sunwoo Cho, Yejin Jung, Nam Ik Cho, Jae Woong Soh

机构 * Department of Electrical and Computer Engineering, INMC, Seoul National University(电气与计算机工程系,INMC,首尔国立大学) Graduate School of Engineering Practice, INMC, Seoul National University(工程实践研究生院,INMC,首尔国立大学) Department of Electrical Engineering and Computer Science, Gwangju Institute of Science and Technology(电气与计算机科学系,全州科学技术院)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

Comments code : https://github.com/sunwoocho/SRDD

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 3 篇

2510.15194 2025-10-20 cs.CV 57%

Salient Concept-Aware Generative Data Augmentation

Tianchen Zhao, Xuanbai Chen, Zhihua Li, Jun Fang, Dongsheng An, Xiang Xu, Zhuowen Tu, Yifan Xing

机构 * AWS DS3

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

Comments 10 pages, 4 figures, NeurIPS2025

Journal ref NeurIPS2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15021 2025-10-20 cs.CV 57%

Constantly Improving Image Models Need Constantly Improving Benchmarks

Jiaxin Ge, Grace Luo, Heekyung Lee, Nishant Malpani, Long Lian, XuDong Wang, Aleksander Holynski, Trevor Darrell, Sewon Min, David M. Chan

机构 * UC Berkeley(伯克利大学)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15671 2025-10-20 cs.CV 57%

CHROME: Clothed Human Reconstruction with Occlusion-Resilience and Multiview-Consistency from a Single Image

Arindam Dutta, Meng Zheng, Zhongpai Gao, Benjamin Planche, Anwesha Choudhuri, Terrence Chen, Amit K. Roy-Chowdhury, Ziyan Wu

机构 * University of California, Riverside(加州大学河滨分校) United Imaging Intelligence(联合影像智能)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 1 篇

2510.14049 2025-10-20 cs.LG cs.MS 50%

CausalVerse: Benchmarking Causal Representation Learning with Configurable High-Fidelity Simulations

Guangyi Chen, Yunlong Deng, Peiyuan Zhu, Yan Li, Yifan Shen, Zijian Li, Kun Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 图像生成评测 :image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 1 篇

2510.15628 2025-10-20 quant-ph 50%

Time evolution of the Husimi and Glauber-Sudarshan functions in terms of complementary Hamiltonian symbols

Mritunjay Tyagi, Simon Friederich

专题命中 效率与蒸馏 :diffusion(abstract)

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏