arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-10 至 2026-02-10 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3 篇

2509.16748 2026-02-10 cs.CV 79%

HyPlaneHead: Rethinking Tri-plane-like Representations in Full-Head Image Synthesis

HyPlaneHead:重新思考全头图像合成中的三平面表示

Heyuan Li, Kenkun Liu, Lingteng Qiu, Qi Zuo, Keru Zheng, Zilong Dong, Xiaoguang Han

机构 * Tongyi Lab, Alibaba Inc.(阿里云实验室) SSE, CUHK (Shenzhen)(城市大学(深圳)信息科学与工程学院) FNii-Shenzhen Guangdong Provincial Key Laboratory of Future Networks of Intelligence(未来网络智能化广东省重点实验室)

专题命中 文生图 :image synthesis(title,abstract);分类 cs.CV

AI总结 HyPlaneHead通过引入混合平面表示,解决三平面表示中的特征纠缠和映射不均问题,提升全头图像合成性能。

Comments Accepted by NeurIPS 2025. Project page: https://lhyfst.github.io/hyplanehead/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08127 2026-02-10 cs.CV 70%

TIPO: Text to Image with Text Presampling for Prompt Optimization

TIPO: 文本到图像的文本预采样用于提示优化

Shih-Ying Yeh, Yi Li, Sang-Hyun Park, Giyeong Oh, Xuehai Wang, Min Song, Youngjae Yu, Shang-Hong Lai

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 TIPO通过文本预采样优化提示,提升文本到图像生成的视觉质量和人类偏好度。

Comments 50 pages, 28 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08145 2026-02-10 cs.LG cs.AI cs.CL cs.CV cs.CY 57%

Reliable and Responsible Foundation Models: A Comprehensive Survey

可靠且负责任的基础模型:全面综述

Xinyu Yang, Junlin Han, Rishi Bommasani, Jinqi Luo, Wenjie Qu, Wangchunshu Zhou, Adel Bibi, Xiyao Wang, Jaehong Yoon, Elias Stengel-Eskin, Shengbang Tong, Lingfeng Shen, Rafael Rafailov, Runjia Li, Zhaoyang Wang, Yiyang Zhou, Chenhang Cui, Yu Wang, Wenhao Zheng, Huichi Zhou, Jindong Gu, Zhaorun Chen, Peng Xia, Tony Lee, Thomas Zollo, Vikash Sehwag, Jixuan Leng, Jiuhai Chen, Yuxin Wen, Huan Zhang, Zhun Deng, Linjun Zhang, Pavel Izmailov, Pang Wei Koh, Yulia Tsvetkov, Andrew Wilson, Jiaheng Zhang, James Zou, Cihang Xie, Hao Wang, Philip Torr, Julian McAuley, David Alvarez-Melis, Florian Tramèr, Kaidi Xu, Suman Jana, Chris Callison-Burch, Rene Vidal, Filippos Kokkinos, Mohit Bansal, Beidi Chen, Huaxiu Yao

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 本文综述了基础模型的可靠和负责任发展,探讨了偏见、安全、不确定性等关键问题,并提出了未来研究方向。

Comments TMLR camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏