arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-09 至 2026-01-09 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 2 篇

2601.04300 2026-01-09 cs.CV 79%

Beyond Binary Preference: Aligning Diffusion Models to Fine-grained Criteria by Decoupling Attributes

超越二元偏好:通过解耦属性对齐扩散模型以实现细粒度标准

Chenye Meng, Zejian Li, Zhongni Liu, Yize Li, Changle Xie, Kaixin Jia, Ling Yang, Huanghuang Deng, Shiying Ding, Shengyuan Zhang, Jiayi Li, Lingyun Sun

机构 * Zhejiang University(浙江大学) University of Electronic Science and Technology of China(电子科技大学) Peking University(北京大学) University of Nottingham Ningbo China(诺丁汉大学宁波分校)

专题命中 图像生成评测 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出CPO方法,通过解耦属性实现扩散模型对细粒度标准的对齐,提升生成质量与专业对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11041 2026-01-09 cs.CV 57%

Beyond Fixed Topologies: Unregistered Training and Comprehensive Evaluation Metrics for 3D Talking Heads

超越固定拓扑:用于3D说话人脸的无注册训练和综合评估指标

Federico Nocentini, Thomas Besnier, Claudio Ferrari, Sylvain Arguillere, Mohamed Daoudi, Stefano Berretti

机构 * MICC, University of Florence(佛罗伦萨大学MICC) CRIStAL, University of Lille, CNRS, Centrale Lille(里尔大学CRIStAL) IMT Nord Europe, University of Lille(里尔大学IMT Nord Europe) Dept. of Information Engineering and Mathematics, University of Siena(锡耶纳大学信息工程与数学系) Laboratoire Paul Painlevé, University of Lille, CNRS(里尔大学Paul Painlevé实验室)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 本文提出了一种能够处理任意拓扑的3D说话人脸生成方法,通过热扩散预测鲁棒特征,并引入新的评估指标以提升唇同步效果。

Comments https://fedenoce.github.io/scantalk/

Journal ref International Journal of Computer Vision 2025

详情

展开后加载摘要…

URL PDF HTML 收藏