arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-21 至 2026-01-21 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 4 篇

2401.10061 2026-01-21 cs.CV cs.AI 83%

DiffusionAgent: Navigating Expert Models for Agentic Image Generation

DiffusionAgent: 专家模型导航用于代理图像生成

Jie Qin, Jie Wu, Weifeng Chen, Yueming Lyu

机构 * Meituan(美团) ByteDance(字节跳动) Nanjing University(南京大学)

专题命中 图像生成评测 :image generation(title);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 DiffusionAgent通过统一代理框架实现多领域图像生成,结合树状思维导航和优势数据库提升生成质量与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16899 2026-01-21 cs.CL cs.CV 70%

Multimodal RewardBench 2: Evaluating Omni Reward Models for Interleaved Text and Image

多模态奖励基准2:评估多模态奖励模型用于交错文本和图像

Yushi Hu, Reyhane Askari-Hemmat, Melissa Hall, Emily Dinan, Luke Zettlemoyer, Marjan Ghazvininejad

机构 * FAIR at Meta Superintelligence Labs(Meta超智能实验室的FAIR)

专题命中 图像生成评测 :text-to-image(abstract);image editing(abstract);分类 cs.CV

AI总结 多模态奖励基准2评估多模态奖励模型在交错文本和图像任务中的性能,通过专家标注数据和先进模型对比,揭示了不同模型在多模态理解与生成任务中的准确率差异。

Comments Code and data available at https://github.com/facebookresearch/MMRB2

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14241 2026-01-21 cs.LG cs.AI physics.soc-ph 50%

Beyond MMD: Evaluating Graph Generative Models with Geometric Deep Learning

超越MMD:利用几何深度学习评估图生成模型

Salvatore Romano, Marco Grassia, Giuseppe Mangioni

机构 * Dipartimento di Ingegneria Elettrica, Elettronica e Informatica University of Catania, Italy(电子工程与信息学院 巴勒莫大学)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出RGM方法,利用几何深度学习评估图生成模型,发现MMD评估不足,指出两种模型在结构特征保留上的局限性。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12628 2026-01-21 cs.SI 50%

Constructing a Dataset to Support Agent-Based Modeling of Online Interactions: Users, Topics, and Interaction Networks

构建支持在线交互 agent-based 模型的数据集:用户、话题和交互网络

Abdul Sittar, Miha Cesnovar, Alenka Gucek, Marko Grobelnik

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文通过构建基于 Reddit 的大规模数据集,支持 agent-based 模型研究用户、话题和交互网络的现实性与验证。

详情

展开后加载摘要…

URL PDF HTML 收藏