arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-30 至 2026-01-30 共收录 1 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 1 篇

2601.20354 2026-01-30 cs.CV 83%

Everything in Its Place: Benchmarking Spatial Intelligence of Text-to-Image Models

万物皆有其位:文本到图像模型空间智能基准测试

Zengbin Wang, Xuecai Hu, Yong Wang, Feng Xiong, Man Zhang, Xiangxiang Chu

机构 * AMAP, Alibaba Group(AMAP、阿里巴巴集团)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出SpatialGenEval基准测试,通过信息密集的提示评估文本到图像模型的空间智能,揭示高阶空间推理的瓶颈,并构建SpatialT2I数据集提升模型性能。

Comments Accepted by ICLR 2026, URL: https://github.com/AMAP-ML/SpatialGenEval

详情

展开后加载摘要…

URL PDF HTML 收藏