arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-14 至 2025-11-14 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3 篇

2511.10136 2025-11-14 cs.CV cs.AI 86%

Right Looks, Wrong Reasons: Compositional Fidelity in Text-to-Image Generation

Mayank Vatsa, Aparna Bharati, Richa Singh

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Accepted in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10154 2025-11-14 cs.CV cs.AI 83%

GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval

Hao Zou, Runqing Zhang, Xue Zhou, Jianxiao Zou

机构 * School of Automation Engineering, University of Electronic Science and Technology of China(自动化工程学院,电子科学与技术大学) Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(深圳高级研究学院,电子科学与技术大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 8pages,3figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10268 2025-11-14 cs.AI 50%

Causal-HalBench: Uncovering LVLMs Object Hallucinations Through Causal Intervention

Zhe Xu, Zhicai Wang, Junkang Wu, Jinda Lu, Xiang Wang

专题命中 文生图 :text-to-image(abstract)

Comments accepted for publication in the Association for the Advancement of Artificial Intelligence (AAAI), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏