CoMa: Contextual Massing Generation with Vision-Language Models
CoMa:基于视觉-语言模型的上下文体量生成
机构 * FusionBrain Lab(融合大脑实验室) ; Innopolis University(因诺普里斯大学) ; Institute of Numerical Mathematics(数值数学研究所)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV、cs.AI
AI总结 CoMa提出基于视觉-语言模型的自动化框架,生成基于功能需求和场地背景的建筑体量,引入CoMa-20K数据集并验证了VLMs在生成上下文敏感体量选项中的潜力。
Comments Code and dataset will be released later