The Indra Representation Hypothesis for Multimodal Alignment
多模态对齐的Indra表示假说
机构 * Northeastern University(东北大学) ; Adobe Research(Adobe研究院)
AI总结 本文提出Indra表示假说,通过范畴论中的V富化Yoneda嵌入,定义样本间关系轮廓,提升多模态对齐的鲁棒性和一致性。
大厂专区
多模态对齐的Indra表示假说
机构 * Northeastern University(东北大学) ; Adobe Research(Adobe研究院)
AI总结 本文提出Indra表示假说,通过范畴论中的V富化Yoneda嵌入,定义样本间关系轮廓,提升多模态对齐的鲁棒性和一致性。
CPT:基于语言模型的可控可编辑设计变体
机构 * Adobe ; Atta
AI总结 本文提出CPT系统,利用解码器-only语言模型生成可编辑的设计变体,通过Creative Markup Language实现结构与细节的精准描述,提升设计流程的可扩展性与个性化。
Comments 18 pages, 6 figures, Accepted at NeurIPS 2025 Workshop on Generative and Protective AI for Content Creation (GenProCC 2025)
重写视频:基于文本的视频重写
机构 * Columbia University(哥伦比亚大学) ; Adobe Research(Adobe研究院)
AI总结 本文提出基于文本的视频重写方法,通过生成重建算法将视频转为可编辑文本提示,并通过交互式工具Rewrite Kit实现视频内容的重写,探讨了文本驱动视频重写的新范式。