Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
对齐视觉与语言:无需注释的多模态知识图谱构建以增强大语言模型推理
Junming Liu, Siyuan Meng, Yanting Gao, Song Mao, Pinlong Cai, Guohang Yan, Yirong Chen, Zilin Bian, Ding Wang, Botian Shi
机构
*
Tongji University(同济大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
East China Normal University(华东师范大学)
;
Stanford University(斯坦福大学)
;
New York University(纽约大学)
AeroVerse: UAV-Agent Benchmark Suite for Simulating, Pre-training, Finetuning, and Evaluating Aerospace Embodied World Models
AeroVerse:用于模拟、预训练、微调和评估航空航天具身世界模型的UAV-Agent基准套件
Fanglong Yao, Yuanchang Yue, Youzhi Liu, Xian Sun, Kun Fu
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空信息研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院)
;
Key Laboratory of Target Cognition and Application Technology(TCAT), Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空信息研究所目标认知与应用技术重点实验室)
专题命中
视觉推理
:visual language model(abstract);分类 cs.AI