GCAgent: Long-Video Understanding via Schematic and Narrative Episodic Memory
Jeong Hun Yeo, Sangyun Chung, Sungjune Park, Dae Hoe Kim, Jinyoung Moon, Yong Man Ro
机构
*
Integrated Vision and Language Lab., School of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(整合视觉与语言实验室,电气工程学院,韩国科学技术院(KAIST))
;
Visual Intelligence Research Section, Superintelligence Creative Research Laboratory, Electronics and Telecommunications Research Institute (ETRI)(视觉智能研究部,超智能创意研究实验室,电子电信研究院)
机构
*
Dalian University of Technology(大连理工大学)
;
University of Lincoln(林肯大学)
;
University of Nottingham(诺丁汉大学)
;
Waseda University(早稻田大学)
;
University of Nottingham Ningbo China(宁波诺丁汉大学)
;
Yale University(耶鲁大学)