DGTRSD & DGTRS-CLIP: A Dual-Granularity Remote Sensing Image-Text Dataset and Vision Language Foundation Model for Alignment
Weizhi Chen, Yupeng Deng, Jin Wei, Jingbo Chen, Jiansheng Chen, Yuman Feng, Zhihao Xi, Diyou Liu, Kai Li, Yu Meng
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院 aerospace information research institute)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院)
;
School of Information Network Security, People’s Public Security University of China(中国人民公安大学信息网络安全学院)
Anita Keshmirian, Razan Baltaji, Babak Hemmatian, Hadi Asghari, Lav R. Varshney
机构
*
Forward College(前进学院)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Nebraska, Lincoln(内布拉斯加大学林肯分校)
;
Technische Universität Berlin(柏林技术大学)
;
Humboldt Institute for Internet and Society(洪堡互联网与社会研究所)
;
Stony Brook University(石溪大学)
ReCAP: Recursive Context-Aware Reasoning and Planning for Large Language Model Agents
Zhenyu Zhang, Tianyi Chen, Weiran Xu, Alex Pentland, Jiaxin Pei
机构
*
Department of Computer Science, Stanford University(斯坦福大学计算机科学系)
;
Stanford Institute for Human-Centered AI(斯坦福大学人本人工智能研究所)
;
MIT Media Lab(麻省理工学院媒体实验室)
专题命中
其他安全
:alignment(abstract);分类 cs.AI
Journal ref39th Conference on Neural Information Processing Systems (NeurIPS 2025)
StreamingCoT: A Dataset for Temporal Dynamics and Multimodal Chain-of-Thought Reasoning in Streaming VideoQA
Yuhang Hu, Zhenyu Yang, Shihan Wang, Shengsheng Qian, Bin Wen, Fan Yang, Tingting Gao, Changsheng Xu
机构
*
Henan Institute of Advanced Technology, Zhengzhou University(河南高级技术研究所,郑州大学)
;
Institute of Automation, CAS(自动化研究所,中国科学院)
;
UCAS(中国科学院大学)
;
Peng Cheng Laboratory(鹏城实验室)