From Semantics, Scene to Instance-awareness: Distilling Foundation Model for Grounded Open-vocabulary Situation Recognition
Chen Cai, Tianyi Liu, Jianjun Gao, Wenyang Liu, Kejun Wu, Ruoyu Wang, Yi Wang, Soo Chin Liew
机构
*
National University of Singapore(新加坡国立大学)
;
Nanyang Technological University(南洋理工大学)
;
Huazhong University of Science and Technology(华中科技大学)
;
The Hong Kong Polytechnic University(香港理工大学)
专题命中
视觉定位与Grounding
:multimodal large language model(abstract);MLLM(abstract);分类 cs.CV
ResearchRubrics: A Benchmark of Prompts and Rubrics For Evaluating Deep Research Agents
Manasi Sharma, Chen Bo Calvin Zhang, Chaithanya Bandi, Clinton Wang, Ankit Aich, Huy Nghiem, Tahseen Rabbani, Ye Htet, Brian Jang, Sumana Basu, Aishwarya Balwani, Denis Peskoff, Marcos Ayestaran, Sean M. Hendryx, Brad Kenstler, Bing Liu
机构
*
Scale AI
;
University of Maryland(马里兰大学)
;
University of Chicago(芝加哥大学)
;
Washington University, St. Louis(圣路易斯华盛顿大学)
;
McGill University(麦吉尔大学)
;
University of California, Berkeley(加州大学伯克利分校)
机构
*
Institute of Cyberspace Security, Harbin Institute of Technology, Shenzhen(网络安全研究所,哈尔滨工业大学,深圳)
;
Department of New Networks, Peng Cheng Laboratory(新网络部门,鹏城实验室)
;
School of Cyberspace Science, Harbin Institute of Technology(空间科学学院,哈尔滨工业大学)
;
Center on Machine Learning Research, Harbin Institute of Technology(机器学习研究中心,哈尔滨工业大学)
;
Faculty of Information Technology, Monash University(信息技术学院,墨尔本大学)
专题命中
视觉定位与Grounding
:grounding(abstract);分类 cs.CV
CommentsThis work has been submitted to Pattern Recognition for possible publication
Cross-Lingual Mental Health Ontologies for Indian Languages: Bridging Patient Expression and Clinical Understanding through Explainable AI and Human-in-the-Loop Validation