VisualQuest: A Benchmark for Abstract Visual Reasoning in MLLMs
VisualQuest: 一个用于多模态大语言模型(MLLMs)抽象视觉推理的基准数据集
Kelaiti Xiao, Liang Yang, Dongyu Zhang, Paerhati Tulajiang, Hongfei Lin
机构
*
School of Computer Science and Technology, Dalian University of Technology, Dalian, China(大连理工大学计算机科学与技术学院)
;
School of Foreign Languages, Dalian University of Technology, Dalian, China(大连理工大学外语学院)
;
School of Computer Science and Technology, Xinjiang Normal University, Urumqi, China(新疆师范大学计算机科学与技术学院)
专题命中
评测与基准
:large language model(abstract);language model(abstract)
Adapting Natural Language Processing Models Across Jurisdictions: A pilot Study in Canadian Cancer Registries
在不同司法管辖区适应自然语言处理模型:加拿大癌症登记处的试点研究
Jonathan Simkin, Lovedeep Gondara, Zeeshan Rizvi, Gregory Doyle, Jeff Dowden, Dan Bond, Desmond Martin, Raymond Ng
机构
*
School of Population and Public Health University of British Columbia(流行病学与公共卫生学院 首都大学)
;
Newfoundland & Labrador Health Services(纽芬兰与拉布拉多省卫生服务)
;
Data Science Institute University of British Columbia(数据科学研究所 首都大学)
MAESTRO: Multi-Agent Evaluation Suite for Testing, Reliability, and Observability
MAESTRO:多智能体评估套件用于测试、可靠性与可观测性
Tie Ma, Yixi Chen, Vaastav Anand, Alessandro Cornacchia, Amândio R. Faustino, Guanheng Liu, Shan Zhang, Hongbin Luo, Suhaib A. Fahmy, Zafar A. Qazi, Marco Canini
Can Large Language Models Still Explain Themselves? Investigating the Impact of Quantization on Self-Explanations
大语言模型还能自我解释吗?探讨量化对自我解释的影响
Qianli Wang, Nils Feldhus, Pepa Atanasova, Fedor Splitt, Simon Ostermann, Sebastian Möller, Vera Schmitt
机构
*
Quality and Usability Lab, Technische Universität Berlin(柏林技术大学质量与可用性实验室)
;
University of Copenhagen(哥本哈根大学)
;
Saarland Informatics Campus(萨尔州信息学校园)
;
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)
;
Centre for European Research in Trusted AI (CERTAIN)(可信AI欧洲研究中心)
;
BIFOLD – Berlin Institute for the Foundations of Learning and Data(柏林学习与数据基础研究院)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
基于大语言模型的时序知识图谱推理知识蒸馏
Wang Xing, Wei Song, Siyu Lin, Chen Wu, Zhesi Li, Man Wang
机构
*
School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院)
;
School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院)
;
School of Information Science and Engineering, Chongqing Jiaotong University(重庆交通大学信息科学与工程学院)
;
School of Information Engineering, Chang’an University(长安大学信息工程学院)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL