机构
*
Tsinghua University(清华大学)
;
Sun Yat-sen University(中山大学)
;
Independent Researcher(独立研究员)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Guangdong Laboratory of AI and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
V2X-QA: A Comprehensive Reasoning Dataset and Benchmark for Multimodal Large Language Models in Autonomous Driving Across Ego, Infrastructure, and Cooperative Views
V2X-QA:面向自动驾驶多视角的多模态大语言模型综合数据集与基准测试
Junwei You, Pei Li, Zhuoyu Jiang, Weizhe Tang, Zilin Huang, Rui Gan, Jiaxi Liu, Yan Zhao, Sikai Chen, Bin Ran
机构
*
Department of Civil and Environmental Engineering, University of Wisconsin–Madison(威斯康星大学麦迪逊分校土木与环境工程系)
;
Department of Civil and Architectural Engineering and Construction Management, University of Wyoming(怀俄明大学土木与建筑工程及施工管理系)
;
School of Transportation, Southeast University(东南大学交通学院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
EpiScreen: Early Epilepsy Detection from Electronic Health Records with Large Language Models
EpiScreen:利用电子健康记录中的大型语言模型进行早期癫痫检测
Shuang Zhou, Kai Yu, Zaifu Zhan, Huixue Zhou, Min Zeng, Feng Xie, Zhiyi Sha, Rui Zhang
机构
*
University of Minnesota(明尼苏达大学)
;
Division of Computational Health Sciences, Department of Surgery, University of Minnesota(明尼苏达大学外科学系计算健康科学部)
;
College of Science and Engineering, University of Minnesota(明尼苏达大学科学与工程学院)
;
Department of Neurology, University of Minnesota(明尼苏达大学神经病学系)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
Understanding Teacher Revisions of Large Language Model-Generated Feedback
理解大型语言模型生成反馈的教师修订
Conrad Borchers, Luiz Rodrigues, Newarney Torrezão da Costa, Cleon Xavier, Rafael Ferreira Mello
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Federal Technological University of Paraná – UTFPR(巴拉那联邦理工大学)
;
Instituto Federal Goiano – IF Goiano(戈亚斯联邦学院)
;
Federal Rural University of Pernambuco – UFRPE(伯南布哥联邦农村大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
University of Waterloo(滑铁卢大学)
;
Université de Montréal / Mila - Quebec AI Institute(蒙特利尔大学 / 加拿大魁北克人工智能研究所)
;
City University of Hong Kong(香港城市大学)
;
Autodesk(Autodesk公司)
;
Singapore Management University(新加坡国立大学)
专题命中
评测与基准
:large language model(title);language model(title);LLM(abstract);prompting(abstract)
MLlm-DR: Towards Explainable Depression Recognition with MultiModal Large Language Models
MLlm-DR: 向多模态大语言模型的可解释性抑郁识别迈进
Wei Zhang, Juan Chen, En Zhu, Wenhong Cheng, YunPeng Li, Yanbo J. Wang
机构
*
National University of Defense Technology(国防科技大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine(上海精神卫生中心,上海交通大学医学院)
;
Nanjing Industria Tenebris Information Technology Co., Ltd.(南京Industria Tenebris信息技术有限公司)
;
National University of Uzbekistan named after Mirzo Ulugbek(乌兹别克斯坦Mirzo Ulugbek命名的国立大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
MaterialFigBENCH: benchmark dataset with figures for evaluating college-level materials science problem-solving abilities of multimodal large language models
MaterialFigBENCH:用于评估多模态大语言模型在大学级材料科学问题解决能力的基准数据集
Michiko Yoshitake, Yuta Suzuki, Ryo Igarashi, Yoshitaka Ushiku, Keisuke Nagato
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
机构
*
Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)
;
State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,北京大学智能科学与技术学院)
;
School of Mathematical Sciences, Peking University(数学科学学院,北京大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
Wisdom of the AI Crowd (AI-CROWD) for Ground Truth Approximation in Content Analysis: A Research Protocol & Validation Using Eleven Large Language Models
La Leaderboard: A Large Language Model Leaderboard for Spanish Varieties and Languages of Spain and Latin America
La Leaderboard:一种用于西班牙及拉丁美洲各种语言和方言的大型语言模型排行榜
María Grandury, Javier Aula-Blasco, Júlia Falcão, Clémentine Fourrier, Miguel González, Gonzalo Martínez, Gonzalo Santamaría, Rodrigo Agerri, Nuria Aldama, Luis Chiruzzo, Javier Conde, Helena Gómez, Marta Guerrero, Guido Ivetta, Natalia López, Flor Miriam Plaza-del-Arco, María Teresa Martín-Valdivia, Helena Montoro, Carmen Muñoz, Pedro Reviriego, Leire Rosado, Alejandro Vaca, María Estrella Vallecillo-Rodríguez, Jorge Vallego, Irune Zubiaga
机构
*
SomosNLP
;
ETSIT, Universidad Politécnica de Madrid(ETSIT,西班牙马德里理工大学)
;
Barcelona Supercomputing Center(巴塞罗那超级计算中心)
;
Hugging Face
;
Universidad Carlos III de Madrid(马德里卡洛斯三世大学)
;
Instituto de Ingeniería del Conocimiento(知识工程研究所)
;
Centro HiTZ - Ixa, Universidad del País Vasco UPV/EHU(HiTZ-Ixa中心,巴斯克大学)
;
LIACS, Leiden University(LIACS,莱顿大学)
;
Universidad de Jaén(杰嫩大学)
;
Universidad Nacional de Córdoba(科尔多瓦国立大学)
;
Universidad Nacional Autónoma de México(墨西哥国立自治大学)
;
Universidad de la República, Uruguay(乌拉圭共和国大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
AI总结
La Leaderboard是一个开源项目,旨在评估西班牙及拉丁美洲各种语言和方言的生成式大型语言模型,通过社区驱动的方式促进多样化语言模型的发展。