机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Tsinghua University(清华大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Peking University(北京大学)
;
Moonshot AI
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Peking University Third Hospital(北京大学第三医院)
;
The Hong Kong Polytechnic University(香港理工大学)
;
The University of Hong Kong(香港大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
German General Social Survey Personas: A Survey-Derived Persona Prompt Collection for Population-Aligned LLM Studies
德国通用社会调查人设:一种基于德国通用社会调查的人员提示集合,用于与人口一致的LLM研究
Jens Rupprecht, Leon Fröhling, Claudia Wagner, Markus Strohmaier
机构
*
University of Mannheim(曼海姆大学)
;
GESIS -- Leibniz Institute for the Social Sciences(莱布尼茨社会科学研究所)
;
RWTH Aachen University(亚琛工业大学)
;
Complexity Science Hub(复杂性科学中心)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
LLM-as-an-Annotator: Training Lightweight Models with LLM-Annotated Examples for Aspect Sentiment Tuple Prediction
LLM-as-Annotator: 利用LLM标注示例训练轻量模型进行方面情感元组预测
Nils Constantin Hellwig, Jakob Fehle, Udo Kruschwitz, Christian Wolff
机构
*
Media Informatics Group, University of Regensburg, Regensburg, Germany(莱茵河畔大学媒体信息学组)
;
Information Science Group, University of Regensburg, Regensburg, Germany(莱茵河畔大学信息科学组)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
MOSAIC: A Unified Platform for Cross-Paradigm Comparison and Evaluation of Homogeneous and Heterogeneous Multi-Agent RL, LLM, VLM, and Human Decision-Makers
MOSAIC:一个用于跨范式比较和评估同质和异质多智能体RL、LLM、VLM和人类决策者的统一平台
Abdulhamid M. Mousa, Yu Fu, Rakhmonberdi Khajiev, Jalaledin M. Azzabi, Abdulkarim M. Mousa, Peng Yang, Yunusa Haruna, Ming Liu
机构
*
School of Optics and Photonics, Beijing Institute of Technology, Beijing 100081, China(北京理工大学光学工程学院)
;
School of Automation Science and Electrical Engineering, Beihang University, Beijing 100191, China(北京航空航天大学自动化科学与电气工程学院)
;
Faculty of Science, Ain Shams University, Cairo, Egypt(爱思唯命大学科学学院)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
When Agents "Misremember" Collectively: Exploring the Mandela Effect in LLM-based Multi-Agent Systems
当智能体“误忆”时:探索基于大语言模型的多智能体系统中的曼德拉效应
Naen Xu, Hengyu An, Shuo Shi, Jinghuai Zhang, Chunyi Zhou, Changjiang Li, Tianyu Du, Zhihui Fu, Jun Wang, Shouling Ji
机构
*
Zhejiang University(浙江大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Palo Alto Networks(帕洛阿尔托网络公司)
;
OPPO Research Institute(OPPO研究院)
;
Zhejiang Key Laboratory of Decision Intelligence(浙江决策智能重点实验室)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
School of Computer Science and Engineering at Nanyang Technological University(南洋理工大学计算机科学与工程学院)
;
School of Cyber Science and Engineering, Wuhan University(武汉大学网络科学与工程学院)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
CommentsPre-print - Accepted for publication in the Proceedings of the International Computer Sciences and Informatics Conference (ICSIC-2024), published by AIP Publishing
SportR: A Benchmark for Multimodal Large Language Model Reasoning in Sports
SportR:多模态大语言模型在体育中的推理基准
Haotian Xia, Haonan Ge, Junbo Zou, Hyun Woo Choi, Xuebin Zhang, Danny Suradja, Botao Rui, Ethan Tran, Wendy Jin, Zhen Ye, Xiyang Lin, Christopher Lai, Shengjie Zhang, Junwen Miao, Shichao Chen, Rhys Tracy, Vicente Ordonez, Weining Shen, Hanjie Chen
机构
*
Department of Computer Science, Rice University(Rice大学计算机科学系)
;
Ken Kennedy Institute, Rice University(Rice大学肯尼迪研究所)
;
Department of Statistics, University of California, Irvine(伊利诺伊大学欧文分校统计系)
;
College of Sciences, Georgia Institute of Technology(佐治亚理工学院科学学院)
;
Department of Applied Mathematics and Statistics, Johns Hopkins University(约翰霍普金斯大学应用数学与统计学系)
;
Department of Computer Science, University of California, Santa Barbara(加州大学圣芭芭拉分校计算机科学系)
专题命中
评测与基准
:large language model(title);language model(title)
CityLens: Evaluating Large Vision-Language Models for Urban Socioeconomic Sensing
CityLens:评估大型视觉-语言模型用于城市社会经济感知
Tianhui Liu, Hetian Pang, Xin Zhang, Tianjian Ouyang, Zhiyuan Zhang, Jie Feng, Yong Li, Pan Hui
机构
*
Information Hub, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)信息中心)
;
Department of Electronic Engineering, BNRist, Tsinghua University(清华大学电子工程系)
;
School of Electronic and Information Engineering, Beijing Jiaotong University(北京交通大学电子与信息工程学院)