机构
*
Department of Mathematics and Computer Science, University of Catania(卡塔尼亚大学数学与计算机科学系)
;
L3S Research Center, Leibniz University Hannover(汉诺威莱布尼茨大学L3S研究中心)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG
Temporal Visual Semantics-Induced Human Motion Understanding with Large Language Models
基于大语言模型的时序视觉语义诱导的人体运动理解
Zheng Xing, Weibing Zhao
机构
*
Guangdong Laboratory of Machine Perception and Intelligent Computing, Shenzhen MSU-BIT University, China(广东机器感知与智能计算实验室,深圳MSU-BIT大学,中国)
;
College of Computer Science and Software Engineering, Shenzhen University, Shenzhen(计算机科学与软件工程学院,深圳大学,深圳)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG
机构
*
AllSci Corp(AllSci公司)
;
Sunwater Capital(Sunwater资本)
;
Kellogg School of Management, Northwestern University(西北大学凯洛格管理学院)
;
Dept. of Computer Science, Northern Illinois University(北伊利诺伊大学计算机科学系)
;
Institute of Foundation Models, MBZUAI(基础模型研究所,MBZUAI)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI
Analyzing Cognitive Differences Among Large Language Models through the Lens of Social Worldview
通过社会世界观的视角分析大型语言模型的认知差异
Jiatao Li, Yanheng Li, Xiaojun Wan
机构
*
Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院)
;
Information Management Department, Peking University(北京大学信息管理系)
;
Renmin University of China(中国人民大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
MM-UAVBench: How Well Do Multimodal Large Language Models See, Think, and Plan in Low-Altitude UAV Scenarios?
MM-UAVBench: 多模态大语言模型在低空无人机场景中的感知、推理与规划能力如何?
Shiqi Dai, Zizhi Ma, Zhicong Luo, Xuesong Yang, Yibin Huang, Wanyue Zhang, Chi Chen, Zonghao Guo, Wang Xu, Yufei Sun, Maosong Sun
机构
*
Tsinghua University(清华大学)
;
Nankai University(南开大学)
;
Northwest Polytechnical University(西北工业大学)
;
Chinese Academy of Sciences(中国科学院)
;
Harbin Institute of Technology(哈尔滨工业大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract)
ClinDEF: A Dynamic Evaluation Framework for Large Language Models in Clinical Reasoning
ClinDEF: 一种用于大语言模型临床推理的动态评估框架
Yuqi Tang, Jing Yu, Zichang Su, Kehua Feng, Zhihui Zhu, Libin Wang, Lei Liang, Qiang Zhang, Keyan Ding, Huajun Chen
机构
*
ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州全球科技创新中心)
;
ZJU-UIUC Institute, Zhejiang University(浙江大学UIUC研究院)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
The Polytechnic Institute, Zhejiang University(浙江大学 polytechnic 院)
;
AntGroup(蚂蚁集团)
专题命中
评测与基准
:large language model(title);language model(title);LLM(abstract);分类 cs.CL
Automated Machine Learning Pipeline: Large Language Models-Assisted Automated Dataset Generation for Training Machine-Learned Interatomic Potentials
自动化机器学习流水线:基于大语言模型的自动化数据集生成用于训练机器学习互作用势
Adam Lahouari, Jutta Rogal, Mark E. Tuckerman
机构
*
NYU, Department of Chemistry(纽约大学化学系)
;
Initiative for Computational Catalysis, Flatiron Institute(计算催化计划,Flatiron研究所)
;
NYU, Department of Physics(纽约大学物理系)
;
Courant Institute of Mathematical Sciences, NYU(数学科学学院,纽约大学)
;
NYU-ECNU Center for Computational Chemistry(纽约大学-复旦大学计算化学中心)
;
Simons Center for Computational Physical Chemistry, NYU(Simons计算物理化学中心,纽约大学)
专题命中
评测与基准
:large language model(title);language model(title);foundation model(abstract);分类 cs.LG
DarkPatterns-LLM: A Multi-Layer Benchmark for Detecting Manipulative and Harmful AI Behavior
DarkPatterns-LLM: 一种多层基准用于检测操纵性和有害的AI行为
Sadia Asif, Israel Antonio Rosales Laguan, Haris Khan, Shumaila Asif, Muneeb Asif
机构
*
Rensselaer Polytechnic Institute(拉特格斯理工学院)
;
National University of Sciences and Technology(国立科学与技术大学)
;
School of Electrical Engineering & Computer Science(电子与计算机科学学院)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
The Gray Zone of Faithfulness: Taming Ambiguity in Unfaithfulness Detection
信仰的灰色地带:在不忠检测中消除歧义
Qiang Ding, Lvzhou Luo, Yixuan Cao, Ping Luo
机构
*
Key Lab of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(中国科学院信息处理重点实验室)
;
State Key Lab of Al Safety(人工智能安全国家重点实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Galaxy Zoo Evo: 1 million human-annotated images of galaxies
Galaxy Zoo Evo: 100万张人类标注的星系图像
Mike Walmsley, Steven Bamford, Hugh Dickinson, Tobias Géron, Alexander J. Gordon, Annette M. N. Ferguson, Lucy Fortson, Sandor Kruk, Natalie Lines, Chris J. Lintott, Karen L. Masters, Robert G. Mann, James Pearson, Hayley Roberts, Anna M. M. Scaife, Stefan Schuldt, Brooke Simmons, Rebecca Smethurst, Josh Speagle, Kyle Willett
DE$^3$-BERT: Distance-Enhanced Early Exiting for BERT based on Prototypical Networks
DE$^3$-BERT: 基于原型网络的距离增强型BERT早期退出
Jianing He, Qi Zhang, Weiping Ding, Duoqian Miao, Jun Zhao, Liang Hu, Longbing Cao
机构
*
School of Information Engineering, Tianjin University of Commerce(天津商业大学信息工程学院)
;
School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)
;
School of Artificial Intelligence and Computer Science, Nantong University(南通大学人工智能与计算机科学学院)
;
Faculty of Data Science, City University of Macau(澳门城市大学数据科学学院)
;
National Laboratory of Pattern Recognition, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室)
;
DataX Research Centre, School of Computing, Macquarie University(麦考瑞大学计算学院DataX研究中心)