Large Language Model Agent Personality and Response Appropriateness: Evaluation by Human Linguistic Experts, LLM-as-Judge, and Natural Language Processing Model
Discovering Heuristics with Large Language Models (LLMs) for Mixed-Integer Programs: Single-Machine Scheduling
İbrahim Oğuz Çetinkaya, İ. Esra Büyüktahtakın, Parshin Shojaee, Chandan K. Reddy
机构
*
Grado Department of Industrial and Systems Engineering, Virginia Tech, Blacksburg, VA(弗吉尼亚理工大学工业与系统工程系)
;
Department of Computer Science, Virginia Tech, Arlington, VA(弗吉尼亚理工大学计算机科学系)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG
SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
Arijit Maji, Raghvendra Kumar, Akash Ghosh, Anushka, Sriparna Saha
机构
*
Department of Computer Science and Engineering, Indian Institute of Technology Patna(印度理工学院帕纳布分校计算机科学与工程系)
;
Department of Computer Science, Banasthali Vidyapeeth University(班斯塔利大学计算机科学系)
专题命中
评测与基准
:language model(title,abstract);large language model(abstract);small language model(abstract);分类 cs.CL
Can LLMs Write Faithfully? An Agent-Based Evaluation of LLM-generated Islamic Content
Abdullah Mushtaq, Rafay Naeem, Ezieddin Elmahjub, Ibrahim Ghaznavi, Shawqi Al-Maliki, Mohamed Abdallah, Ala Al-Fuqaha, Junaid Qadir
机构
*
Information Technology University(信息科技大学)
;
Qatar University(卡塔尔大学)
;
Hamad Bin Khalifa University(哈马德·本·卡西姆大学)
专题命中
评测与基准
:LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
CommentsAccepted at 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: 5th Muslims in Machine Learning (MusIML) Workshop
CommentsAccepted version. Published in Machine Learning (Springer) 114:263 (2025). Open access under a CC BY-NC-ND 4.0 license. DOI: 10.1007/s10994-025-06916-9
机构
*
University of Pisa, Department of Computer Science(比萨大学计算机科学系)
;
National Research Council of Italy, Institute of Information Science and Technologies(意大利国家研究委员会信息科学与技术研究所)
;
University of Trento, Department of Psychology and Cognitive Science(特伦托大学心理学与认知科学系)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
MixAT: Combining Continuous and Discrete Adversarial Training for LLMs
Csaba Dékány, Stefan Balauca, Robin Staab, Dimitar I. Dimitrov, Martin Vechev
机构
*
INSAIT, Sofia University "St. Kliment Ohridski"(INSAIT,索菲亚大学"圣克莱孟·奥赫里迪斯基")
;
ETH Zurich(苏黎世联邦理工学院)
;
ELTE Eötvös Loránd University, Budapest, Hungary(ELTE 爱斯特霍特·洛兰德大学,布达佩斯,匈牙利)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
CommentsPublished at 39th Conference on Neural Information Processing Systems (NeurIPS 2025)
CPathAgent: An Agent-based Foundation Model for Interpretable High-Resolution Pathology Image Analysis Mimicking Pathologists' Diagnostic Logic
Yuxuan Sun, Yixuan Si, Chenglu Zhu, Kai Zhang, Zhongyi Shui, Bowen Ding, Tao Lin, Lin Yang
机构
*
College of Computer Science and Technology, Zhejiang University, China(浙江大学计算机科学与技术学院)
;
Research Center for Industries of the Future and School of Engineering, Westlake University, China(未来产业研究中心和西湖大学工程学院)
;
Department of Computer Science and Engineering, The Ohio State University, USA(俄亥俄州立大学计算机科学与工程系)
Evaluating LLMs on Generating Age-Appropriate Child-Like Conversations
Syed Zohaib Hassan, Pål Halvorsen, Miriam S. Johnson, Pierre Lison
机构
*
Department of Holistic Systems, SimulaMet(整体系统系,SimulaMet)
;
Department of Computer Science, Oslo Metropolitan University(计算机科学系,奥斯陆 Metropolitan 大学)
;
Department of Behavioural Sciences, Oslo Metropolitan University(行为科学系,奥斯陆 Metropolitan 大学)
;
Department of Psychology, Harvard University(心理学系,哈佛大学)
;
Department of Informatics, University of Oslo(信息学系,奥斯陆大学)
;
Norwegian Computing Center(挪威计算中心)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
Comments11 pages excluding references and appendix. 3 figures and 6 tables
机构
*
The Pennsylvania State University(宾夕法尼亚州立大学)
;
The University of Utah(犹他大学)
;
Amazon(亚马逊)
;
Microsoft(微软)
;
IBM T.J. Watson Research Center(IBM T.J.沃森研究中心)
;
Michigan State University(密歇根州立大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI