Evaluating LLM Personalization via Semantic Constraint Verification
通过语义约束验证评估LLM个性化
Xuran Li, Guanqin Zhang, Imran Razzak, Hakim Hacid, Eleanna Kafeza, Hao Xue, Flora D. Salim
机构
*
University of New South Wales(新南威尔士大学)
;
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
The Technology Innovation Institute(技术创新研究所)
;
The Hong Kong University of Science and Technology(香港科技大学)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Measuring Whether LLM Tutors Teach or Solve: A Diagnostic for Educational Impact
衡量LLM导师是教学还是解题:教育影响的诊断方法
Junyi Yao, Zihao Zheng, Baichuan Li
机构
*
Washington University in St. Louis(圣路易斯华盛顿大学)
;
Department of Operations Research and Engineering Management, Southern Methodist University(南卫理公会大学运筹学与工程管理系)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
LLM-based Visual Code Completion for Aerospace Geometric Design
基于LLM的航空航天几何设计视觉代码补全
Hau Kit Yong, Robert Marsh, Edmar A. Silva, András Sóbester, Stuart E. Middleton
机构
*
Faculty of Engineering and Physical Sciences, University of Southampton(南安普顿大学工程与物理科学学院)
;
School of Electronics and Computer Science, University of Southampton(南安普顿大学电子与计算机科学学院)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Florida International University(佛罗里达国际大学)
;
Boston University(波士顿大学)
;
Department of Computer Science and Engineering, Indian Institute of Technology Patna(印度帕纳吉印度理工学院计算机科学与工程系)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI
XAI-Grounded Explanation Generation for Speech Deepfake Detection with Training-Free Multimodal Large Language Models
基于XAI的语音深度伪造检测解释生成:使用免训练多模态大语言模型
Yupei Li, Qiyang Sun, Xiaoliang Wu, Chenxi Wang, Berrak Sisman, Björn W. Schuller
机构
*
Imperial College London(帝国理工学院)
;
Technical University of Munich(慕尼黑工业大学)
;
University of Southampton(南安普顿大学)
;
MBZUAI(穆罕默德·本·扎耶德人工智能大学)
;
Johns Hopkins University(约翰霍普金斯大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI
Risk-Aware LLM Agents for Geospatial Data Retrieval: Design and Preliminary Adversarial Evaluation
风险感知的LLM智能体用于地理空间数据检索:设计与初步对抗性评估
Kyle Gao, Joel Cumming, Jonathan Li, Linlin Xu, David A. Clausi
机构
*
Dept. of Systems Design Engineering, University of Waterloo(滑铁卢大学系统设计工程系)
;
SkyWatch
;
Dept. of Geography and Environmental Management, University of Waterloo(滑铁卢大学地理与环境管理系)
;
Dept. of Geomatics Engineering, University of Calgary(卡尔加里大学测绘工程系)
CommentsAccepted for publication in the International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences (ISPRS Archives), ISPRS Congress 2026
UXBench: Measuring the Actionability of LLM-Generated UX Critiques
UXBench: 衡量LLM生成的UX评论的可操作性
Wenjie Wang, Yue Huang, Zipeng Ling, Han Bao, Hang hua, Xiaonan Luo, Yu Jiang, Shiyi Du, Yuexing Hao, Xiaomin Li, Yuchen Ma, Dianzhuo Wang, Yanfang Ye, Xiangliang Zhang
机构
*
University of Notre Dame(诺丁汉大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
University of Rochester(罗切斯特大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Harvard University(哈佛大学)
;
LMU Munich(慕尼黑路德维希-马克西米利安大学)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI