Evaluating 21st-Century Competencies in Postsecondary Curricula with Large Language Models: Performance Benchmarking and Reasoning-Based Prompting Strategies
机构
*
Systems Hub, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)系统中心)
;
Academy of Interdisciplinary Studies, The Hong Kong University of Science and Technology(香港科学与技术大学跨学科研究院)
机构
*
Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative, Institute of Digital Twin, EIT(宁波空间智能与数字衍生关键实验室,数字孪生研究院,EIT)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院)
;
Shenzhen University of Advanced Technology(深圳先进技术大学)
;
Shenzhen MSU-BIT University(深圳MSU-BIT大学)
;
Amazon AGI(亚马逊人工智能)
QuantEval: A Benchmark for Financial Quantitative Tasks in Large Language Models
QuantEval:大型语言模型中金融量化任务的基准测试
Zhaolu Kang, Junhao Gong, Wenqing Hu, Shuo Yin, Kehan Jiang, Zhicheng Fang, Yingjie He, Chunlei Meng, Rong Fu, Dongyang Chen, Leqi Zheng, Eric Hanchen Jiang, Yunfei Feng, Yitong Leng, Junfan Zhu, Xiaoyou Chen, Xi Yang, Richeng Xuan
机构
*
Peking University(北京大学)
;
Tsinghua University(清华大学)
;
Fudan University(复旦大学)
;
University of Macau(澳门大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Shanghai Jiao Tong University(上海交通大学)
;
Imperial College London(伦敦帝国理工学院)
;
University of Chicago(芝加哥大学)
;
Shanghai Weina Software Technology(上海韦纳软件技术)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
ThinkEval: Practical Evaluation of Knowledge Leakage in LLM Editing using Thought-based Knowledge Graphs
ThinkEval: 基于思维的知识图谱对 LLM 编辑中知识泄漏的实用评估
Manit Baser, Dinil Mon Divakaran, Mohan Gurusamy
机构
*
Electrical and Computer Engineering National University of Singapore(新加坡国立大学电子与计算机工程系)
;
A*STAR Institute for Infocomm Research (A*STAR I 2 R), Singapore(新加坡A*STAR信息与通信研究机构)
CommentsThis is an earlier version of the work released in May 2025. The version accepted at CHI 2026 is available as a separate preprint at arXiv:2511.04366
FrankenMotion: Part-level Human Motion Generation and Composition
FrankenMotion: 部位级人类动作生成与组合
Chuqiao Li, Xianghui Xie, Yong Cao, Andreas Geiger, Gerard Pons-Moll
机构
*
Tübingen AI Center, University of Tübingen(图宾根人工智能中心,图宾根大学)
;
Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息研究所,萨尔兰信息校区)