Statistical Inference for Rank Allocation in Low-Rank Adaptation
低秩适应中秩分配的统计推断
Yihang Gao, Vincent Y. F. Tan
机构
*
Department of Mathematics, National University of Singapore(数学系,新加坡国立大学)
;
Department of Mathematics and Department of Electrical and Computer Engineering, National University of Singapore(数学系和电气与计算机工程系,新加坡国立大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.LG
The Economics of Autonomy: Real-Time Risk Indexing for Insurable AI-Driven 6G Systems
自主性经济学:适用于可保险的人工智能驱动的6G系统的实时风险索引
Anthony Kiggundu, Michael Zentarra, Christoph Lipps, Hans D. Schotten
机构
*
German Research Center for Artificial Intelligence (DFKI), Germany(德国人工智能研究中心(DFKI))
;
RPTU University of Kaiserslautern-Landau, Germany(莱茵-威斯伐尔大学科堡分校)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI
Explaining and Tuning Transformer-based LLMs in Arithmetic Tasks with Human Strategies
用人类策略解释和调整基于Transformer的语言模型在算术任务中的表现
Luyu Qiu, Jianing Li, Hwanhee Kim, Xiaoyong Wei, Yueyuan Zheng, Janet Hsiao, Lei Chen
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
University of California, Berkeley(加州大学伯克利分校)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.LG
SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning
SEED:用于智能体强化学习的自进化在线策略蒸馏
Jinyang Wu, Shuo Yang, Zhengxi Lu, Fan Zhang, Yuhao Shen, Lang Feng, Haoran Luo, Zheng Lian, Shuai Zhang, Zhengqi Wen, Jianhua Tao
机构
*
Tsinghua University(清华大学)
;
Zhejiang University(浙江大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Nanyang Technological University(南洋理工大学)
;
Tongji University(同济大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Department of Electrical and Computer Engineering, University of South Florida(电子与计算机工程系,佛罗里达州立大学)
;
Department of Mathematics, Embry-Riddle Aeronautical University(数学系,埃默里-瑞德航空大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.LG
STEEL: Sparsity-Aware Fused Attention for Energy-Efficient Long-Sequence Inference on AMD's XDNA NPU
STEEL:用于在AMD的XDNA NPU上进行节能长序列推理的稀疏感知融合注意力
Victor J. B. Jung, Gagandeep Singh, Joseph Melber, Kristof Denolf, Francesco Conti, Luca Benini
机构
*
AMD Research and Advanced Development (RAD)(AMD研究与先进开发)
;
Integrated Systems Laboratory (IIS)(集成系统实验室)
;
ETH Zürich(苏黎世联邦理工学院)
;
Department of Electrical, Electronic and Information Engineering (DEI)(电气电子信息工程系)
;
University of Bologna(博洛尼亚大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI
Rating the Pitch, Not the Product: User Evaluations of LLMs Reflect Expectations More Than Performance
评价的是宣传话术,而非产品本身:用户对大语言模型的评估更多反映期望而非性能
Robert Morabito, Tyler McDonald, Charitra Viswanath, Angel Hsing-Chi Hwang, Susanne Gaube, Jad Kabbara, Ali Emami
机构
*
Brock University(布鲁克大学)
;
Emory University(埃默里大学)
;
University of Southern California(南加州大学)
;
University College London(伦敦大学学院)
;
Massachusetts Institute of Technology(麻省理工学院)