AMQ: Enabling AutoML for Mixed-precision Weight-Only Quantization of Large Language Models
Sangjun Lee, Seung-taek Woo, Jungyu Jin, Changhun Lee, Eunhyeok Park
机构
*
Graduate School of Artificial Intelligence(人工智能研究生院)
;
Department of Convergence IT Engineering(融合IT工程系)
;
Pohang University of Science and Technology (POSTECH)(釜山科学技术大学)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
CommentsEMNLP 2025 Main Conference, Long Paper (Oral)
Growing Perspectives: Modelling Embodied Perspective Taking and Inner Narrative Development Using Large Language Models
Sabrina Patania, Luca Annese, Anna Lambiase, Anita Pellegrini, Tom Foulsham, Azzurra Ruggeri, Silvia Rossi, Silvia Serino, Dimitri Ognibene
机构
*
Department of Psychology, University of Milan-Bicocca(心理学系,米兰-比科卡大学)
;
Department of Psychology, University of Essex(心理学系,埃塞克斯大学)
;
School of Social Sciences and Technology, Technical University of Munich(社会科学与技术学院,慕尼黑技术大学)
;
Department of Electrical Engineering and Information Technology, University of Naples Federico II(电气工程与信息技术系,那不勒斯费德里科二世大学)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
XplaiNLP at CheckThat! 2025: Multilingual Subjectivity Detection with Finetuned Transformers and Prompt-Based Inference with Large Language Models
Ariana Sahitaj, Jiaao Li, Pia Wenzel Neves, Fedor Splitt, Premtim Sahitaj, Charlott Jakob, Veronika Solopova, Vera Schmitt
机构
*
Quality and Usability Lab, Technische Universität Berlin, Berlin, Germany(柏林技术大学质量与可用性实验室)
;
German Research Center for Artificial Intelligence (DFKI), Berlin, Germany(德国人工智能研究中心(DFKI))
专题命中
效率与部署
:large language model(title);language model(title);prompting(abstract);分类 cs.CL
HalluField: Detecting LLM Hallucinations via Field-Theoretic Modeling
Minh Vu, Brian K. Tran, Syed A. Shah, Geigh Zollicoffer, Nhat Hoang-Xuan, Manish Bhattarai
机构
*
Center for Nonlinear Studies(非线性研究中心)
;
Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)
;
T-1 Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室T-1部门)
;
Applied Mathematics University of Colorado Boulder(科罗拉多大学博尔德分校应用数学系)
;
T-4 Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室T-4部门)
专题命中
效率与部署
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
QualityFM: a Multimodal Physiological Signal Foundation Model with Self-Distillation for Signal Quality Challenges in Critically Ill Patients
Zongheng Guo, Tao Chen, Manuela Ferrario
机构
*
Department of Electronics, Information and Bioengineering, Politecnico di Milano(电子、信息与生物工程系,米兰理工学院)
;
State Key Laboratory of Industrial Control Technology, Zhejiang University(工业控制技术国家重点实验室,浙江大学)
AQUA: Attention via QUery mAgnitudes for Memory and Compute Efficient Inference in LLMs
Santhosh G S, Saurav Prakash, Balaraman Ravindran
机构
*
Centre for Responsible AI(负责任人工智能中心)
;
Indian Institute of Technology Madras(印度理工学院马德拉斯分校)
;
Department of Electrical Engineering(电气工程系)
;
Wadhwani School of Data Science and Artificial Intelligence(Wadhwani数据科学与人工智能学院)
专题命中
效率与部署
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Towards Automated Error Discovery: A Study in Conversational AI
Dominic Petrak, Thy Thy Tran, Iryna Gurevych
机构
*
Ubiquitous Knowledge Processing Lab (UKP Lab), Department of Computer Science and Hessian Center for AI (hessian.AI), Technical University of Darmstadt(德累斯顿技术大学)
专题命中
效率与部署
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
University of Nottingham(诺丁汉大学)
;
The University of Hong Kong(香港大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Columbia University(哥伦比亚大学)
;
University of California, Berkeley(加州大学伯克利分校)
Regist3R: Incremental Registration with Stereo Foundation Model
Sidun Liu, Wenyu Li, Peng Qiao, Yong Dou
机构
*
College of Computer Science and Technology(计算机科学与技术学院)
;
National Key Laboratory of Parallel and Distributed Computing(并行与分布式计算国家重点实验室)
;
National University of Defense Technology(国防科技大学)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shandong University(山东大学)
;
University of Electronic Science and Technology of China(电子科学与技术大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Tsinghua University(清华大学)
;
National University of Singapore(新加坡国立大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
DSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs
Minxuan Lv, Zhenpeng Su, Leiyu Pan, Yizhe Xiong, Zijia Lin, Hui Chen, Wei Zhou, Jungong Han, Guiguang Ding, Cheng Luo, Di Zhang, Kun Gai, Songlin Hu
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Kuaishou Technology(快手科技)
;
Tianjin University(天津大学)
;
Tsinghua University(清华大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.CL
专题命中
效率与部署
:large language model(abstract);language model(abstract)
CommentsThis paper has been accepted to the 31st ACM International Conference on Architectural Support for Programming Languages and Operating Systems (ASPLOS 2026)