Less is More: Local Intrinsic Dimensions of Contextual Language Models
Benjamin Matthias Ruppik, Julius von Rohrscheidt, Carel van Niekerk, Michael Heck, Renato Vukovic, Shutong Feng, Hsien-chin Lin, Nurul Lubis, Bastian Rieck, Marcus Zibrowius, Milica Gašić
机构
*
Faculty of Mathematics and Natural Sciences, Heinrich Heine University Düsseldorf(明斯特大学数学与自然科学学院)
;
Institute of AI for Health, Helmholtz Munich(健康人工智能研究所)
;
Technical University of Munich(慕尼黑技术大学)
;
University of Fribourg(弗里堡大学)
专题命中
指令微调
:language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG;LLM(comments)
A Training-Free Mixture-of-Agents Framework for Multi-Document Summarization using LLMs and Knowledge Graphs
一种基于LLM和知识图谱的无训练混合智能体框架用于多文档摘要
Cuong Vuong Tuan, Trang Mai Xuan, Tien-Cuong Nguyen, Vu-Duc Ngo, Thien Van Luong
机构
*
Faculty of Artificial Intelligence and Data Science, Phenikaa University(人工智能与数据科学学院,泛尼克大学)
;
VNPT AI, VNPT Group(VNPT AI,VNPT集团)
;
MobiFone Research and Development Center, MobiFone Corporation(MobiFone研发与开发中心,MobiFone公司)
;
Business AI Lab, Faculty of Data Science and Artificial Intelligence, National Economics University, College of Technology(商业人工智能实验室,数据科学与人工智能学院,国家经济大学,技术学院)
专题命中
指令微调
:LLM(title_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Alignment Risks from Capability-Seeking RL Training
从能力寻求强化学习训练中产生的对齐风险
Yujun Zhou, Yue Huang, Han Bao, Kehan Guo, Zhenwen Liang, Pin-Yu Chen, Tian Gao, Werner Geyer, Nuno Moniz, Nitesh V Chawla, Xiangliang Zhang
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Stanford University(斯坦福大学)
;
University of Washington(华盛顿大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
University of Toronto(多伦多大学)
;
University of Cambridge(剑桥大学)
Stabilizing Policy Optimization via Logits Convexity
通过Logits凸性稳定策略优化
Hongzhan Chen, Tao Yang, Yuhua Zhu, Shiping Gao, Xiaojun Quan, Ting Yao
机构
*
National University of Singapore(新加坡国立大学)
;
University of Science and Technology of China(中国科学技术大学)
;
University of California, Berkeley(加州大学伯克利分校)
专题命中
指令微调
:SFT(abstract,abstract_cn);LLM(abstract_cn);large language model(abstract);language model(abstract)
HE-SNR: Uncovering Latent Logic via Entropy for Guiding Mid-Training on SWE-bench
HE-SNR:通过熵揭示潜在逻辑以指导SWE-bench上的中期训练
Yueyang Wang, Jiawei Fu, Baolong Bi, Xili Wang, Xiaoqing Liu
机构
*
School of Mathematical Sciences, Peking University, Beijing, China(北京大学数学科学学院)
;
Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院计算技术研究所)
专题命中
指令微调
:SFT(abstract,abstract_cn);LLM(abstract_cn);large language model(abstract);language model(abstract)
Hangzhan Jin, Tianwei Ni, Lu Li, Pierre-Luc Bacon, Mohammad Hamdaqa, Doina Precup
机构
*
Mila - Quebec AI Institute(魁北克AI研究所)
;
Polytechnique Montréal(蒙特利尔理工学院)
;
Université de Montréal(蒙特利尔大学)
;
McGill University(麦吉尔大学)
;
CIFAR AI Chair(CIFAR人工智能主席)
;
Google DeepMind(谷歌DeepMind)
Comments12 pages, 2 figures. Accepted at the SCOLIA 2026 Workshop (Second Workshop on Scholarly Information Access), co-located with ECIR 2026. Workshop date: April 2, 2026
Journal refProceedings of the Second International Workshop on Scholarly Information Access (SCOLIA 2026), co-located with ECIR 2026, Delft, The Netherlands, April 2, 2026. CEUR Workshop Proceedings, Vol. 4187, pp. 16-30
Comments14 pages, 1 figure, 7 tables. Accepted to the 15th Workshop on Computational Approaches to Subjectivity, Sentiment & Social Media Analysis (WASSA) at EACL 2026, Rabat, Morocco
Journal refProceedings of the 15th Workshop on Computational Approaches to Subjectivity, Sentiment & Social Media Analysis (WASSA), 2026