arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanjing University(南京大学)

2026-02-12 至 2026-02-12 共收录 5
2510.20280 2026-02-12 cs.CL cs.AI

Context-level Language Modeling by Learning Predictive Context Embeddings

通过学习预测上下文嵌入进行上下文级语言建模

Beiya Dai, Yuliang Liu, Daozheng Xue, Yunchong Song, Qipeng Guo, Kai Chen, Xinbing Wang, Bowen Zhou, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Nanjing University(南京大学)

AI总结 ContextLM通过学习预测上下文嵌入,提升多令牌预测能力,实现更高效的参数和训练效率,同时在下游任务中表现更优。

Comments 19pages,6 figures, 13 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23279 2026-02-12 cs.CL

Unveiling Super Experts in Mixture-of-Experts Large Language Models

揭示混合专家大语言模型中的超级专家

Zunhai Su, Qingyuan Li, Hao Zhang, Weihao Ye, Qibo Xue, YuLei Qian, Yuchen Xie, Ngai Wong, Kehong Yuan

机构 * Tsinghua University(清华大学) Meituan(美团) Xiamen University(厦门大学) Nanjing University(南京大学) The University of Hong Kong(香港大学)

AI总结 研究揭示了混合专家大语言模型中起关键作用的超级专家,通过分析其影响发现其在数学推理中的重要性,并探讨了压缩这些专家对模型性能的显著影响。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10708 2026-02-12 cs.LG cs.AI

Interpretable Graph-Level Anomaly Detection via Contrast with Normal Prototypes

基于正常原型对比的图级异常检测

Qiuran Zhao, Kai Ming Ting, Xinpeng Li

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学)

AI总结 ProtoGLAD通过对比异常与最近正常原型图,提供可解释的图级异常检测方法,优于现有技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10158 2026-02-12 physics.chem-ph cs.AI

NMRTrans: Structure Elucidation from Experimental NMR Spectra via Set Transformers

NMRTrans: 通过集合变换从实验NMR谱图中确定结构

Liujia Yang, Zhuo Yang, Jiaqing Xie, Yubin Wang, Ben Gao, Tianfan Fu, Xingjian Wei, Jiaxing Sun, Jiang Wu, Conghui He, Yuqiang Li, Qinying Gu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Nanjing University(南京大学)

AI总结 NMRTrans通过集合变换模型,利用大规模实验光谱数据提升NMR结构解析的准确性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05892 2026-02-12 cs.LG

ContextBench: A Benchmark for Context Retrieval in Coding Agents

ContextBench: 一种用于编码代理代码上下文检索的基准测试

Han Li, Letian Zhu, Bohan Zhang, Rili Feng, Jiaming Wang, Yue Pan, Earl T. Barr, Federica Sarro, Zhaoyang Chu, He Ye

机构 * Nanjing University(南京大学) University College London(伦敦大学学院)

AI总结 ContextBench通过评估编码代理在问题解决过程中代码上下文的检索能力,揭示了代理在上下文利用上的不足,为改进LLM在软件任务中的推理提供了新的研究方向。

Comments 36 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏