arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-02 至 2025-12-02 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 7 篇

2512.01541 2025-12-02 cs.AR 89%

RoMe: Row Granularity Access Memory System for Large Language Models

RoMe:面向大语言模型的行粒度访问内存系统

Hwayong Nam, Seungmin Baek, Jumin Kim, Michael Jaemin Kim, Jung Ho Ahn

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 RoMe通过行粒度访问DRAM并移除冗余结构,简化内存调度并提升带宽,适用于大语言模型的高效内存系统。

Comments 15 pages, 14 figures, accepted at HPCA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01357 2025-12-02 cs.DC cs.AI cs.AR 85%

Tangram: Accelerating Serverless LLM Loading through GPU Memory Reuse and Affinity

Tangram: 通过GPU内存重用和亲和力加速无服务器LLM加载

Wenbin Zhu, Zhaoyan Shen, Zili Shao, Hongjun Dai, Feng Chen

机构 * Shandong University(山东大学) The Chinese University of Hong Kong(香港中文大学) Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Tangram通过GPU内存重用和亲和力调度技术,显著提升无服务器LLM的加载速度和冷启动性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00504 2025-12-02 cs.CL cs.AI 79%

G-KV: Decoding-Time KV Cache Eviction with Global Attention

G-KV:基于全局注意力的解码时间KV缓存淘汰

Mengqi Liao, Lu Wang, Chaoyun Zhang, Zekai Shen, Xiaowei Mao, Si Qin, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang, Huaiyu Wan

机构 * School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学) MicroSoft(微软) Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence(北京交通数据挖掘与具身智能重点实验室)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

AI总结 G-KV通过结合局部和历史注意力分数的全局评分机制,改进KV缓存淘汰,提升大语言模型的推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01591 2025-12-02 cs.LG q-bio.NC 77%

Scaling and context steer LLMs along the same computational path as the human brain

按计算路径扩展和引导大语言模型,使其与人脑一致

Joséphine Raugel, Stéphane d'Ascoli, Jérémy Rapin, Valentin Wyart, Jean-Rémi King

机构 * Meta AI Laboratoire de Neurosciences Cognitives et Computationnelles (Inserm U960)(神经认知与计算实验室) Ecole Normale Supérieure - PSL(巴黎高等师范学院 - PSL)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究通过分析人脑和LLM的表示对齐性,发现两者在计算顺序上一致,但受模型大小和上下文长度影响。

Journal ref Neurips Proceedings 2025 - Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00059 2025-12-02 cs.AR cs.LG 77%

SafeCiM: Investigating Resilience of Hybrid Floating-Point Compute-in-Memory Deep Learning Accelerators

SafeCiM: 探究混合浮点计算内存深度学习加速器的鲁棒性

Swastik Bhattacharya, Sanjay Das, Anand Menon, Shamik Kundu, Arnab Raha, Kanad Basu

机构 * Department of Electrical and Computer Engineering, University of Texas at Dallas(得克萨斯大学达拉斯分校电气与计算机工程系) Advanced Architecture Research Group at Intel Corporation(英特尔公司先进架构研究组) Department of Electrical, Computer and Systems Engineering, Rensselaer Polytechnic Institute(拉特格斯理工学院电气、计算机与系统工程系)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 SafeCiM通过引入位翻转故障分析,提升了混合浮点计算内存加速器在硬件故障下的鲁棒性,显著降低了LLM推理准确性下降的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00325 2025-12-02 cs.SE cs.AI cs.CL 62%

Progressive Code Integration for Abstractive Bug Report Summarization

渐进式代码集成用于抽象式bug报告摘要

Shaira Sadia Karim, Abrar Mahmud Rahim, Lamia Alam, Ishmam Tashdeed, Lutfun Nahar Lota, Md. Abu Raihan M. Kamal, Md. Azam Hossain

机构 * Islamic University of Technology(伊斯兰技术大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出渐进式代码集成框架,通过整合长代码片段和文本内容,提升基于LLM的bug报告摘要效果,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11165 2025-12-02 cs.CV 50%

Explainable Deep Convolutional Multi-Type Anomaly Detection

可解释的深度卷积多类型异常检测

Alex George, Lyudmila Mihaylova, Sean Anderson

机构 * School of Electrical and Electronic Engineering(电子工程学院)

专题命中 长上下文与记忆 :language model(abstract)

AI总结 本文提出 MultiTypeFCDD 框架,通过图像级别标签生成多通道热图,实现多类型异常检测,有效解决传统方法的计算和内存限制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏