arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-17 至 2025-12-17 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 6 篇

2512.14118 2025-12-17 cs.CL 89%

CogMem: A Cognitive Memory Architecture for Sustained Multi-Turn Reasoning in Large Language Models

CogMem:一种用于大型语言模型中持续多轮推理的认知记忆架构

Yiran Zhang, Jincheng Hu, Mark Dras, Usman Naseem

机构 * Macquarie University(麦考瑞大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 CogMem通过引入认知启发的记忆增强架构,解决大型语言模型在多轮交互中的推理偏差、任务漂移和记忆衰减问题,提升推理的连贯性和可靠性。

Comments underreview

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13713 2025-12-17 cs.AI cs.LG cs.MA 86%

LoopBench: Discovering Emergent Symmetry Breaking Strategies with LLM Swarms

LoopBench: 通过LLM群体发现涌现的对称性打破策略

Ali Parsaee, Yashar Talebirad, Csongor Szepesvári, Vishwajeet Ohal, Eden Redman

机构 * University of Alberta(阿尔伯塔大学) Network for Applied Technology(应用技术网络)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 LoopBench通过LLM群体研究分布式对称性打破策略,揭示先进模型在解决死锁问题上的能力。

Comments 11 pages, 3 figures, submitted to ANTS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14130 2025-12-17 cs.CR cs.AI 57%

UIXPOSE: Mobile Malware Detection via Intention-Behaviour Discrepancy Analysis

基于意图-行为不一致分析的移动恶意软件检测:UIXPOSE

Amirmohammad Pasdar, Toby Murray, Van-Thuan Pham

机构 * School of Computing and Information Systems(计算与信息系统学院) The University of Melbourne(墨尔本大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI

AI总结 UIXPOSE通过意图-行为不一致分析提升移动恶意软件的动态检测能力

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13921 2025-12-17 cs.LG 57%

Sliding Window Recurrences for Sequence Models

滑动窗口递归关系用于序列模型

Dragos Secrieru, Garyk Brixi, Yoshua Bengio, Taiji Suzuki, Michael Poli, Stefano Massaroli

专题命中 长上下文与记忆 :language model(abstract);分类 cs.LG

AI总结 本研究提出滑动窗口递归关系,通过分层分解框架优化GPU内存层次结构,实现比优化Transformer更快的序列模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14313 2025-12-17 cs.IR 50%

Dynamic Context Selection for Retrieval-Augmented Generation: Mitigating Distractors and Positional Bias

动态上下文选择用于检索增强生成:缓解干扰项和位置偏差

Malika Iratni, Mohand Boughanem, Taoufiq Dkaki

专题命中 长上下文与记忆 :language model(abstract)

AI总结 本文提出动态上下文选择方法,通过优化检索文档数量和位置以提升RAG生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04540 2025-12-17 cs.CV 50%

VideoMem: Enhancing Ultra-Long Video Understanding via Adaptive Memory Management

VideoMem: 通过自适应内存管理增强超长视频理解

Hongbo Jin, Qingyuan Wang, Wenhao Zhang, Yang Liu, Sijie Cheng

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学)

专题命中 长上下文与记忆 :language model(abstract)

AI总结 VideoMem通过自适应内存管理框架,有效提升超长视频理解任务的性能,采用PRPO算法和两个核心模块实现高效训练和长期记忆保留。

详情

展开后加载摘要…

URL PDF HTML 收藏