arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-19 至 2026-02-19 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 11 篇

2602.16520 2026-02-19 cs.CR cs.AI 85%

Recursive language models for jailbreak detection: a procedural defense for tool-augmented agents

递归语言模型用于对抗检测:一种针对工具增强代理的程序性防御

Doron Shavit

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

AI总结 本文提出基于递归语言模型的RLM-JB框架,通过程序化方法检测对抗性输入,实现高检测效果与高精度的平衡。

Comments 5 pages and 1 figure. Appendix: an additional 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16054 2026-02-19 cs.CL cs.LG 81%

CLAA: Cross-Layer Attention Aggregation for Accelerating LLM Prefill

CLAA: 跨层注意力聚合用于加速大语言模型预填

Bradley McDanel, Steven Li, Harshit Khaitan

机构 * Franklin and Marshall College(弗兰克林与马歇尔学院) Meta Reality Labs(Meta现实实验室)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.CL、cs.LG

AI总结 CLAA通过跨层聚合注意力分数,提升大语言模型预填阶段的推理速度,将TTFT降低至39%。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05298 2026-02-19 stat.ML cs.LG math.OC 79%

Logarithmic-time Schedules for Scaling Language Models with Momentum

用于大规模语言模型的对数时间调度

Damien Ferbach, Courtney Paquette, Gauthier Gidel, Katie Everett, Elliot Paquette

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.LG

AI总结 ADANA通过引入对数时间调度和阻尼机制,在大规模语言模型训练中提升性能和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07274 2026-02-19 cs.LG cs.AI 79%

Forget Forgetting: Continual Learning in a World of Abundant Memory

遗忘遗忘:在充足记忆世界中的持续学习

Dongkyu Cho, Taesup Moon, Rumi Chunara, Kyunghyun Cho, Sungmin Cha

机构 * New York University(纽约大学) Seoul National University(首尔国立大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种轻量级方法,通过权重空间巩固在充足内存环境下提升持续学习性能,挑战传统假设并提供低计算成本的替代方案。

Comments 26 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16534 2026-02-19 cs.CR cs.AI 77%

Targeting Alignment: Extracting Safety Classifiers of Aligned LLMs

针对对齐:提取对齐LLM的安全分类器

Jean-Charles Noirot Ferrand, Yohan Beugin, Eric Pauley, Ryan Sheatsley, Patrick McDaniel

机构 * 2 Department of Computer Science Virginia Tech Blacksburg, VA, USA

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种提取对齐LLM安全分类器的方法,通过构建候选分类器并评估其在对抗性攻击中的有效性,展示了替代分类器在提高攻击成功率方面的优势。

Comments This work has been accepted for publication at the IEEE Conference on Secure and Trustworthy Machine Learning (SaTML). The final version will be available on IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14299 2026-02-19 cs.CL cs.AI cs.CY 73%

Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook

人工智能代理社会中社会化是否会出现?Moltbook案例研究

Ming Li, Xirui Li, Tianyi Zhou

机构 * University of Maryland(马里兰大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 Moltbook研究揭示AI代理社会在规模和交互密度下难以形成稳定结构和共识,表明社会化需要更复杂的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16704 2026-02-19 cs.CL 70%

Reinforced Fast Weights with Next-Sequence Prediction

增强型快速权重与下序列预测

Hee Seung Hwang, Xindi Wu, Sanghyuk Chun, Olga Russakovsky

专题命中 长上下文与记忆 :language model(abstract);post-training(abstract);分类 cs.CL

AI总结 REFINE通过强化学习框架在下序列预测目标下训练快速权重模型,提升长上下文建模性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06051 2026-02-19 cs.CL 57%

CAST: Character-and-Scene Episodic Memory for Agents

CAST:基于角色和场景的事件记忆用于智能体

Kexin Ma, Bojun Li, Yuhua Tang, Liting Sun, Ruochun Jin

机构 * College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL

AI总结 CAST通过构建3D场景和角色档案,结合图结构语义记忆,提升智能体对连贯事件的回忆能力,实验结果显示在多个数据集上性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15927 2026-02-19 cs.CV cs.LG 57%

Visual Memory Injection Attacks for Multi-Turn Conversations

多轮对话中的视觉记忆注入攻击

Christian Schlarmann, Matthias Hein

机构 * Tübingen AI Center, University of Tübingen, Germany(图宾根人工智能中心,图宾根大学,德国)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.LG

AI总结 本文提出一种多轮对话中的视觉记忆注入攻击,通过操控用户输入实现隐蔽的信息操控,展示了对大视觉-语言模型的安全威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15010 2026-02-19 cs.RO cs.LG 57%

BPP: Long-Context Robot Imitation Learning by Focusing on Key History Frames

BPP: 通过聚焦关键历史帧实现长上下文机器人模仿学习

Max Sobol Mark, Jacky Liang, Maria Attarian, Chuyuan Fu, Debidatta Dwibedi, Dhruv Shah, Aviral Kumar

机构 * Carnegie Mellon University(卡内基梅隆大学) Google DeepMind(谷歌DeepMind)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.LG

AI总结 BPP通过聚焦关键历史帧,提升机器人模仿学习在长上下文任务中的表现,成功率达70%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16493 2026-02-19 cs.CV 50%

MMA: Multimodal Memory Agent

MMA:多模态记忆代理

Yihao Lu, Wanru Cheng, Zeyu Zhang, Hao Tang

机构 * School of Computer Science, Peking University(北京大学计算机学院)

专题命中 长上下文与记忆 :foundation model(abstract)

AI总结 MMA通过动态可靠性评分和冲突感知网络共识,提升多模态代理在长horizon任务中的记忆检索与决策能力,同时在多个基准测试中展现优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏