arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-23 至 2026-02-23 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 6 篇

2602.17837 2026-02-23 cs.CR cs.CL cs.LG 90%

TFL: Targeted Bit-Flip Attack on Large Language Model

TFL:针对大语言模型的定向位翻转攻击

Jingkai Guo, Chaitali Chakrabarti, Deliang Fan

机构 * School of Electrical, Computer and Energy Engineering(电气、计算机与能源工程学院) Arizona State University(亚利桑那州立大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

AI总结 TFL是一种新型定向位翻转攻击框架,通过精确操控LLM输出并减少对无关输入的影响,提升攻击的隐蔽性和针对性。

Comments 13 pages, 11 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17931 2026-02-23 cs.LG cs.AI 86%

Memory-Based Advantage Shaping for LLM-Guided Reinforcement Learning

基于记忆的优势塑造用于LLM引导的强化学习

Narjes Nourzad, Carlee Joe-Wong

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于记忆的优势塑造方法,通过构建记忆图来提升LLM引导强化学习的样本效率和学习速度,减少对连续LLM监督的依赖。

Comments Association for the Advancement of Artificial Intelligence (AAAI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17930 2026-02-23 cs.LG cs.AI 86%

MIRA: Memory-Integrated Reinforcement Learning Agent with Limited LLM Guidance

MIRA: 集成记忆的强化学习智能体与有限LLM指导

Narjes Nourzad, Carlee Joe-Wong

机构 * University of Southern California(南加州大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 MIRA通过集成记忆图减少对LLM的依赖,提升稀疏奖励环境中的强化学习性能。

Comments International Conference on Learning Representations (ICLR'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18374 2026-02-23 cs.RO cs.AI 70%

Zero-shot Interactive Perception

零样本交互感知

Venkatesh Sripada, Frank Guerin, Amir Ghalamzan

机构 * University of Surrey(萨里大学) University of Sheffield(谢菲尔德大学)

专题命中 长上下文与记忆 :language model(abstract);prompting(abstract);分类 cs.AI

AI总结 ZS-IP通过结合多策略操作与基于记忆的视觉语言模型,实现零样本交互感知,提升复杂场景中推操作的性能。

Comments Original manuscript submitted on April 24, 2025. Timestamped and publicly available on OpenReview: https://openreview.net/forum?id=7MhpFcr5Nx

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14434 2026-02-23 cs.SE 67%

CMind: An AI Agent for Localizing C Memory Bugs

CMind:一种用于定位C内存错误的人工智能代理

Chia-Yi Su, Collin McMillan

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 CMind通过模拟人类程序员行为,利用大语言模型和引导决策方法,定位C程序中的内存错误。

Comments 4 pages, 2 figures. To be published in 34th IEEE/ACM International Conference on Program Comprehension (ICPC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18007 2026-02-23 cs.DC 67%

Joint Training on AMD and NVIDIA GPUs

在AMD和NVIDIA GPU上联合训练

Jon Hu, Thomas Jia, Jing Zhu, Zhendong Yu

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 本文提出了一种在AMD和NVIDIA GPU上实现高效异构混合训练的技术方案,通过设备直接通信机制提升训练吞吐量至接近同构系统的98%。

详情

展开后加载摘要…

URL PDF HTML 收藏