arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12698 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 665 篇

2607.21067 2026-07-24 cs.CL 新提交 70%

PrefReward: Learning User Preference Matrix for Personalized Text Generation

PrefReward:学习用于个性化文本生成的用户偏好矩阵

Yue Wu, Chengbing Wang, Yimeng Bai, Xiaoyan Zhao, Yang Zhang, Fuli Feng

机构 * University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究针对大语言模型个性化生成中存在的问题,提出PrefReward框架,通过提取用户特定偏好矩阵并将其作为奖励信号指导生成,实验证明该框架在生成质量和个性化可解释性上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17710 2026-07-21 cs.LG 新提交 70%

Planning with Transformers: Chain of Computation and Structured Context Windows

使用Transformer进行规划:计算链与结构化上下文窗口

Ehsan Futuhi, Nathan R. Sturtevant

机构 * Department of Computing Science, University of Alberta(阿尔伯塔大学计算科学系) Alberta Machine Intelligence Institute (Amii)(阿尔伯塔机器智能研究所)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型解决规划问题的不足,提出计算链架构,利用结构化上下文窗口,让语言模型学习规划策略、预测世界模型并执行算术运算,在多个任务上取得高成功率,能解决复杂汉诺塔问题且减少训练数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16213 2026-07-21 cs.AI 新提交 70%

SelKV: Selective KV Cache Merging with Per-Token Merge-or-Drop and Attention Compensation

SelKV:基于逐令牌合并或丢弃及注意力补偿的选择性键值缓存合并

Soumia Bouyahiaoui, Manel Kara laouar, Aicha Boutorh, Mohamed Hadj Ameur

机构 * National School of Artificial Intelligence (ENSIA)(国家人工智能学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对大型语言模型KV缓存内存占用瓶颈问题,提出无训练的SelKV双组件框架,通过软余弦门和注意力比率补偿机制进行缓存压缩,在LongBench数据集上仅保留25%缓存时性能强大,在多文档问答任务中表现出色且解码加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09052 2026-07-13 cs.LG 新提交 70%

COBS: Cumulant Order Block Sparse Attention

COBS:累积阶数块稀疏注意力

Alexander Tian, Aditya Ghai, Sanjit Neelam, Zaal Vasania, Akshay Mishra

机构 * MatX

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型中缓解KV缓存读取瓶颈的块稀疏注意力方法,以DeepSeek的NSA为代表分析其块选择问题。通过累积量展开指出现有方法局限,提出COBS方法,在32k RULER基准上提升了NSA基线分数,缩小与密集注意力差距,且减少了KV缓存读取流量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08395 2026-07-10 cs.CR cs.CL 新提交 70%

Token-Flow Firewall: Semantic Runtime Auditing for Persistent AI Agents

令牌流防火墙:持久人工智能代理的语义运行时审计

Puji Wang, Yingchen Zhang, Ruqing Zhang, Jiafeng Guo, Xueqi Cheng

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学北京校区)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对持久人工智能代理不安全内容传播问题,提出TokenWall运行时防御框架,通过对令牌流进行语义审计及相关操作,实现安全-效用权衡,实验显示其有效降低攻击成功率,保持高良性通过率且增加延迟少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08032 2026-07-10 cs.LG 新提交 70%

What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents

保留什么,遗忘什么:大语言模型和智能体中内存压缩的率失真视角

Ashwin Gerard Colaco, Nada Lahjouji

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型和智能体内存压缩问题,提出基于率失真视角统一分类各层方法,构建七轴分类法并转移机制,还针对相关问题未被测量及缺乏统一基准的情况,转化为提案、实验、原则并梳理开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01935 2026-07-09 cs.AI 新提交 70%

A-TMA: Decoupling State-Aware Memory Failures in Long-Term Agent Memory

A-TMA: 解耦长期智能体记忆中的状态感知记忆故障

Zitong Shi, Yixuan Tang, Anthony Kum Hoe Tung

机构 * National University of Singapore(新加坡国立大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对长期记忆中状态不一致导致的幽灵记忆问题,提出A-TMA方法,通过状态感知覆盖层在存储、检索和回答三个层面解耦故障,在冲突密集基准上显著提升时间F1。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02967 2026-07-08 cs.LG cs.NE 新提交 70%

Rank-Order N-of-M Codes for Sparse Distributed Memory: Disentangling Representation and Learning Effects in Noise Robustness Against Contemporary Neuromorphic Architectures

用于稀疏分布式内存的秩排序N选M码:在针对当代神经形态架构的噪声鲁棒性中解开表示和学习效应

Joy Bose

机构 * Independent Researcher(独立研究者) Bengaluru, India(印度班加罗尔)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对大语言模型持续学习受限问题,评估秩排序N选M编码替代稀疏分布式内存阈值二进制编码器。通过重新实现验证架构等效,实验表明其在容量和误码率鲁棒性上有优势,还分析了编码能量,为相关架构提供指导。

Comments 14 pages, 8 tables, 2 figures. Revisits rank-order sparse distributed memory for continual learning and memory-augmented AI. Includes comparisons with CALM and SpikingMamba, statistical evaluation, and real embedding experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02881 2026-07-07 cs.CL 新提交 70%

PraMem: Practice-derived Experiential Memory for Long-horizon Behavior Prediction

PraMem:用于长时行为预测的实践衍生经验记忆

Zhuoqun Li, Boxi Cao, Jiawei Chen, Hanshu Zhou, Ruoxi Xu, Guiping Jiang, Ruotong Pan, Tingting Gao, Han Li, Xiangyu Wu, Hongyu Lin, Yaojie Lu, Xianpei Han, Le Sun

机构 * Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所中文信息处理实验室) University of Chinese Academy of Sciences(中国科学院大学) Fudan University(复旦大学) Kuaishou Technology(快手科技)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究长时行为预测问题,针对大语言模型在该任务中的不足,提出PraMem范式,通过对历史序列预实践构建经验记忆辅助长时行为预测,实验证明其性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01814 2026-07-03 cs.AI 新提交 70%

MMIR-TCM: Memory-Integrated Multimodal Inference and Retrieval for TCM Clinical Decision Support

MMIR-TCM:面向中医临床决策支持的记忆集成多模态推理与检索

Lihui Luo, Joongwon Chae, Ziyan Chen, Yang Liu, Siyi Cheng, Weihan Gao, Zelin Zeng, Xiaoming Yin, Samaneh Beheshti Kashi, Dongmei Yu, Lian Zhang, Jing Sui, Zeming Liang, Jiansong Ji, Peter E. Lobie, Peiwu Qin

机构 * Institute of Biopharmaceutics and Health Engineering, Tsinghua Shenzhen International Graduate School(清华深圳国际研究生院生物医药与健康工程研究院) Chinese Medicine Guangdong Laboratory(广东省中医药实验室) Beijing Normal University(北京师范大学) First Hospital of Hebei Medical University(河北医科大学第一医院) Lishui Hospital of Zhejiang University(浙江大学丽水医院) XiaoMing TCM Hospital(小明中医医院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出MMIR-TCM框架,结合多模态大模型、记忆增强分割与检索增强生成,解决中医舌诊中的主观性和语义鸿沟问题,在MedTCM数据集上优于GPT-4o等模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01204 2026-07-02 cs.LG 新提交 70%

TiRex-2: Generalizing TiRex to Multivariate Data and Streaming

TiRex-2: 将 TiRex 推广到多变量数据和流式处理

Patrick Podest, Marco Pichler, Elias Bürger, Levente Zólyomi, Bernhard Voggenberger, Wilhelm Berghammer, Daniel Klotz, Sebastian Böck, Günter Klambauer, Sepp Hochreiter

机构 * ELLIS Unit Linz, LIT AI Lab & Institute for Machine Learning, JKU Linz, Austria(ELLIS 林茨单元,LIT AI 实验室与机器学习研究所,林茨约翰·开普勒大学,奥地利) NXAI Lab, Linz, Austria(NXAI 实验室,林茨,奥地利) NXAI GmbH, Linz, Austria(NXAI 有限公司,林茨,奥地利) Interdisciplinary Transformation University Austria, Linz, Austria(奥地利跨学科转型大学,林茨,奥地利)

专题命中 长上下文与记忆 :foundation model(abstract);pretraining(abstract);分类 cs.LG

AI总结 提出基于 xLSTM 的循环时间序列基础模型 TiRex-2,通过记忆中心设计实现多变量预测与流式处理,在零样本任务上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26654 2026-06-26 cs.CL cs.HC cs.IR 新提交 70%

SocialPersona: Benchmarking Personalized Profiling and Response with Multimodal Social-Media Context

SocialPersona: 基于多模态社交媒体上下文的个性化画像与回复基准测试

Qinkai Zhang, Yanyan Zhao, Xin Lu, Yulin Hu, Pengtao Han, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出SocialPersona基准,评估多模态大语言模型从社交媒体时间线推断用户偏好并用于对话的能力,实验表明模型在细粒度与近期偏好上表现不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24626 2026-06-24 cs.AI 新提交 70%

SAFARI: Scaling Long Horizon Agentic Fault Attribution via Active Investigation

SAFARI: 通过主动调查扩展长时域智能体故障归因

Chenyang Zhu, Jiayu Yao, Kushal Chawla, Youbing Yin, Nathan Wolfe, Pengshan Cai, Jingyu Wu, Spencer Hong, Sangwoo Cho, Shi-Xiong Zhang, Daben Liu, Sambit Sahu, Erin Babinsky

机构 * Department of Engineering Sciences(工程科学系) Applied Mathematics, Northwestern University(应用数学,西北大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出SAFARI框架,用工具增强的诊断循环替代线性上下文加载,结合短期记忆解耦诊断准确性与上下文限制,在Who&When和TRAIL GAIA数据集上分别提升20%和19%,并在超出上下文窗口5倍时保持0.58精度。

Comments Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24595 2026-06-24 cs.CL 新提交 70%

MEMPROBE: Probing Long-Term Agent Memory via Hidden User-State Recovery

MEMPROBE:通过隐藏用户状态恢复探测长期智能体记忆

Enze Ma, Yufan Zhou, Wei-Chieh Huang, Jie Yang, Huanhuan Ma, Zixuan Wang, Chengze Li, Chunyu Miao, Philip S. Yu, Zhen Wang

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) KU Leuven(库尔勒大学) UC San Diego(圣地亚哥大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 提出MEMPROBE基准,通过从智能体记忆重建隐藏用户状态来直接评估长期记忆,发现任务完成与记忆可恢复性是不同的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23961 2026-06-24 cs.LG 新提交 70%

Forget Without Compromise: Nexus Sampling for Streaming KV-Cache Eviction Under Fixed Budgets

无需妥协的遗忘:固定预算下流式KV缓存驱逐的Nexus采样

Duc Duong, Hoang Anh Duy Le, Jianwen Xie, Anshumali Shrivastava, Zhaozhuo Xu

机构 * Department of Computer Science, Grinnell College(格林内尔学院计算机科学系) Department of Computer Science, Rice University(莱斯大学计算机科学系) Lambda, Inc(Lambda公司) Workato(Workato公司)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 提出Nexus采样方法,通过迭代注意力计算和加权水库采样替代确定性top-K选择,在固定预算下保留微妙重要令牌,理论证明其长期优势,实验在80%驱逐率下性能接近密集注意力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23687 2026-06-23 cs.CL 新提交 70%

Randomized YaRN Improves Length Generalization for Long-Context Reasoning

随机化 YaRN 提升长上下文推理的长度泛化能力

Manas Mehta, Fangcong Yin, Greg Durrett

机构 * New York University(纽约大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出随机化 YaRN 方法,通过结合 YaRN 位置外推、随机位置编码和长度课程,在短上下文训练数据上提升模型对长上下文(16K-128K)的推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22844 2026-06-23 cs.AI cs.MA 新提交 70%

RaMem: Contextual Reinstatement for Long-term Agentic Memory

RaMem: 面向长期智能体记忆的上下文重建

Wei Yang, Bryce Kan, Shixuan Li, Li Li, Yuehan Qin, Jiate Li, Paul Bogdan, Jesse Thomason

机构 * University of Southern California(南加州大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对长期记忆中的上下文坍塌问题,提出RaMem框架,通过证据锚定、回忆条件归纳、有效性感知检索和上下文保留合成四个阶段,将检索到的记忆片段转化为可验证的上下文证据,在多个基准上平均F1提升超10%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18259 2026-06-18 cs.HC cs.AI 新提交 70%

Caring Without Feeling: Affective Dynamics as the Control Layer of Human-AI Agent Collaboration

无感关怀:情感动态作为人-AI智能体协作的控制层

Junjie Xu, Xingjiao Wu, Zihao Zhang, Yujia Xu, Yuzhe Yang, Jin Zhu, Luwei Xiao, Wen Wu, Liang He

机构 * East China Normal University(华东师范大学) National University of Singapore(新加坡国立大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文综述情感动态在人-AI智能体协作中的作用,提出将情感视为协调层而非AI内部属性,用于校准信任、委托和治理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17798 2026-06-17 cs.CV cs.AI 新提交 70%

LiveStarPro: Proactive Streaming Video Understanding with Hierarchical Memory for Long-Horizon Streams

LiveStarPro: 具有分层记忆的主动式流视频理解用于长时域流

Zhenyu Yang, Kairui Zhang, Bing Wang, Shengsheng Qian, Changsheng Xu

机构 * IEEE

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出LiveStarPro,通过流验证解码、流因果注意力掩码和树结构分层记忆三个组件,实现长时域流媒体视频的主动理解,在语义正确性和时序误差上分别提升28.9%和降低18.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17735 2026-06-17 cs.AI 新提交 70%

Shattering the Autoregressive Curse: Dynamic Epistemic Entropy Orchestrated Erasable Reinforcement Learning for LLMs

打破自回归诅咒:动态认知熵编排的可擦除强化学习用于大语言模型

Ziliang Wang, Kang An, Faqiang Qian, Jialu Cai, Cijun Ouyang, Yuhang Wang, Qibing Ren, Yichao Wu

机构 * SenseTime(商汤科技) Shanghai Jiao Tong University(上海交通大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出动态认知熵编排的可擦除强化学习(E³RL),通过将模型内生的局部自回归交叉熵作为认知不确定性坐标,利用分段自适应动态阈值和优势分配精准切除逻辑缺陷并重用KV缓存,解决长序列推理中的自回归级联崩溃问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16898 2026-06-16 cs.CV cs.AI 新提交 70%

Semantic Flip: Synthetic OOD Generation for Robust Refusal in Embodied Question Answering and Spatial Localization

Semantic Flip: 用于具身问答和空间定位中鲁棒拒绝的合成OOD生成

Dongbin Na, Chanwoo Kim, Giyun Choi, Dooyoung Hong

机构 * RGA Inc.(RGA公司)

专题命中 长上下文与记忆 :language model(abstract);prompting(abstract);分类 cs.AI

AI总结 提出Semantic Flip框架,通过合成辅助OOD样本训练轻量拒绝模块,使冻结的视觉语言模型在无外部OOD标注下实现鲁棒拒绝,在具身问答和空间定位基准上优于强提示基线。

Comments 18 pages, 3 figures. Code and data: https://github.com/ndb796/SemanticFlip ; project page: https://ndb796.github.io/SemanticFlip

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14790 2026-06-16 cs.PL cs.AI 新提交 70%

XFlow: An Executable Protocol Programming System for Reliable Multi-Agent Workflows

XFlow: 一个用于可靠多智能体工作流的可执行协议编程系统

Hanqi Li, Jing Peng, Zijian Wang, Lu Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室,计算机科学学院,上海交通大学,上海,中国) Jiangsu Key Lab of Language Computing, Suzhou, China(江苏省语言计算重点实验室,苏州,中国) Suzhou Laboratory, Suzhou, China(苏州实验室,苏州,中国)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出XFlow可执行协议编程系统及其领域特定语言XPF,通过将工作流承诺从提示移至可检查、可执行的协议结构,并利用生命周期管理的符号中介智能体输出,提升多智能体工作流的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14674 2026-06-15 cs.CL 新提交 70%

AgentSpec: Understanding Embodied Agent Scaffolds Through Controlled Composition

AgentSpec: 通过受控组合理解具身智能体脚手架

Jixuan Chen, Jianzhi Shen, Haoqiang Kang, Zhi Hong, Qingyi Jiang, Soham Bose, Yiming Zhang, Leon Leng, Amit Vyas, Lingjun Mao, Siru Ouyang, Kun Zhou, Lianhui Qin

机构 * University of California, San Diego(加利福尼亚大学圣迭戈分校) Johns Hopkins University(约翰霍普金斯大学) University of Washington(华盛顿大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 提出AgentSpec模块化规范框架,将具身智能体表示为可复用策略组件的类型化组合,通过标准化接口实现受控组件替换与重组,揭示脚手架兼容性和交互效应对性能的主导作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12797 2026-06-12 cs.AI 新提交 70%

The Containment Gap: How Deployed Agentic AI Frameworks Fail Public-Facing Safety Requirements

遏制缺口:已部署的自主AI框架如何未能满足面向公众的安全要求

Md Jafrin Hossain, Mohammad Arif Hossain, Weiqi Liu, Nirwan Ansari

机构 * New Jersey Institute of Technology(新泽西理工学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究发现主流自主AI框架缺乏架构级安全保证,内存完整性漏洞可导致定向腐败,提出轻量级遏制机制消除攻击向量。

Comments ICML 2026 (AI4GOOD Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11853 2026-06-11 cs.CV cs.AI 新提交 70%

Task-Aware Structured Memory for Dynamic Multi-modal In-Context Learning

任务感知结构化记忆用于动态多模态上下文学习

Zhirui Chen, Ziwei Chen, Ling Shao

机构 * Zhihui Chen(陈志辉) Ziwei Chen(陈子伟) Ling Shao(邵令)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出TASM框架,通过任务向量引导压缩、语义感知令牌合并和层次化记忆结构,解决多模态大语言模型上下文学习中记忆压缩导致的语义破坏和静态问题。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10662 2026-06-10 cs.MA cs.AI 新提交 70%

Decentralized Multi-Agent Systems with Shared Context

具有共享上下文的去中心化多智能体系统

Yuzhen Mao, Azalia Mirhoseini

机构 * Stanford University(斯坦福大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出DeLM框架,通过并行智能体、共享上下文和任务队列去中心化协调,解决集中式MAS的瓶颈,在软件工程和长上下文推理中提升性能并降低成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07127 2026-06-08 cs.LG 新提交 70%

Learning Explicit Behavioral Models with Adaptive Questions and World-Model Probes

通过自适应问题和世界模型探针学习显式行为模型

Hikaru Shindo, Yu Deng, Teng Cao, Quentin Delfosse, Christopher Tauchmann, Jannis Blüml, Gopika Sudhakaran, Kristian Kersting

机构 * Artificial Intelligence and Machine Learning Lab(人工智能与机器学习实验室) Technical University of Darmstadt(德累斯顿技术大学) Hessian Center for Artificial Intelligence (hessian.AI)(黑森人工智能中心) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Department of Computer Science(计算机科学系) Centre for Cognitive Science(认知科学中心)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 提出显式符号行为模型(ESBM),通过自适应问题和世界模型探针将任务性能与可解释机制结合,在Atari任务中学习高分策略并生成显式答案和机制预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23982 2026-08-26 cs.AI cs.CL cs.LG 新提交 67%

Memory Is Not Always Needed: Characterizing Conditional Memory in Scientific Reasoning

记忆并非总是必需:科学推理中条件记忆的特征分析

Zhen Bi, Xueshu Chen, Yan Wang, Zhizhi Peng, Haosen Hong, Zhen Wang, Zhixuan Chu, Bingyu Zhu, Jungang Lou

机构 * Huzhou Normal University(湖州师范大学) Alibaba Group(阿里巴巴集团) Bota Biosciences(博塔生物科技) Zhejiang University(浙江大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究探究科学推理中条件记忆的参与机制,提出知识边界感知路由器,在生物化学推理基准上验证其可保留有益记忆贡献并抑制退化,确立选择性记忆分配的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22275 2026-08-25 cs.SE cs.CR 新提交 67%

CodeMechanic: Bug-Property-Guided Program Mitigation

CodeMechanic:基于漏洞属性引导的程序缓解方案

Han Zheng, Rafaila Galanopoulou, Ilia Shumailov, Tianqi Fan, Aiden Hall, Dominik Maier, Mathias Payer

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 本文提出CodeMechanic系统,通过重构内存安全属性、插入故障停止保护等方法,在101个ARVO漏洞上生成更多合理且语义等价的补丁,同时降低token使用量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22035 2026-08-25 cs.RO 新提交 67%

Ludi${}_{\scriptscriptstyle 0.1}$: An Agentic System for Socially Intelligent Robots

Ludi₀.₁:面向社交智能机器人的智能体系统

Wooseong Chung, William Cong, Jakub Dworakowski, Ethan Ewer, Tri Wahyu Guntara, Yeonwoo Jeong, Tianchong Jiang, Chaewon Kim, Hyunseo Kim, Jinwoo Kim, Jinyeon Kim, Yea-Seul Kim, Jack Kunde, Kangwook Lee, Sangheon Lee, Robert Nowak, Junha Roh

机构 * Ludo Robotics(乐动机器人)

专题命中 长上下文与记忆 :language model(abstract);foundation model(abstract)

AI总结 该研究提出Ludi₀.₁智能体系统,集成多技能与微调视觉语言模型,为社交智能机器人提供可行的人机协作方案,还可生成相关交互轨迹用于开发更融合的机器人基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏