arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-01 至 2025-12-01 共收录 8 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 8 篇

2511.11772 2025-12-01 cs.CY cs.AI 70%

Scaling Equitable Reflection Assessment in Education via Large Language Models and Role-Based Feedback Agents

通过大型语言模型和基于角色的反馈代理实现教育中的公平性评估扩展

Chenyu Zhang, Xiaohang Luo

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出利用多代理LLM系统实现公平、高质量的形成性反馈,通过角色化代理生成公平、简洁的反馈,提升教育公平性与教学效率。

Comments Accepted to AAAI-26 AISI Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22609 2025-12-01 cs.CV cs.RO 67%

MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory

MG-Nav:基于稀疏空间记忆的双尺度视觉导航

Bo Wang, Jiehong Lin, Chenzhi Liu, Xinting Hu, Yifei Yu, Tianjia Liu, Zhongrui Wang, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract)

AI总结 MG-Nav通过稀疏空间记忆图和VGGT-adapter模块实现双尺度视觉导航,结合全局规划与局部控制,实现零样本导航的高鲁棒性与高性能。

Comments 10pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22311 2025-12-01 cs.AI cond-mat.mes-hall cond-mat.soft cs.CL cs.LG 67%

Swarms of Large Language Model Agents for Protein Sequence Design with Experimental Validation

大规模语言模型代理群组用于蛋白质序列设计的实验验证

Fiona Y. Wang, Di Sheng Lee, David L. Kaplan, Markus J. Buehler

机构 * Laboratory for Atomistic and Molecular Mechanics (LAMM), Department of Biological Engineering, Massachusetts Institute of Technology(原子分子力学实验室(LAMM),生物工程系,麻省理工学院) Department of Biomedical Engineering, Tufts University(生物医学工程系,塔夫茨大学) Laboratory for Atomistic and Molecular Mechanics (LAMM), Department of Civil and Environmental Engineering, Department of Mechanical Engineering, Center for Computational Science and Engineering, Schwarzman College of Computing, Massachusetts Institute of Technology(原子分子力学实验室(LAMM),土木与环境工程系,机械工程系,计算科学与工程中心,计算机科学学院,麻省理工学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种基于大规模语言模型代理群组的蛋白质序列设计方法,通过去中心化协调实现高效目标导向设计,无需微调或特定训练,且在实验中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21730 2025-12-01 cs.CL cs.AI cs.LG 67%

A Benchmark for Procedural Memory Retrieval in Language Agents

一种用于语言代理中程序记忆检索的基准测试

Ishant Kohar, Aswanth Krishnan

机构 * Qpi AI

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种用于评估语言代理程序记忆检索能力的基准测试,通过构建双语料库和系统分层查询,揭示了基于嵌入的方法在新上下文中的泛化问题,并展示了LLM生成的程序抽象在跨上下文转移中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21726 2025-12-01 cs.CL cs.AI cs.LG 67%

Goal-Directed Search Outperforms Goal-Agnostic Memory Compression in Long-Context Memory Tasks

目标导向搜索在长上下文记忆任务中优于目标无关的记忆压缩

Yicong Zheng, Kevin L. McKee, Thomas Miconi, Zacharie Bugaud, Mick van Gelderen, Jed McCaleb

机构 * Astera Institute(Astera研究所)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SUMER通过目标导向搜索在长上下文记忆任务中超越传统记忆压缩方法,达到SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23436 2025-12-01 cs.AI 57%

Towards Continuous Intelligence Growth: Self-Training, Continual Learning, and Dual-Scale Memory in SuperIntelliAgent

迈向持续智能增长:在SuperIntelliAgent中实现自我训练、持续学习和双尺度记忆

Jianzhe Lin, Zeyu Pan, Yun Zhu, Ruiqi Song, Jining Yang

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 SuperIntelliAgent通过自我训练和双尺度记忆实现持续智能增长,利用可训练学习者与推理验证者配对,提升偏好对齐和学习效果。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21882 2025-12-01 cs.LG cs.CV 57%

Closed-Loop Transformers: Autoregressive Modeling as Iterative Latent Equilibrium

闭环变换器:将自回归建模作为迭代潜在均衡

Akbar Anbar Jafari, Gholamreza Anbarjafari

机构 * University of Tartu(塔尔图大学) S Holding OÜ(3S控股公司)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

AI总结 本文提出均衡变换器(EqT),通过迭代细化潜在表示实现自洽均衡,解决自回归模型中错误传播问题,提升长序列推理和多步规划能力。

Comments 22 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21768 2025-12-01 cs.CR math.CT quant-ph 50%

Categorical Framework for Quantum-Resistant Zero-Trust AI Security

量子抗性零信任AI安全的范畴框架

I. Cherkaoui, C. Clarke, J. Horgan, I. Dey

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出基于范畴论的量子抗性零信任AI安全框架,通过建模加密流程为态射和信任策略为函子,实现细粒度信任管理和微分割,提升对抗性AI威胁防护,并在ESP32上验证了加密敏捷过渡的性能和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏