arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-16 至 2026-01-16 共收录 6 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 6 篇

2509.23870 2026-01-16 cs.AI 83%

Gradient Coupling: The Hidden Barrier to Generalization in Agentic Reinforcement Learning

梯度耦合:代理强化学习中泛化能力的隐藏障碍

Jingyu Liu, Xiaopeng Wu, Jingquan Peng, Kehan Chen, Chuan Yu, Lizhong Ding, Yong Liu

机构 * Taobao & Tmall Group of Alibaba(阿里巴巴淘宝与天猫集团) Beijing Institute of Technology(北京理工大学) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程技术研究中心)

专题命中 记忆与上下文管理 :agentic(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出了一种通过训练演员同时作为分类器来分离好坏动作,从而缓解代理强化学习中梯度耦合问题并提升泛化能力的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12991 2026-01-16 cs.CE q-fin.TR 78%

Controllable Financial Market Generation with Diffusion Guided Meta Agent

受扩散引导的元代理可控金融市场生成

Yu-Hao Huang, Chang Xu, Yang Liu, Weiqing Liu, Wu-Jun Li, Jiang Bian

专题命中 记忆与上下文管理 :agent(title,abstract)

AI总结 本文提出DigMA模型,通过扩散引导元代理生成可控且保真度高的金融市场,适用于高频交易任务。

Comments To appear in The Fortieth AAAI Conference on Artificial Intelligence (AAAI-26 Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09905 2026-01-16 cs.SE cs.CL 62%

Self-reflection in Automated Qualitative Coding: Improving Text Annotation through Secondary LLM Critique

在自动化定性编码中的自我反思:通过二次LLM批评提升文本标注

Zackary Okun Dunivin, Mobina Noori, Seth Frey, Curtis Atkinson

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.CL、cs.SE

AI总结 通过二次LLM批评提升文本标注精度,减少错误率并提高分类器性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10088 2026-01-16 cs.AI 57%

State of AI: An Empirical 100 Trillion Token Study with OpenRouter

AI 状态:一项具有 OpenRouter 的 100 万亿 token 实证研究

Malika Aubakirova, Alex Atallah, Chris Clark, Justin Summerville, Anjney Midha

机构 * OpenRouter

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 本研究通过分析 100 万亿 token 的真实世界 LLM 交互,揭示了 LLM 在实际应用中的复杂使用模式,包括开放式权重模型的普及、创意角色扮演的流行以及代理推理的兴起。

Comments 36 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10025 2026-01-16 cs.AI 57%

Structured Personality Control and Adaptation for LLM Agents

结构化人格控制与适应用于大语言模型代理

Jinpeng Wang, Xinyu Jia, Wei Wei Heng, Yuquan Li, Binbin Shi, Qianlei Chen, Guannan Chen, Junxia Zhang, Yuyu Yin

机构 * Key Laboratory of Complex Systems Modeling and Simulation of Ministry of Education(教育部复杂系统建模与仿真重点实验室) Hangzhou Dianzi University(杭州电子科技大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出基于荣格心理学类型模型的结构化人格控制框架,通过协调、强化补偿和反思机制实现LLM人格的细腻表达与动态适应,提升人机交互中的自然代理设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10535 2026-01-16 cs.CV 50%

SVII-3D: Advancing Roadside Infrastructure Inventory with Decimeter-level 3D Localization and Comprehension from Sparse Street Imagery

SVII-3D:利用厘米级3D定位与稀疏街道影像的综合理解,推进道路基础设施库存建设

Chong Liu, Luxuan Fu, Yang Jia, Zhen Dong, Bisheng Yang

机构 * State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing (LIESMARS), Wuhan University, Wuhan 430079, China(信息工程测绘遥感国家重点实验室(LIESMARS),武汉大学) Research Institute Ltd, Chengdu 610000, China(四川省公路规划设计研究有限公司)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 SVII-3D通过厘米级3D定位与稀疏影像综合理解,提升道路基础设施库存的自动化创建与细粒度状态诊断能力。

详情

展开后加载摘要…

URL PDF HTML 收藏