arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4766 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4766 篇

2602.16028 2026-03-19 cs.DS math.PR 50%

Markov Chains with Rewinding

可重放马尔可夫链

Amir Azarmehr, Soheil Behnezhad, Alma Ghafari, Madhu Sudan

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了可重放马尔可夫链,探讨了通过重放策略区分初始状态的方法,证明非适应性策略在效率上与适应性策略有多项式差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16534 2026-03-18 math.OC math.DS 50%

An Extension of Major-Minor Mean Field Game Theory

主导玩家的MFG理论扩展

Agustín Muñoz González

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文扩展了Bensoussan等人提出的主导玩家MFG理论,考虑了效用和成本函数依赖于状态-控制律的联合分布,并建立了包含主导玩家控制对系统动态和功能的直接影响的优化问题。

Comments 20

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19570 2026-03-18 cs.CV 50%

VALD: Multi-Stage Vision Attack Detection for Efficient LVLM Defense

VALD:为高效LVLM防御的多阶段视觉攻击检测

Nadav Kadvil, Malak Fares, Ayellet Tal

机构 * Technion – Israel Institute of Technology(技术学院 – 以色列理工学院)

专题命中 记忆与上下文管理 :agentic(abstract)

AI总结 本文提出VALD方法,通过图像变换与智能数据整合快速过滤清洁输入,结合文本嵌入空间和LLM解决攻击问题,实现高效准确的LVLM防御。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12464 2026-03-18 quant-ph 50%

Challenge-Response Quantum Reinforcement Learning with Application to Quantum-Assisted Authentication

挑战-响应量子强化学习及其在量子辅助认证中的应用

Jawaher Kaldari, Saif Al-Kuwari

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出一种挑战-响应量子强化学习环境,探讨在有限量子资源下,通过轻量级混合代理实现可靠推断的策略,验证其在高和低惩罚场景下的优越性及在安全应用中的相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11022 2026-03-17 eess.SY cs.SY math.OC 50%

Privacy-Preserving Uncertainty Disclosure for Facilitating Enhanced Energy Storage Dispatch

隐私保护的不确定性披露以促进增强的能量存储调度

Ning Qi, Xiaolong Jin, Kai Hou, Zeyu Liu, Hongjie Jia, Wei Wei

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出一种隐私保护的不确定性披露框架,通过释放边际价值函数边界以减少区间预测的保守性,提升存储调度和社会福利。基于随机动态规划开发了风险规避的存储套利模型,并通过滚动地平线机会约束经济调度公式得出实时边际价值函数边界。

Comments The authors have conflict of interests about this paper and have to withdrawn it

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11726 2026-03-13 cs.CE 50%

Online Learning of Strategic Defense against Ecological Adversaries under Partial Observability with Semi-Bandit Feedback

在线学习对抗生态对手的策略防御:在部分可观察性下具有半轮询反馈的资源分配

Anjali Purathekandy, Deepak N. Subramani

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出HERDS算法,通过动态预算分配、自适应收益估计和模型无关学习,解决部分可观察性下的生态对手防御问题,实现显著的遗憾减少和作物损害降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09904 2026-03-11 eess.SY cs.SY 50%

Dynamic Average Consensus with Privacy Guarantees and Its Application to Battery Energy Storage Systems

具有隐私保证的动态平均一致性算法及其在电池储能系统中的应用

Mihitha Maithripala, Chenyang Qiu, Zongli Lin

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出一种具有隐私保护的动态平均一致性算法,用于电池储能系统的荷电状态平衡,通过掩码信号防止信息泄露并验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09387 2026-03-11 econ.TH 50%

Unintended Consequences: Updating Causal Models

意外后果:更新因果模型

Joseph Y. Halpern, Evan Piermont, Marie-Louise Vierø

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文探讨了因果信念如何影响代理选择,并提出稳态概念以解释反馈如何更新因果模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09135 2026-03-11 quant-ph 50%

Critical States Preparation With Deep Reinforcement Learning

临界态制备与深度强化学习

Jia-Wen Yu, Yi-Ming Yu, Ke-Xiong Yan, Jun-Hao Lin, Jie Song, Ye-Hong Chen, Yan Xia

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出利用深度强化学习快速制备量子临界态,并应用于量子拉比模型,实现高保真度的临界态制备。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19345 2026-03-11 eess.SY cs.SY 50%

Privacy-Preserving Distributed Control for a Networked Battery Energy Storage System

隐私保护的分布式控制用于联网电池储能系统

Mihitha Maithripala, Zongli Lin

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种隐私保护的分布式控制算法,用于实现联网电池储能系统的SoC平衡,通过隐私保护的估计器确保安全的功率分配和状态平衡。

Comments Accepted for publication in Journal of Energy Storage

Journal ref Journal of Energy Storage, Volume 153, 120958 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09919 2026-03-10 cs.CR 50%

LLM4PQC - Accurate and Efficient Synthesis of PQC Cores by Feedback-Driven LLMs

LLM4PQC - 通过反馈驱动的LLM实现准确且高效的PQC核心合成

Buddhi Perera, Zeng Wang, Weihua Xiao, Mohammed Nabeel, Ozgur Sinanoglu, Johann Knechtel, Ramesh Karri

专题命中 记忆与上下文管理 :agentic(abstract)

AI总结 LLM4PQC通过反馈驱动的LLM实现PQC核心的高效准确合成,减少手动工作量并加速设计探索。

Comments Accpeted at DATE 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07237 2026-03-10 eess.SY cs.SY 50%

Reinforcement Learning for Vehicle-to-Grid Voltage Regulation: Single-Hub to Multi-Hub Coordination with Battery-Aware Constraints

为车辆到电网电压调节的强化学习:单中心到多中心协调与电池感知约束

Jingbo Wang, Roshni Anna Jacob, Harshal D. Kaushik, Jie Zhang

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种基于强化学习的V2G电压调节框架,通过单中心与多中心协调,结合电池感知约束,实现了在正常和过载情况下的电压稳定控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05337 2026-03-06 physics.soc-ph cs.MA 50%

The effect of a toroidal opinion space on opinion bi-polarisation

环形意见空间对意见双极化的影响

Frank P. Pijpers, Benedikt V. Meylahn, Michel R. H. Mandjes

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了环形意见空间对意见双极化的影响,发现其在稳态下能形成更多群体,并对扩展更敏感。

Comments 15 pages + Appendices. Comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04254 2026-03-05 cs.CV 50%

EmbodiedSplat: Online Feed-Forward Semantic 3DGS for Open-Vocabulary 3D Scene Understanding

EmbodiedSplat: 在线前馈语义3DGS用于开放词汇3D场景理解

Seungjun Lee, Zihan Wang, Yunsong Wang, Gim Hee Lee

机构 * National University of Singapore(新加坡国立大学)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 EmbodiedSplat通过在线前馈3DGS实现开放词汇3D场景理解,结合CLIP编码和3D U-Net提升语义重建效率与泛化能力。

Comments CVPR 2026, Project Page: https://0nandon.github.io/EmbodiedSplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06743 2026-03-04 eess.SY cs.SY 50%

Data-Driven Control of Large-Scale Networks with Formal Guarantees: A Small-Gain Free Approach

基于正式保证的数据驱动控制大规模网络:一种无小增益自由的方法

Behrad Samari, Amy Nejati, Abolfazl Lavaei

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出一种数据驱动方法,通过分而治之策略在未知网络中实现控制,无需传统小增益条件,显著降低样本复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10477 2026-03-03 cs.RO cs.NE 50%

Symphony: A Heuristic Normalized Calibrated Advantage Actor and Critic Algorithm in application for Humanoid Robots

Symphony:一种用于双足机器人的启发式规范化校准优势Actor-Critic算法

Timur Ishuov, Michele Folgheraiter, Madi Nurmanov, Goncalo Gordo, Richárd Farkas, József Dombi

机构 * Department of Computer Algorithms and Artificial Intelligence, University of Szeged(塞格德大学计算机算法与人工智能系) Department of Robotics and Mechatronics, Nazarbayev University(纳扎尔巴耶夫大学机器人与机电系) Tinker AI Limited(Tinker AI有限公司)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 Symphony算法通过规范化校准和安全动作策略,提升双足机器人从零开始的学习效率和安全性。

Comments https://github.com/SuspensionRailway/symphony

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01770 2026-03-03 physics.ins-det astro-ph.IM hep-ex 50%

ImpCresst -- A versatile simulation tool focusing on solid-state detectors at keV energies

ImpCresst -- 一种专注于keV能量范围的固态探测器模拟工具

G. Angloher, S. Banik, A. Bento, A. Bertolini, R. Breier, C. Bucci, J. Burkhart, L. Burmeister, L. Canonica, F. Casadei, E. Cipelli, S. Di Lorenzo, J. Dohm, F. Dominsky, A. Erb, E. Fascione, F. von Feilitzsch, S. Fichtinger, D. Fuchs, A. Fuss, V. M. Ghete, P. Gorla, P. V. Guillaumon, D. Hauff, M. Ješkovský, J. Jochum, M. Kaznacheeva, H. Kluck, H. Kraus, B. von Krosigk, A. Langenkämper, M. Mancuso, B. Mauri, V. Mokina, C. Moore, P. Murali, M. Olmi, T. Ortmann, C. Pagliarone, L. Pattavina, F. Petricca, W. Potzel, P. Povinec, F. Pröbst, F. Pucci, F. Reindl, J. Rothe, K. Schäffner, J. Schieck, S. Schönert, C. Schwertner, M. Stahlberg, L. Stodolsky, C. Strandhagen, R. Strauss, F. Toschi, I. Usherov, D. Valdenaire, M. Zanirato, V. Zema

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 ImpCresst是一种用于模拟固态探测器在keV能量范围背景和校准信号的灵活工具,适用于多种实验需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19465 2026-03-03 physics.soc-ph math.PR 50%

A Mathematical Framework for Misinformation Propagation in Complex Networks: Topology-Dependent Distortion and Control

复杂网络中虚假信息传播的数学框架:拓扑依赖的失真与控制

Saikat Sur, Rohitashwa Chattopadhyay, Jens Christian Claussen, Archan Mukhopadhyay

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种数学框架,用于分析复杂网络中虚假信息传播的拓扑依赖失真机制,并通过不同网络结构的比较揭示了抑制虚假信息的最优策略。

Comments 18 pages, 6 figures, Accepted in Chaos: An Interdisciplinary Journal of Nonlinear Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00009 2026-03-03 math.OC math.PR 50%

Non-Exchangeable Mean Field Markov Decision Processes with common noise : from Bellman equation to quantitative propagation of chaos

非交换性均场马尔可夫决策过程与共同噪声:从贝尔曼方程到混沌传播的定量分析

Samy Mekkaoui, Huyên Pham

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了非交换性均场马尔可夫决策过程,提出了一种新的框架并分析了共同噪声下的混沌传播问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22695 2026-03-02 cs.CV 50%

GFRRN: Explore the Gaps in Single Image Reflection Removal

GFRRN: 探索单图像反光去除中的空白

Yu Chen, Zewei He, Xingyu Liu, Zixuan Chen, Zheming Lu

机构 * Zhejiang University(浙江大学) Huanjiang Laboratory(焕江实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 GFRRN通过引入PEFT策略、标签生成器和自适应频率学习块,解决单图像反光去除中的语义差距和标签不一致问题,实现更高效的反光去除性能。

Comments CVPR26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23490 2026-03-02 cs.HC 50%

Tidynote: Always-Clear Notebook Authoring

Tidynote:始终清晰的笔记本作者工具

Ruanqianqian Huang, Brian Hempel, Yining Cao, James D. Hollan, Haijun Xia, Sorin Lerner

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 Tidynote通过三个核心功能提升笔记本创作的清晰性,支持探索性任务并实现全过程的清晰维护。

Comments Accepted at CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06186 2026-03-02 eess.SY cs.SY 50%

Newton Methods in Generalized Nash Equilibrium Problems with Applications to Game-Theoretic Model Predictive Control

牛顿方法在广义纳什均衡问题中的应用及在博弈论模型预测控制中的应用

Mushuang Liu, Ilya Kolmanovsky

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种基于牛顿方法的广义纳什均衡问题求解方法,用于博弈论模型预测控制,证明了其在动态系统中的稳定性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21682 2026-02-26 cs.RO 50%

SunnyParking: Multi-Shot Trajectory Generation and Motion State Awareness for Human-like Parking

SunnyParking: 多次停车场景下的轨迹生成与运动状态感知

Jishu Miao, Han Chen, Jiankun Zhai, Qi Liu, Tsubasa Hirakawa, Takayoshi Yamashita, Hironobu Fujiyoshi

机构 * Chubu University(名古屋大学) Tongji University(同济大学)

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 SunnyParking通过双分支端到端架构实现运动状态感知,结合空间轨迹和离散运动状态预测,提升复杂多次停车场景下的轨迹生成和换挡点定位精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09406 2026-02-26 econ.TH 50%

Selective Disclosure in Overlapping Generations

选择性披露在重叠世代模型中

Nemanja Antic, Harry Pei

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了重叠世代模型中信息选择性披露机制,探讨了信息传递概率对披露策略的影响,并展示了在极限情况下最优信息筛选的特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13301 2026-02-25 cs.CV 50%

DriveMamba: Task-Centric Scalable State Space Model for Efficient End-to-End Autonomous Driving

DriveMamba: 以任务为中心的可扩展状态空间模型用于高效端到端自动驾驶

Haisheng Su, Wei Wu, Feixiang Song, Junjie Zhang, Zhenjie Yang, Junchi Yan

机构 * Sch. of Computer Science & Sch. of Artificial Intelligence, Shanghai Jiao Tong University(计算机学院与人工智能学院,上海交通大学) SenseAuto

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 DriveMamba通过动态任务关系建模、隐式视角对应学习和长期时间融合,提升端到端自动驾驶的效率与可扩展性。

Comments Accepted to ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12370 2026-02-25 cs.CV 50%

Changes in Real Time: Online Scene Change Detection with Multi-View Fusion

实时变化:多视角融合的在线场景变化检测

Chamuditha Jayanga Galappaththige, Jason Lai, Lloyd Windrim, Donald Dansereau, Niko Sünderhauf, Dimity Miller

机构 * QUT Centre for Robotics(昆士兰理工大学机器人中心) ARIAM ACFR, University of Sydney(悉尼大学先进计算机研究中心) Abyss Solutions

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种基于多视角融合的在线场景变化检测方法,通过自监督融合损失、快速姿态估计和变化引导更新策略,在高帧率下实现了优于离线方法的性能。

Comments Accepted at CVPR 2026. Project Page: https://chumsy0725.github.io/O-SCD/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19831 2026-02-24 cs.CR 50%

An Explainable Memory Forensics Approach for Malware Analysis

用于恶意软件分析的可解释性内存取证方法

Silvia Lucia Sanna, Davide Maiorca, Giorgio Giacinto

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本文提出了一种基于AI的可解释内存取证方法,利用大语言模型解释内存分析结果并提取入侵指标,提升恶意软件分析的可解释性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19657 2026-02-24 cs.DS 50%

Exploration of Always $S$-Connected Temporal Graphs

对始终S连接的时间图的探索

Duncan Adamson, Paul G Spirakis

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了始终S连接时间图的探索问题,提出了一种新的方法,能够高效地探索具有特定结构的时间图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19180 2026-02-24 cs.CV 50%

VLM-Guided Group Preference Alignment for Diffusion-based Human Mesh Recovery

基于扩散模型的人体网格恢复中的群体偏好对齐

Wenhao Shen, Hao Wang, Wanqi Yin, Fayao Liu, Xulei Yang, Chao Liang, Zhongang Cai, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) HKUST(GZ)(香港科技大学(广州)) SenseTime Research(商汤科技研究院) A*STAR(新加坡科技研究局)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种基于群体偏好的扩散模型微调框架,通过双内存增强的批评代理生成质量评分,提升人体网格恢复的物理合理性和图像一致性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10682 2026-02-24 cs.CV 50%

Action-Dynamics Modeling and Cross-Temporal Interaction for Online Action Understanding

动作-动态建模与跨时间交互用于在线动作理解

Xinyu Yang, Zheheng Jiang, Feixiang Zhou, Yihang Zhu, Na Lv, Nan Xing, Nishan Canagarajah, Huiyu Zhou

机构 * School of Computing and Mathematical Sciences, University of Leicester, United Kingdom(莱斯特大学计算与数学科学学院) School of Eye and Vision Sciences, University of Liverpool, United Kingdom(利物浦大学眼科学与视觉科学学院) School of Information Science and Engineering, University of Jinan, China(济南大学信息科学与工程学院) School of Automation and Information Engineering, Xi’an University of Technology, China(西安理工大学自动化与信息工程学院)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出状态特定模型(SSM)用于统一动作检测与预见,通过关键状态压缩、动作模式学习和跨时间交互模块,提升动作理解性能。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏