arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2603.20927 2026-03-24 stat.ML cs.LG 57%

Active Inference for Physical AI Agents -- An Engineering Perspective

物理人工智能代理的主动推断——工程视角

Bert de Vries

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文从概率论出发,探讨主动推断在物理人工智能代理中的应用,通过统一感知、学习、规划与控制,提出一种基于变分自由能的理论框架,适用于资源受限的现实环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20815 2026-03-24 cs.AI 57%

GMPilot: An Expert AI Agent For FDA cGMP Compliance

GMPilot:一种用于FDA cGMP合规的专家AI代理

Xiaohan Wang, Nan Zhang, Sulene Han, Keguang Tang, Lei Xu, Zhiping Li, Xiue, Liu, Xiaomei Han

机构 * Aelion AI Inc.(Aelion AI公司) H&N Consulting(H&N咨询) Department of Medicine, Johns Hopkins University(约翰霍普金斯大学医学系) Gilead Sciences Inc.(吉利德科学公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出GMPilot,一种专为FDA cGMP合规设计的AI代理,通过RAG和ReAct框架提供实时决策支持,提升制药行业质量管理的专业性和响应速度。

Comments 14 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20636 2026-03-24 cs.CL cs.CE 57%

A Modular LLM Framework for Explainable Price Outlier Detection

一个模块化的LLM框架用于可解释的价格异常检测

Shadi Sartipi, John Wu, Sina Ghotbi, Nikhita Vedula, Shervin Malmasi

机构 * Amazon.com, Inc.(亚马逊公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出一个基于LLM的框架,通过产品检测和比较进行价格异常判断,实现75%以上的人工审核一致率,优于零样本和检索基于的LLM方法。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07496 2026-03-24 cs.CR cs.AI 57%

From Thinker to Society: Security in Hierarchical Autonomy Evolution of AI Agents

从思考者到社会:AI智能体分层自主性演化的安全问题

Xiaolei Zhang, Lu Zhou, Xiaogang Xu, Jiafei Wu, Tianyu Du, Heqing Huang, Hao Peng, Zhe Liu

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Collaborative Innovation Center of Novel Software Technology and Industrialization(新型软件技术与产业化协同创新中心) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) Independent Researcher(独立研究者) Zhejiang Normal University(浙江师范大学) School of Software Technology, Zhejiang University(浙江大学软件学院) Ningbo Global Innovation Center, Zhejiang University(宁波全球创新中心,浙江大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 研究探讨了AI智能体分层自主性演化中的安全挑战,提出三级安全框架并分析现有防御措施的不足,旨在指导可信AI智能体系统的多层防御架构设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12876 2026-03-24 cs.AI econ.GN q-fin.EC 57%

Think, Speak, Decide: Language-Augmented Multi-Agent Reinforcement Learning for Economic Decision-Making

思考、表达、决定:语言增强的多智能体强化学习用于经济决策

Heyang Ma, Qirui Mi, Qipeng Yang, Zijun Fan, Bo Li, Haifeng Zhang

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出LAMP框架,通过思考、表达、决定三阶段整合语言信息,提升经济决策的效率与鲁棒性,实验显示其在累积收益和可解释性上优于传统方法。

Comments Extended version of an accepted paper at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01869 2026-03-24 q-fin.CP cs.LG 57%

BondBERT: What we learn when assigning sentiment in the bond market

BondBERT: 在债券市场中进行情感分析时我们学到了什么

Toby Barter, Zheng Gao, Eva Christodoulaki, Jing Chen, John Cartlidge

机构 * School of Engineering Mathematics and Technology, University of Bristol, Bristol, UK(工程数学与技术学院,布里斯托尔大学,布里斯托尔,英国) School of Mathematics, Cardiff University, Cardiff, UK(数学学院,卡迪夫大学,卡迪夫,英国)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出BondBERT,一种针对债券市场新闻微调的Transformer模型,用于提供与预测模型集成的情感信号,通过对比实验显示其在预测准确性上优于现有模型。

Comments 8 pages, 3 figures, author manuscript accepted for ICAART 2026: 18th International Conference on Agents and Artificial Intelligence, Mar. 2026, Marbella, Spain

Journal ref 18th International Conference on Agents and Artificial Intelligence (ICAART), Volume 5, Mar. 2026, pp. 4056-4063

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00761 2026-03-24 cs.LG 57%

A Probabilistic Approach to Wildfire Spread Prediction Using a Denoising Diffusion Surrogate Model

基于去噪扩散替代模型的 wildfire 传播预测概率方法

Wenbo Yu, Anirbit Ghosh, Tobias Sebastian Finn, Rossella Arcucci, Marc Bocquet, Sibo Cheng

机构 * CEREA, ENPC, EDF R&D, Institut Polytechnique de Paris(CEREA、ENPC、EDF R&D、巴黎理工学院) Department of Earth Science & Engineering, Imperial College London(帝国理工学院伦敦地球科学与工程系) Department of Computing, Imperial College London(帝国理工学院伦敦计算机科学系) Data Science Institute, Imperial College London(帝国理工学院伦敦数据科学研究院)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出首个去噪扩散模型用于预测野火传播,通过模拟多种可能场景,考虑野火动态的不确定性,优于传统确定性方法。

Journal ref Geosci. Model Dev., 19, 1027-1054, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01013 2026-03-24 cs.LG 57%

TimeXL: Explainable Multi-modal Time Series Prediction with LLM-in-the-Loop

TimeXL:基于LLM的多模态时间序列预测可解释方法

Yushan Jiang, Wenchao Yu, Geon Lee, Dongjin Song, Kijung Shin, Wei Cheng, Yanchi Liu, Haifeng Chen

机构 * School of Computing, University of Connecticut(大学计算机学院) Data Science & System Security Department, NEC Labs America(数据科学与系统安全部,NEC美国实验室) Kim Jaechul Graduate School of AI, KAIST(金 Jaechul人工智能研究生院,韩国科学技术院)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 TimeXL通过集成原型时间序列编码器与三个协作LLM,提升时间序列预测的准确性与可解释性,实验证明在四个真实数据集上AUC提升达8.9%。

Comments NeurIPS 2025 camera ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20299 2026-03-24 cs.SE cs.AI 57%

HCAG: Hierarchical Abstraction and Retrieval-Augmented Generation on Theoretical Repositories with LLMs

HCAG:基于LLM的理论仓库中层次抽象与检索增强生成

Yusen Wu, Xiaotie Deng

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 HCAG通过层次化抽象与检索增强生成方法,解决复杂理论代码库中高层架构模式和跨文件依赖的捕捉问题,提升代码质量和架构一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20270 2026-03-24 cs.AI 57%

FactorSmith: Agentic Simulation Generation via Markov Decision Process Decomposition with Planner-Designer-Critic Refinement

FactorSmith: 通过马尔可夫决策过程分解实现代理模拟生成

Ali Shamsaddinlou, Morteza NourelahiAlamdari

机构 * Ali Shamsaddinlou(阿里·沙姆萨丁卢) Morteza NourelahiAlamdari(莫尔塔扎·努尔埃拉希阿尔马达里)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出FactorSmith框架,通过分解POMDP实现从文本描述生成可执行模拟,结合分解策略与分层代理工作流提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20094 2026-03-23 cs.IR cs.AI cs.DB 57%

LLM-Enhanced Semantic Data Integration of Electronic Component Qualifications in the Aerospace Domain

基于大语言模型的航空领域电子元件资格语义数据整合

Antonio De Santis, Marco Balduini, Matteo Belcao, Andrea Proia, Marco Brambilla, Emanuele Della Valle

机构 * Politecnico di Milano, DEIB(米兰Politecnico大学DEIB系) Quantia Consulting(Quantia咨询公司) Motus ml(Motus ml实验室) Thales Alenia Space(Thales Alenia空间公司)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出利用虚拟知识图谱和大语言模型整合航空领域电子元件资格数据,通过本体数据访问和向量搜索提升检索效率,减少人工处理成本。

Comments ESWC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20028 2026-03-23 cs.SE cs.AI 57%

Orchestrating Human-AI Software Delivery: A Retrospective Longitudinal Field Study of Three Software Modernization Programs

协调人机AI软件交付:三种软件现代化项目的回顾纵向实地研究

Maximiliano Armesto, Christophe Kolb

机构 * Taller Technologies(塔勒技术)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 研究通过回顾三个软件现代化项目,分析AI与人类协作在软件交付各阶段的效果,发现嵌入协调工作流的AI能显著提升效率与覆盖率。

Comments 18 pages, 4 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19896 2026-03-23 cs.AI 57%

Utility-Guided Agent Orchestration for Efficient LLM Tool Use

基于效用的代理协调以提高大语言模型工具使用效率

Boyan Liu, Gongming Zhao, Hongli Xu

机构 * University of Science and Technology of China(科学技术大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种基于效用的代理协调策略,通过平衡收益、成本、不确定性及冗余性来优化大语言模型工具使用中的质量与成本权衡。实验表明显式协调信号显著影响代理行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19710 2026-03-23 cs.IR cs.AI 57%

AIGQ: An End-to-End Hybrid Generative Architecture for E-commerce Query Recommendation

AIGQ: 电商查询推荐的端到端混合生成架构

Jingcao Xu, Jianyun Zou, Renkai Yang, Zili Geng, Qiang Liu, Haihong Tang

机构 * Taobao \& Tmall Group of Alibaba Hangzhou China University of Electronic Science Taobao \& Tmall Group of Alibaba

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 AIGQ通过端到端生成框架解决电商查询推荐中的语义浅层、冷启动差和偶然性问题,采用兴趣感知列表监督微调和兴趣感知列表组相对策略优化,提升查询相关性和列表属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07451 2026-03-23 cs.CL 57%

DLLM Agent: See Farther, Run Faster

DLLM Agent: 看得更远,跑得更快

Huiling Zhen, Weizhe Lin, Renxi Liu, Kai Han, Yiming Li, Yuchuan Tian, Hanting Chen, Xiaoguang Li, Xiaosong Li, Chen Chen, Xianzhi Yu, Mingxuan Yuan, Youliang Yan, Peifeng Qin, Jun Wang, Yu Wang, Dacheng Tao, Yunhe Wang

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司) UCL(伦敦大学学院) Tsinghua University(清华大学) NTU(国立新加坡大学) Peking University(北京大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 本文研究了扩散大语言模型(DLLM)在代理多步决策中的表现,发现其在准确率相当的情况下,整体效率比自回归模型(AR)高30%以上,并提出部署扩散骨架的两个实用考虑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20795 2026-03-23 cs.CL 57%

Test-Time Alignment for Large Language Models via Textual Model Predictive Control

通过文本模型预测控制对大型语言模型进行测试时对齐

Kuang-Da Wang, Teng-Ruei Chen, Yu Heng Hung, Guo-Xun Ko, Shuoyang Ding, Yueh-Hua Wu, Yu-Chiang Frank Wang, Chao-Han Huck Yang, Wen-Chih Peng, Ping-Chun Hsieh

机构 * National Yang Ming Chiao Tung University NVIDIA National Taiwan University

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 本文提出TMPC方法,通过文本模型预测控制解决测试时对齐问题,通过分层强化学习原理改进生成过程,提升不同任务的性能。

Comments Accepted for ICLR 2026. Project page: https://rl-bandits-lab.github.io/TMPC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19138 2026-03-20 cs.AI cs.CR cs.SE 57%

Implicit Patterns in LLM-Based Binary Analysis

基于LLM的二进制分析中的隐式模式

Qiang Li, XiangRui Zhang, Haining Wang

机构 * Beijing Jiaotong University(北京交通大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 研究揭示了基于LLM的多轮二进制漏洞分析中隐式形成的结构化模式,包括早期剪枝、路径依赖锁定、目标回溯和知识引导优先级,为构建更可靠的分析系统提供了基础。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18627 2026-03-20 cs.AI 57%

Agentic Flow Steering and Parallel Rollout Search for Spatially Grounded Text-to-Image Generation

代理流引导与并行展开搜索用于空间感知的文本到图像生成

Ping Chen, Daoxuan Zhang, Xiangming Wang, Yungeng Liu, Haijin Zeng, Yongyong Chen

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AFS-Search框架,通过闭合环路机制和空间感知引导提升文本到图像生成的精度与效率,实现性能和速度的双重优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16137 2026-03-20 cs.CL 57%

SIA: A Synthesize-Inject-Align Framework for Knowledge-Grounded and Secure E-commerce Search LLMs with Industrial Deployment

SIA:一种用于知识引导和安全的电子商务搜索LLM的合成-注入-对齐框架

Zhouwei Zhai, Mengxiang Chen, Anmeng Zhang

机构 * Beijing China(中国北京)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出SIA框架,通过合成高质量语料库、参数高效预训练和双路径对齐方法,解决电子商务搜索LLM的知识幻觉和安全漏洞问题,并在京东实现工业部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18489 2026-03-20 cs.CL 57%

EntropyCache: Decoded Token Entropy Guided KV Caching for Diffusion Language Models

EntropyCache: 基于解码令牌熵的KV缓存用于扩散语言模型

Minsoo Cheong, Donghyun Son, Woosang Lim, Sungjoo Yoo

机构 * Seoul National University(首尔国立大学)

专题命中 规划推理 :chain-of-thought(abstract);分类 cs.CL

AI总结 EntropyCache利用解码令牌熵指导KV缓存,通过最大熵信号决定是否重新计算,实现高效缓存更新,提升推理速度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13647 2026-03-20 cs.IR cs.AI 57%

SF-RAG: Structure-Fidelity Retrieval-Augmented Generation for Academic Question Answering

SF-RAG:用于学术问答的结构保真检索增强生成

Rui Yu, Tianyi Wang, Ruixia Liu, Yinglong Wang

机构 * Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东科学院)) National University of Singapore(新加坡国立大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 SF-RAG通过保留学术论文的层级结构,提高检索和生成的效率与准确性,减少碎片化并提升答案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10971 2026-03-20 cs.CR cs.CL 57%

AJAR: Adaptive Jailbreak Architecture for Red-teaming

AJAR:适应性突破架构用于红队测试

Yipu Dou, Wang Yang

机构 * School of Cyber Science and Engineering(网络安全科学与工程学院)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 AJAR框架通过可调用MCP服务实现多轮突破算法,提升X-Teaming攻击成功率至76.0%,并在工具访问下优化攻击面。

Comments 7 pages, 3 figures. Code and data available at https://github.com/douyipu/ajar

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16344 2026-03-20 cs.RO cs.AI 57%

Manual2Skill++: Connector-Aware General Robotic Assembly from Instruction Manuals via Vision-Language Models

Manual2Skill++: 通过视觉语言模型实现连接器感知的指令手册驱动机器人装配

Chenrui Tie, Shengxiang Sun, Yudi Lin, Yanbo Wang, Zhongrui Li, Zhouhan Zhong, Jinxuan Zhu, Yiman Pang, Haonan Chen, Junting Chen, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) University of Toronto(多伦多大学) Zhejiang University(浙江大学) Peking University(北京大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出Manual2Skill++框架,通过视觉语言模型从指令手册中提取结构化连接信息,构建层次化图表示,实现连接器为核心的装配任务理解与执行。

Journal ref ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21475 2026-03-20 cs.AI 57%

MMSearch-Plus: Benchmarking Provenance-Aware Search for Multimodal Browsing Agents

MMSearch-Plus:面向多模态浏览代理的溯源感知基准测试

Xijia Tao, Yihua Teng, Xinxing Su, Xinyu Fu, Jihao Wu, Chaofan Tao, Ziru Liu, Haoli Bai, Rui Liu, Lingpeng Kong

机构 * The University of Hong Kong (HKU)(香港大学) Huawei Inc(华为公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 MMSearch-Plus是一个包含311个任务的基准测试,通过迭代图像-文本检索和交叉验证在噪声下强制多模态理解,提供模型无关的代理框架和集中标记模块,提升多步推理的鲁棒性。

Comments Project Page: https://mmsearch-plus.github.io

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10978 2026-03-20 cs.AI cs.CY 57%

Agentic LLM Framework for Adaptive Decision Discourse

代理大语言模型框架用于自适应决策 discourse

Antoine Dolant, Praveen Kumar

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种代理大语言模型框架,用于模拟决策 discourse,通过多方观点协作开发可行策略,解决复杂系统中的不确定性挑战,展示了两个案例研究,平衡了社会、经济和环境优先事项,为可扩展和情境感知的推荐奠定基础。

Comments 24 pages, 4 figures, 1 appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16289 2026-03-19 cs.CV cs.AI 57%

VisBrowse-Bench: Benchmarking Visual-Native Search for Multimodal Browsing Agents

VisBrowse-Bench:多模态浏览代理的视觉原生搜索基准测试

Zhengbo Zhang, Jinbo Su, Zhaowen Zhou, Changtao Miao, Yuhan Hong, Qimeng Wu, Yumeng Liu, Feier Wu, Yihe Tian, Yuhao Liang, Zitong Shan, Wanke Xia, Yi-Fan Zhang, Bo Zhang, Zhe Li, Shiming Xiang, Ying Yan

机构 * CASIA Ant Digital Technologies Ant Group(蚂蚁集团数字技术部) RUC(清华大学) FZU(福建师范大学) THU(清华大学) USTB(北京科技大学) PKU(北京大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出VisBrowse-Bench,用于评估多模态浏览代理的视觉推理能力,通过文本-图像检索和联合推理进行多模态证据交叉验证,验证了不同模型在搜索过程中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17420 2026-03-19 cs.AI 57%

From Digital Twins to World Models:Opportunities, Challenges, and Applications for Mobile Edge General Intelligence

从数字孪生到世界模型:移动边缘通用智能的机会、挑战与应用

Jie Zheng, Dusit Niyato, Changyuan Zhao, Jiawen Kang, Jiacheng Wang

机构 * State-Province Joint Engineering and Research Center of Advanced Networking and Intelligent Information Services, College of Computer, Northwest University(高级网络与智能信息服务省州联合工程研究中心,计算机学院,西北大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Automation of School, Guangdong University of Technology(自动化学院,广东工业大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文探讨了从数字孪生到世界模型的转变,分析了其在移动边缘通用智能中的作用,涵盖概念差异、设计原则、关键组件及应用挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05904 2026-03-19 cs.AR cs.AI 57%

LUMINA: LLM-Guided GPU Architecture Exploration via Bottleneck Analysis

LUMINA: 通过瓶颈分析指导的LLM引导的GPU架构探索

Tao Zhang, Rui Ma, Shuotao Xu, Yongqiang Xiong, Peng Cheng

机构 * Microsoft Research(微软研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 LUMINA利用AI提升GPU设计空间探索效率,通过自动编译DSE规则和基准测试,实现高效高质量的设计指导,比传统方法提升17.5倍效率和32.9%的设计效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25758 2026-03-19 cs.AI 57%

TheraMind: A Strategic and Adaptive Agent for Longitudinal Psychological Counseling

TheraMind:一种用于长期心理辅导的战略和自适应代理

He Hu, Chiyuan Ma, Qianning Wang, Lin Liu, Yucheng Zhou, Laizhong Cui, Fei Ma, Qi Tian

机构 * Shenzhen University(深圳大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Auckland University of Technology(奥克兰理工大学) University of Science and Technology of China(中国科学技术大学) SKL-IOTSC, CIS, University of Macau(澳门科技研究所、CIS、澳门大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出TheraMind,一种用于可信在线长期心理辅导的战略和自适应代理,通过双循环架构提升对话管理和治疗规划能力,实验证明其在多会话指标上优于其他方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16171 2026-03-18 cs.IR cs.AI 57%

MemX: A Local-First Long-Term Memory System for AI Assistants

MemX:面向AI助手的本地优先长期记忆系统

Lizheng Sun

机构 * Lizheng Sun(孙立政)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 MemX是一种本地优先的长期记忆系统,通过向量召回、关键词召回和RRF等方法提升检索稳定性,实验表明其在中文基准测试中达到91.3%的Hit@1精度,且在长文本检索中表现出色。

Comments 18 pages, 2 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏