arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11120 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2604.06280 2026-04-09 physics.med-ph cs.AI 57%

DosimeTron: Automating Personalized Monte Carlo Radiation Dosimetry in PET/CT with Agentic AI

DosimeTron:利用代理AI自动化PET/CT中的个性化蒙特卡洛辐射剂量学

Eleftherios Tzanis, Michail E. Klontzas, Antonios Tzortzakakis

机构 * Division of Radiology, Department for Clinical Science, Intervention and Technology (CLINTEC), Karolinska Institutet(卡罗林斯卡学院临床科学、干预与技术系放射学部门) Artificial Intelligence and Translational Imaging (ATI) Lab, Department of Radiology, School of Medicine, University of Crete(克里特大学医学院放射学系人工智能与转化影像实验室) Department of Nuclear Medicine and Medical Physics, Section Nuclear Medicine Huddinge, Karolinska University Hospital(卡罗林斯卡大学医院核医学与医学物理系胡丁厄核医学部门) Department of Nuclear Medicine and Medical Physics, Theranostics Trial Center, Karolinska University Hospital(卡罗林斯卡大学医院核医学与医学物理系治疗诊断试验中心) Computational Biomedicine Laboratory, Institute of Computer Science Foundation for Research and Technology Hellas (ICS - FORTH)(研究与技术基金会计算机科学研究所计算生物医学实验室)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出DosimeTron,一种基于代理AI的系统,用于自动化PET/CT检查中的患者特定蒙特卡洛内部辐射剂量学,通过自然语言交互实现DICOM元数据提取、图像预处理、MC模拟、器官分割和剂量报告,验证了其在114例病例和22个器官上的高精度与临床可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06198 2026-04-09 cs.CY cs.AI 57%

Concentrated siting of AI data centers drives regional power-system stress under rising global compute demand

人工智能数据中心的集中布局在日益增长的全球计算需求下加剧了区域电力系统压力

Danbo Chen, Zijun Zhou, Yongyang Cai, Jiahong Qin, Ani Katchova, Lei Chen

机构 * The Ohio State University(俄亥俄州立大学) Meta Platforms Inc.(Meta平台公司) Zhejiang A&F University(浙江农林大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文研究了人工智能数据中心的集中布局对电力系统的影响,通过结合大语言模型分析和能源系统建模,预测了2025至2030年间AI数据中心的电力足迹,发现北美、西欧和亚太地区占90%以上计算能力,部分区域电网面临高压力。

Comments 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14735 2026-04-09 q-fin.CP cs.AI cs.CV 57%

PyFi: Toward Pyramid-like Financial Image Understanding for VLMs via Adversarial Agents

PyFi: 通过对抗代理实现金字塔式金融图像理解的愿景语言模型

Yuqun Zhang, Yuxuan Zhao, Sijia Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Yantai Research Institute, Harbin Engineering University(哈尔滨工程大学烟台研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 PyFi通过对抗代理生成的金字塔结构数据集,提升VLM在金融图像理解中的推理能力,实验显示模型在复杂金融问题上的准确率提升19.52%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05987 2026-04-08 cs.AI 57%

Flowr -- Scaling Up Retail Supply Chain Operations Through Agentic AI in Large Scale Supermarket Chains

Flowr -- 通过大规模超市连锁中的代理AI实现零售供应链运营的扩展

Eranga Bandara, Ross Gore, Sachin Shetty, Piumi Siyambalapitiya, Sachini Rajapakse, Isurunima Kularathna, Pramoda Karunarathna, Ravi Mukkamala, Peter Foytik, Safdar H. Bouk, Abdul Rahman, Xueping Liang, Amin Hass, Tharaka Hewa, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University(老道明大学) Florida International University(佛罗里达国际大学) Nanyang Technological University(南洋理工大学) University of Colombo(科伦坡大学) Center for Wireless Communications, University of Oulu(奥卢大学无线通信中心) University of Sri Jayewardenepura(斯里贾亚瓦德纳普拉大学) Accenture Technology Labs(埃森哲技术实验室)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Flowr框架,通过代理AI自动化大规模超市连锁的端到端供应链流程,减少人工协调负担,提升供需匹配度和异常处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05458 2026-04-08 cs.CR cs.AI 57%

MA-IDS: Multi-Agent RAG Framework for IoT Network Intrusion Detection with an Experience Library

MA-IDS:基于经验库的多智能体RAG框架用于物联网网络入侵检测

Md Shamimul Islam, Luis G. Jaimes, Ayesha S. Dina

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出MA-IDS框架,结合大语言模型与RAG技术,通过经验库实现自学习的入侵检测,实验表明其在物联网网络中具有高准确率和可解释性。

Comments Preprint. Submitted to IEEE conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05416 2026-04-08 cs.AI 57%

Multi-Agent Pathfinding with Non-Unit Integer Edge Costs via Enhanced Conflict-Based Search and Graph Discretization

具有非单位整数边成本的多智能体路径规划:通过增强的基于冲突搜索和图离散化

Hongkai Fan, Qinjing Xie, Bo Ouyang, Yaonan Wang, Zhi Yan, Jiawen He, Zheng Fang

机构 * China Mobile Group Hunan Company Limited(中国移动通信集团湖南有限公司)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出MAPFZ,一种处理非单位整数边成本的多智能体路径规划变种,通过增强的基于冲突搜索框架和图离散化方法,提升了求解效率和现实准确性。

Comments 16 pages, 7 figures, submitted to cs.AI, Multi-Agent Systems, Pathfinding Optimization

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04936 2026-04-08 cs.IR cs.AI 57%

Web Retrieval-Aware Chunking (W-RAC) for Efficient and Cost-Effective Retrieval-Augmented Generation Systems

面向高效且经济的检索增强生成系统的网页检索感知分块(W-RAC)

Uday Allu, Sonu Kedia, Tanmay Odapally, Biddwan Ahmed

机构 * AI Research Team, Yellow.ai(Yellow.ai AI研究团队)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出W-RAC,一种针对网页文档的高效分块框架,通过分离文本提取与语义分块规划,减少LLM token消耗,提升系统可观察性。

Comments 13 pages, 9 tables, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00472 2026-04-08 cs.AI cs.DC cs.MA cs.NI 57%

UserCentrix: An Agentic Memory-augmented AI Framework for Smart Spaces

UserCentrix: 一种面向智能空间的代理增强型AI框架

Alaa Saleh, Sasu Tarkoma, Praveen Kumar Donta, Anders Lindgren, Naser Hossein Motlagh, Schahram Dustdar, Susanna Pirttikangas, Lauri Lovén

机构 * RISE Research Institutes of Sweden(瑞典RISE研究所) ICREA Barcelona(巴塞罗那ICREA)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出UserCentrix框架,通过紧急意识和意图驱动决策机制优化资源管理,提升用户体验,在边缘计算条件下实现高效意图处理与实时监控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04853 2026-04-07 cs.AI 57%

MemMachine: A Ground-Truth-Preserving Memory System for Personalized AI Agents

MemMachine:一种保持事实真实性的记忆系统用于个性化AI代理

Shu Wang, Edwin Yu, Oscar Love, Tom Zhang, Tom Wong, Steve Scargall, Charles Fan

机构 * MemVerge, Inc.(MemVerge公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 MemMachine是一种开源记忆系统,通过整合短期、长期事件和用户档案记忆,实现事实真实性保护,提升多会话交互的准确性和效率。

Comments 18 pages, 16 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04741 2026-04-07 cs.CY cs.AI 57%

Artificial Intelligence and Cost Reduction in Public Higher Education: A Scoping Review of Emerging Evidence

人工智能与公共高等教育成本削减:一项新兴证据的综述研究

Diamanto Tzanoulinou, Loukas Triantafyllopoulos, George Vorvilas, Evgenia Paxinou, Nikolaos Karousos, Thomas Dasaklis, Athanassios Mihiotis, Manolis Koutouzis, Dimitris Kalles, Vassilios S. Verykios

机构 * School of Science and Technology, Hellenic Open University(希腊开放大学科学与技术学院) School of Humanities, Hellenic Open University(希腊开放大学人文学院) School of Social Sciences, Hellenic Open University(希腊开放大学社会科学学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文通过系统检索Scopus和IEEE Xplore数据库,综述了人工智能在公共高等教育中的应用,发现AI可通过自动化任务、优化资源配置等实现成本节约,但也面临实施成本和数字鸿沟等挑战。

Comments 19 pages, 2 tables, 4 figures, ICBE-HOU 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04651 2026-04-07 cs.AI 57%

Search, Do not Guess: Teaching Small Language Models to Be Effective Search Agents

搜索,不要猜测:教小语言模型成为有效的搜索代理

Yizhou Liu, Qi Sun, Yulin Chen, Siyue Zhang, Chen Zhao

机构 * New York University(纽约大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Nanyang Technological University(南洋理工大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文通过评估复杂多跳推理任务,发现小语言模型(SLMs)虽参数较少,但检索工具使用更少且易产生幻觉。提出轻量级微调方法\policy,使SLMs能可靠检索并生成基于证据的答案,提升Bamboogle和HotpotQA性能17.3和15.3分,达到LLM水平。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04528 2026-04-07 cs.AI 57%

Receding-Horizon Control via Drifting Models

通过漂移模型实现滚动预测控制

Daniele Foffano, Alessio Russo, Alexandre Proutiere

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院) Boston University(波士顿大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出Drifting MPC框架,结合漂移生成模型与未知动态下的滚动规划,从离线轨迹数据中学习最优轨迹分布,提升轨迹生成效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04442 2026-04-07 cs.CR cs.LG cs.MA 57%

Explainable Autonomous Cyber Defense using Adversarial Multi-Agent Reinforcement Learning

利用对抗性多智能体强化学习的可解释自主网络防御

Yiyao Zhang, Diksha Goel, Hussain Ahmad

机构 * Adelaide University(阿德莱德大学) CSIRO’s Data61(澳大利亚联邦科学与工业研究组织Data61)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出C-MADF框架,通过因果建模与对抗性双策略控制,提升网络防御的可解释性和准确性,在真实数据集上显著降低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04324 2026-04-07 cs.AI cs.SE 57%

RESCORE: LLM-Driven Simulation Recovery in Control Systems Research Papers

RESCORE:基于大语言模型的控制系统研究论文仿真恢复

Vineet Bhat, Shiqing Wei, Ali Umut Kaypak, Prashanth Krishnamurthy, Ramesh Karri, Farshad Khorrami

机构 * New York University(纽约大学) Tandon School of Engineering(坦登工程学院)

专题命中 规划推理 :verifier(abstract);分类 cs.AI

AI总结 本文提出RESCORE框架,通过迭代执行反馈和视觉比较提升论文仿真恢复精度,实现40.7%的仿真恢复率,比单次生成方法更高效,节省验证时间与成本。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04211 2026-04-07 cs.CR cs.AI 57%

LOCARD: An Agentic Framework for Blockchain Forensics

LOCARD:区块链取证的代理框架

Xiaohang Yu, William Knottenbelt

机构 * Imperial College London(帝国理工学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种新的区块链取证方法,通过LOCARD框架实现动态决策过程,结合结构化信念状态机制,展示了在跨链交易追踪中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22776 2026-04-07 cs.AI 57%

TSPO: Breaking the Double Homogenization Dilemma in Multi-turn Search Policy Optimization

TSPO:突破多轮搜索策略优化中的双重均质化困境

Shichao Ma, Zhiyuan Ma, Ming Yang, Xiaofan Li, Xing Wu, Jintao Du, Yu Cheng, Weiqiang Wang, Qiliang Liu, Zhengyang Zhou, Yang Wang

机构 * University of Science and Technology of China(中国科学技术大学) Tiansuan Lab, Ant Group Co., Ltd.(天算实验室,蚂蚁集团) Fudan University(复旦大学) East China Normal University(华东师范大学) Central South University(中南大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出TSPO方法,通过引入首次出现潜在奖励机制,解决多轮搜索策略优化中的过程均质化和组内均质化问题,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08565 2026-04-07 cs.HC cs.AI 57%

Rewriting Video: Text-Driven Reauthoring of Video Footage

重写视频:基于文本的视频重写

Sitong Wang, Anh Truong, Lydia B. Chilton, Dingzeyu Li

机构 * Columbia University(哥伦比亚大学) Adobe Research(Adobe研究院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出基于文本的视频重写方法,通过生成重建算法将视频转为可编辑文本提示,并通过交互式工具Rewrite Kit实现视频内容的重写,探讨了文本驱动视频重写的新范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04096 2026-04-07 cs.SE cs.AI 57%

Toward a Sustainable Software Architecture Community: Evaluating ICSA's Environmental Impact

迈向可持续的软件架构社区:评估ICSA的环境影响

Mahyar T. Moghaddam, Mina Alipour, Torben Worm, Mikkel Baun Kjærgaard

机构 * SDU Software Engineering(南丹麦大学软件工程系)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文评估了ICSA会议中生成式AI和传统活动的环境影响,提出碳足迹报告,探讨可持续软件架构的研究方法和改进措施。

Comments accepted at ICSA-C 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03557 2026-04-07 cs.AI 57%

When Do Hallucinations Arise? A Graph Perspective on the Evolution of Path Reuse and Path Compression

当幻觉何时出现?从图视角看路径复用和路径压缩的演变

Xinnan Dai, Kai Yang, Cheng Luo, Shenglai Zeng, Kai Guo, Jiliang Tang

机构 * Michigan State University(密歇根州立大学) University of Michigan(密歇根大学) Independent Researcher(独立研究员)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文从图视角分析大语言模型中幻觉产生的机制,揭示路径复用与路径压缩对推理幻觉的影响,提出统一解释框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03388 2026-04-07 cs.LG stat.ML 57%

Scalable Variational Bayesian Fine-Tuning of LLMs via Orthogonalized Low-Rank Adapters

通过正交化低秩适配器实现大规模语言模型的可扩展变分贝叶斯微调

Haotian Xiang, Bingcong Li, Qin Lu

机构 * School of Electrical and Computer Engineering, University of Georgia(佐治亚大学电气与计算机工程学院) Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出PoLAR-VBLL框架,通过正交化低秩适配器与变分推断结合,实现大规模语言模型的可扩展贝叶斯微调,提升不确定性量化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03330 2026-04-07 cs.CR cs.AI 57%

AICCE: AI Driven Compliance Checker Engine

AICCE:基于人工智能的合规检查引擎

Mohammad Wali Ur Rahman, Martin Manuel Lopez, Lamia Tasnim Mim, Carter Farthing, Julius Battle, Kathryn Buckley, Salim Hariri

机构 * University of Arizona(亚利桑那大学) Avirtek, Inc.(Avirtek公司) Joint Interoperability Test Command (JITC), United States Department of Defense(美国国防部联合互操作性测试司令部)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AICCE,一种结合双架构推理与检索增强生成的新型生成系统,用于自动化IPv6合规性验证,通过语义编码提升检测精度,实现99%的准确率和F1分数。

Comments Accepted for publication in IEEE Transactions on Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05912 2026-04-07 cs.AI 57%

DeepFact: Co-Evolving Benchmarks and Agents for Deep Research Factuality

DeepFact: 深度研究事实性共演基准与智能体

Yukun Huang, Leonardo F. R. Ribeiro, Momchil Hardalov, Bhuwan Dhingra, Markus Dreyer, Venkatesh Saligrama

机构 * Duke University(杜克大学) Amazon AGI(亚马逊AGI) Boston University(波士顿大学)

专题命中 规划推理 :verifier(abstract);分类 cs.AI

AI总结 本文提出DeepFact-Bench基准和DeepFact-Eval智能体,通过审计-评分机制提升事实性验证的可靠性,并在深度研究报告中实现高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03173 2026-04-06 cs.CL 57%

Detecting and Correcting Reference Hallucinations in Commercial LLMs and Deep Research Agents

检测和纠正商业大语言模型和深度研究代理中的参考幻觉

Delip Rao, Eric Wong, Chris Callison-Burch

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 规划推理 :self-correction(abstract);分类 cs.CL

AI总结 研究通过评估10种模型和代理在DRBench和ExpertQA上的引用URL可靠性,发现3-13%的URL存在幻觉,5-18%无法解析。提出urlhealth工具可有效减少非解析URL,验证引用URL的有效性与可纠正性。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02543 2026-04-06 cs.CV cs.LG 57%

Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation

过度自信与校准在医学视觉问答中的研究:实证发现与幻觉意识缓解

Ji Young Byun, Young-Jin Park, Jean-Philippe Corbeil, Asma Ben Abacha

机构 * Johns Hopkins University, School of Medicine(约翰霍普金斯大学医学院) Massachusetts Institute of Technology(麻省理工学院) Microsoft Healthcare & Life Sciences(微软医疗健康与生命科学)

专题命中 规划推理 :chain-of-thought(abstract);分类 cs.LG

AI总结 本文研究了医学VQA中VLMs的过度自信问题,发现校准方法如Platt缩放能有效提升校准精度,但无法提升预测区分度,提出幻觉意识校准方法以提高可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02539 2026-04-06 cs.IR cs.LG 57%

Synapse: Evolving Job-Person Fit with Explainable Two-phase Retrieval and LLM-guided Genetic Resume Optimization

Synapse:通过可解释的双阶段检索和LLM引导的遗传简历优化实现就业-个人匹配

Ansel Kaplan Erol, Seohee Yoon, Keenan Hom, Xisheng Zhang

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 Synapse通过双阶段检索和遗传优化提升招聘推荐系统,解决信息不平衡问题,提高推荐精度和透明度,实验显示nDCG@10提升22%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02522 2026-04-06 cs.CR cs.AI 57%

Opal: Private Memory for Personal AI

Opal:面向个人AI的隐私内存

Darya Kaviani, Alp Eren Ozdarendeli, Jinhao Zhu, Yu Ding, Raluca Ada Popa

机构 * Google DeepMind(谷歌DeepMind) UC Berkeley(加州大学伯克利分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 Opal通过将数据依赖推理与个人数据分离,利用可信 enclave 提高检索准确率,并在基础设施成本上取得显著优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02490 2026-04-06 cs.CR cs.AI 57%

Automated Malware Family Classification using Weighted Hierarchical Ensembles of Large Language Models

基于预训练大语言模型加权层次集成的自动化恶意软件家族分类

Samita Bai, Hamed Jelodar, Tochukwu Emmanuel Nwankwo, Parisa Hamedi, Mohammad Meymani, Roozbeh Razavi-Far, Ali A. Ghorbani

机构 * Canadian Institute for Cybersecurity, Faculty of Computer Science, University of New Brunswick(加拿大网络安全研究所,新不伦瑞克大学计算机科学学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于预训练大语言模型加权层次集成的零标签恶意软件家族分类框架,通过聚合多个互补推理能力的语言模型决策预测,提升分类鲁棒性和分析员推理一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02409 2026-04-06 cs.CV cs.AI 57%

LumiVideo: An Intelligent Agentic System for Video Color Grading

LumiVideo:一种用于视频色彩分级的智能代理系统

Yuchen Guo, Junli Gong, Hongmin Cai, Yiu-ming Cheung, Weifeng Su

机构 * Northwestern University(西北大学) Northeastern University(东北大学) South China University of Technology(华南理工大学) Hong Kong Baptist University(香港浸会大学) Beijing Normal - Hong Kong Baptist University(北京师范大学-香港浸会大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 LumiVideo通过感知、推理、执行和反思四个阶段模仿专业调色师的工作流程,利用LLM和RAG框架实现非线性色彩参数空间导航,生成符合行业标准的色彩配置文件,并支持通过自然语言反馈进行迭代优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02211 2026-04-03 cs.IR cs.AI cs.MA 57%

Multi-Agent Video Recommenders: Evolution, Patterns, and Open Challenges

多智能体视频推荐系统:演进、模式与开放挑战

Srivaths Ranganathan, Abhishek Dharmaratnakar, Anushree Sinha, Debanshu Das

机构 * Google LLC(谷歌公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文探讨多智能体视频推荐系统的演进、协作模式及挑战,分析了从早期MARL到LLM驱动架构的发展,并提出可扩展性、多模态理解等开放问题。

Comments Accepted for publication in The Nineteenth ACM International Conference on Web Search and Data Mining (WSDM Companion 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01664 2026-04-03 cs.AI 57%

ContextBudget: Budget-Aware Context Management for Long-Horizon Search Agents

ContextBudget: 长时间 horizon 搜索代理的预算感知上下文管理

Yong Wu, YanZhao Zheng, TianZe Xu, ZhenTao Zhang, YuanQiang Yu, JiHuai Zhu, Chao Ma, BinBin Lin, BaoHua Dong, HangCheng Zhu, RuoHui Huang, Gang Yu

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出BACM方法,通过预算约束的序列决策问题管理上下文,结合BACM-RL强化学习方法,在多目标问答和长时间网页浏览任务中优于现有方法,尤其在高复杂度场景下表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏