arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35648 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35648 篇

2601.04191 2026-01-08 cs.RO cs.AI 84%

Embedding Autonomous Agents in Resource-Constrained Robotic Platforms

在资源受限的机器人平台上嵌入自主代理

Negar Halakou, Juan F. Gutierrez, Ye Sun, Han Jiang, Xueming Wu, Yilun Song, Andres Gomez

机构 * Institut für Datentechnik und Kommunikationsnetze, TU Braunschweig(数据技术与通信网络研究所, Braunschweig 技术大学)

专题命中 规划决策 :autonomous agent(title,abstract);agent(abstract,comments);分类 cs.AI;multi-agent(comments)

AI总结 本研究在资源受限的机器人平台上嵌入自主代理,通过AgentSpeak编程实现迷宫探索,展示高效推理过程适用于实时自主操作。

Comments This is an open-access, author-archived version of a manuscript published in European Conference on Multi-Agent Systems 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06579 2025-10-09 cs.CL 84%

TinyScientist: An Interactive, Extensible, and Controllable Framework for Building Research Agents

Haofei Yu, Keyang Xuan, Fenghai Li, Kunlun Zhu, Zijie Lei, Jiaxun Zhang, Ziheng Qi, Kyle Richardson, Jiaxuan You

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Allen Institute for Artificial Intelligence(人工智能研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);workflow(abstract);agentic(abstract)

Comments 7 pages, EMNLP 2025 Demo track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21134 2025-09-26 cs.AI cs.MA 84%

ToMPO: Training LLM Strategic Decision Making from a Multi-Agent Perspective

Yiwen Zhang, Ziang Chen, Fanqi Kong, Yizhe Huang, Xue Feng

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Peking University(北京大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学)

专题命中 规划决策 :agent(title);multi-agent(title);分类 cs.AI

Comments 22 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05520 2025-08-27 cs.AI 84%

Architecting Clinical Collaboration: Multi-Agent Reasoning Systems for Multimodal Medical VQA

Karishma Thakrar, Shreyas Basavatia, Akshay Daftardar

机构 * Georgia Institute of Technology Atlanta, GA, USA(佐治亚理工学院)

专题命中 规划决策 :agent(title);multi-agent(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01623 2025-08-05 cs.AI 84%

A Multi-Agent Pokemon Tournament for Evaluating Strategic Reasoning of Large Language Models

Tadisetty Sai Yashwanth, Dhatri C

机构 * TuriLabs

专题命中 规划决策 :agent(title);multi-agent(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00951 2025-07-15 cs.AI 84%

Thinking Beyond Tokens: From Brain-Inspired Intelligence to Cognitive Foundations for Artificial General Intelligence and its Societal Impact

Rizwan Qureshi, Ranjan Sapkota, Abbas Shah, Amgad Muneer, Anas Zafar, Ashmal Vayani, Maged Shoman, Abdelrahman B. M. Eldaly, Kai Zhang, Ferhat Sadak, Shaina Raza, Xinqi Fan, Ravid Shwartz-Ziv, Hong Yan, Vinjia Jain, Aman Chadha, Manoj Karkee, Jia Wu, Seyedali Mirjalili

机构 * Center for research in Computer Vision, University of Central Florida(计算机视觉研究中心,中央佛罗里达大学) Cornell University(康奈尔大学) Department of Electronics Engineering, Mehran University of Engineering & Technology(电子工程系,工程与技术大学) Department of Imaging Physics, The University of Texas MD Anderson Cancer Center(成像物理系,德克萨斯大学MD安德森癌症中心) Intelligent Transportation Systems, University of Tennessee(智能交通运输系统,田纳西大学) Department of Electrical Engineering, City University of Hong Kong(电气工程系,香港城市大学) Department of Mechanical Engineering, Bartin University(机械工程系,巴廷大学) Vector Institute, Toronto Canada(多伦多加拿大向量研究所) Manchester Metropolitan University(曼彻斯特 Metropolitan 大学) Center for Data Science, New York University(数据科学中心,纽约大学) Meta Research(Meta 研究) Amazon Research(亚马逊研究) Centre for Artificial Intelligence Research and Optimization, Torrens University Australia(人工智能研究与优化中心,塔伦斯大学澳大利亚) University Research and Innovation Center, Obuda University(研究与创新中心,奥布达大学)

专题命中 规划决策 :agent(abstract);tool use(abstract);planning(abstract);agentic(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12749 2025-07-01 cs.CL 84%

ChipXplore: Natural Language Exploration of Hardware Designs and Libraries

Manar Abdelatty, Jacob Rosenstein, Sherief Reda

机构 * Brown University(布朗大学)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);planning(abstract);workflow(abstract)

Comments 10 pages

Journal ref IEEE International Conference on LLM-Aided Design (LAD), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13205 2024-06-11 cs.LG 84%

Multi-Agent Reinforcement Learning with Hierarchical Coordination for Emergency Responder Stationing

Amutheezan Sivagnanam, Ava Pettet, Hunter Lee, Ayan Mukhopadhyay, Abhishek Dubey, Aron Laszka

专题命中 规划决策 :agent(title);multi-agent(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.13114 2022-06-28 cs.LG 84%

Dynamic-Group-Aware Networks for Multi-Agent Trajectory Prediction with Relational Reasoning

Chenxin Xu, Yuxi Wei, Bohan Tang, Sheng Yin, Ya Zhang, Siheng Chen

专题命中 规划决策 :agent(title);multi-agent(title);分类 cs.LG

Comments arXiv admin note: text overlap with arXiv:2204.08770

详情

展开后加载摘要…

URL PDF HTML 收藏
1103.0632 2015-06-01 cs.AI 84%

An Agent Based Architecture (Using Planning) for Dynamic and Semantic Web Services Composition in an EBXML Context

Hioual Ouassila, Boufaida Zizette

专题命中 规划决策 :agent(title);planning(title);分类 cs.AI

Comments 22 pages, 11 figures, 1 table

Journal ref International Journal of Database Management Systems ( IJDMS ), Vol.3, No.1, February 2011 110-131

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23953 2026-08-26 cs.SE cs.AI cs.CE 新提交 84%

The Empire, Long Divided, Must Unite: Architectural Convergence in Three LLM Agent Harnesses

长期分裂的帝国必须统一:三种大语言模型智能体框架的架构趋同

Dai Jiahong

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.SE

AI总结 通过对LangChain deepagents、Earendil pi、DeepSeek dsh三种编码智能体框架的多案例研究,发现它们虽初始理念迥异却趋同于含五个元素的架构,同时指出外部可验证性是未趋同的关键维度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12276 2026-08-18 cs.AI cs.CL 版本更新 84%

Agentic Test-Time Scaling for WebAgents

代理测试时缩放 for WebAgents

Nicholas Lee, Lutfi Eren Erdogan, Chris Joseph John, Surya Krishnapillai, Michael W. Mahoney, Kurt Keutzer, Amir Gholami

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 CATTS 通过动态分配计算资源提升代理在 WebArena-Lite 和 GoBrowse 的性能,比 React 提高 9.1%,且更高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13612 2026-08-17 cs.AI cs.SE 新提交 84%

SemPlan: Benchmarking Structured Semantic Planning for LLM-Based Queries over Enterprise Data

SemPlan:面向企业数据的基于大语言模型(LLM)查询的结构化语义规划基准测试

Bruno Santos Teixeira

机构 * Universidade Federal de Ouro Preto (UFOP)(欧鲁普雷图联邦大学(UFOP))

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 该研究构建了SemPlan基准测试,对比四种架构在企业数据LLM查询语义规划中的表现,发现结构化语义规划架构(A3)正确率最高,不同架构在正确率、策略合规性、成本等方面存在权衡。

Comments 11 pages, 3 figures, 9 tables. Submitted to Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13581 2026-08-17 cs.HC cs.AI cs.LG 新提交 84%

From Prediction to Intervention: Personalized Meal-Level Glucose Regulation via an LLM Agent

从预测到干预:基于大语言模型智能体的个性化餐级血糖调节

Mingyu Huang, Weiqing Min, Ying Jin, Yilin Wang, Shuqiang Jiang

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对精准营养中个性化血糖调节的挑战,提出融合生理学习与LLM智能体的系统,通过生理感知预测器和预测驱动优化智能体提升血糖预测准确率并降低血糖波动。

Comments Accepted in ACL 2026 Findings, 17 pages, 4 figures

Journal ref Findings of the Association for Computational Linguistics ACL 2026, pages 21629 to 21645

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13571 2026-08-17 cs.CL cs.AI 新提交 84%

Not All Tokens Are Equal: Inflation-Aware Routing for Agentic LLM Systems

并非所有token都平等:面向智能体大语言模型系统的感知通胀路由

Heming Fu, Shan Lin, Qianqian Xie, Guojun Xiong

机构 * Stony Brook University(石溪大学) Wuhan University(武汉大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 针对智能体LLM系统的token通胀问题,提出四阶段路由框架InflationAgent,通过测量通胀、引入CBE信号、最大化SER并采用新鲜升级策略,在GSM8K上优于FrugalGPT。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13560 2026-08-14 cs.CV cs.AI cs.CL 新提交 84%

AutoDesign: Meta-Harness Optimization for Long-Horizon Agentic Design

AutoDesign:面向长视距智能体设计的元工具优化

Yaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, Xiaotong Li

机构 * Meituan(美团) MBZUAI(Mohamed bin Zayed University of Artificial Intelligence) Huazhong University of Science and Technology(华中科技大学) Peking University(北京大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 AutoDesign是符合人类设计先验的元工具优化框架,以论文转海报生成任务为实例,在PosterBench上性能优于Claude Design,集成其学习的DesignHarness可提升代码智能体性能,且获人类最高偏好。

Comments Tech Report. Code at: https://github.com/Yaxin9Luo/AutoDesign

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19824 2026-08-13 cs.AI cs.CL cs.CV cs.RO 84%

From Prompts to Pavement Through Time: Temporal Grounding in Agentic Scene-to-Plan Reasoning

从提示到路面通过时间:代理场景到计划推理中的时间定位

Ahmed Y. Gado, Omar Y. Goba, Alaa Hassanein, Catherine M. Elias, Ahmed Hussein

机构 * Computer Science & Engineering Department, German University in Cairo (GUC), Egypt(德国亚历山大大学(GUC)计算机科学与工程系,埃及) C-DRiVeS Lab: Cognitive Driving Research in Vehicular Systems, Cairo, Egypt(认知驾驶系统实验室,埃及开罗,C-DRiVeS) M.Eng. Robotics Candidate at Deggendorf Institute of Technology, Germany(德国德格多夫技术学院机器人硕士候选人) IAV GmbH, Berlin, Germany(德国柏林IAV GmbH公司)

专题命中 规划决策 :agentic(title);agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 本研究探讨了在代理间通信中引入时间条件是否能保持或增强推理的一致性,而不会降低语义或逻辑一致性,并通过BDD-X数据集的curated子集评估了三种具有递增时间整合的规划器架构。结果表明,时间条件改变了推理风格,但并未在标准NLP正确性指标上产生统计显著改进,但定性分析揭示了预测危险推理、稳定纠正行为和战略分歧。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03924 2026-08-13 cs.CL cs.AI 版本更新 84%

Uncertainty as a Planning Signal: Multi-Turn Decision Making for Goal-Oriented Conversation

不确定性作为规划信号:面向目标导向对话的多轮决策

Xinyi Ling, Ye Liu, Reza Averly, Xia Ning

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出CUP框架,通过结合语言模型与结构化规划,解决目标导向对话中不确定性与信息获取之间的平衡问题,提升对话成功率并减少交互轮次。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10628 2026-08-12 cs.CV cs.CL cs.LG 新提交 84%

InSight-doc: Agentic Visual Perception for Long-Document Understanding

InSight-doc:面向长文档理解的智能体视觉感知框架

Kaican Li, Weiyan Xie, Lewei Yao, Jiannan Wu, Lanqing Hong, Yongxiang Huang, Nevin L. Zhang

机构 * The Hong Kong University of Science and Technology(香港科技大学) Huawei(华为)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出智能体视觉感知框架InSight-doc,通过自适应选择放大高分辨率区域处理长文档,经SFT+RL训练后在文档VQA任务中显著提升准确率、降低幻觉与推理延迟,相关资源已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14574 2026-08-11 cs.CL cs.AI 版本更新 84%

SIMMER: Benchmarking Latent Failures in LLM Executable Planning with a World Model

SIMMER: 基于世界模型评估LLM可执行规划中的潜在故障

Xiaoxin Lu, Ranran Haoran Zhang, Rui Zhang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 规划决策 :planning(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 提出SIMMER基准,通过人工策划的厨房领域符号世界模型,评估LLM规划中的潜在故障;实验发现前沿模型最多17%无错误计划,56%含潜在故障,多数不可逆;反事实预演可减少72%潜在故障和75%不可逆案例。

Comments Accepted at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06961 2026-08-10 cs.AI cs.LG 新提交 84%

CAi Copilot: Reducing Operational Workload in Molecular Design through Intent-Driven Agentic Workflows

CAi Copilot:通过意图驱动的智能体工作流减少分子设计中的操作工作量

Zhu Wang, Jiangyu Chen, Yingjun Shang, Yuhui Yao, Laiao Lu, Tianfan Fu, Na Zou

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Nanjing University(南京大学)

专题命中 规划决策 :agentic(title);agent(abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 CAi Copilot是面向专家的意图驱动智能体,通过三层架构整合分子设计分散工具,在45项任务中整体性能最优,得分84.59,可将设计意图转化为可追溯工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05499 2026-08-07 cs.CV cs.AI cs.LG 新提交 84%

APQF: Agentic Profiling-Guided Structured Pruning and Mixed-Precision Quantization with Adaptive Fine-Tuning

APQF:基于智能体分析引导的结构化剪枝与混合精度量化及自适应微调

Sadegh Jafari, Mohiuddin Bilwal, Fan Zhou, Brian Gelder, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 APQF是结合LLM引导与分析支撑的自动化剪枝量化框架,在ImageNet等数据集上实现高压缩比且精度接近基线,优于现有联合剪枝量化方法。

Comments 22 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04588 2026-08-06 cs.CL cs.AI 新提交 84%

EASy: Towards Efficient LLM-Based Agentic System

EASy:迈向高效的基于大语言模型的智能体系统

Junnan Liu, Linhao Luo, Thuy-Trang Vu, Gholamreza Haffari

机构 * Monash University(莫纳什大学)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 EASy是一种可训练的智能体框架,通过强化学习优化任务性能与计算效率,采用里程碑-规划-执行工作流,在多类基准上实现了更优的性能-效率权衡。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00339 2026-08-04 cs.AI cs.CL 新提交 84%

Bayesian and Motivated Reasoning in AI Agents

AI智能体中的贝叶斯推理与动机推理

Eddie Yang

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究发现AI智能体的结论受先验信念影响,相同数值数据因框架不同会得出不同结论,揭示了委托其决策存在依赖未指定先验的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10739 2026-08-04 cs.CL cs.AI 版本更新 84%

Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving

长周期推理代理用于竞赛级数学问题求解

Yuzhe Gu, Songyang Gao, Zijian Wu, Lingkai Kong, Wenwei Zhang, Zhongrui Cai, Fan Zheng, Tianyou Ma, Junhao Shen, Haiteng Zhao, Duanyang Zhang, Huilun Zhang, Kuikun Liu, Chengqi Lyu, Yanhui Duan, Chiyu Chen, Ningsheng Ma, Jianfei Gao, Han Lyu, Dahua Lin, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) MMLab The Chinese University of Hong Kong(香港中文大学) ICMAT Spanish National Research Council(西班牙国家科研 council) The High School Affiliated to Renmin University of China(中国人民大学附属高中) Ren Hui Academy of Beijing(北京润辉学院)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出Intern-S1-MO,通过多轮分层推理和OREAL-H框架,突破IMO级数学问题的上下文限制,实现26/35分的优异成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12384 2026-08-03 cs.LG cs.AI 版本更新 84%

APPO: Agentic Procedural Policy Optimization

APPO: 智能体程序策略优化

Xucong Wang, Ziyu Ma, Yong Wang, Yuxiang Ji, Shidong Yang, Guanhua Chen, Pengkun Wang, Xiangxiang Chu

机构 * University of Science and Technology of China(中国科学技术大学) AMAP, Alibaba Group(阿里巴巴集团高德地图) Southern University of Science and Technology(南方科技大学)

专题命中 规划决策 :agentic(title,abstract);tool-use(abstract);分类 cs.AI、cs.LG

AI总结 提出APPO方法,通过细粒度分支和程序级优势缩放改进智能体强化学习的信用分配,在13个基准上平均提升近4个点。

Comments 25 pages, including 14 pages of main text and 11 pages of appendix; work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25090 2026-07-29 cs.AI cs.LG 新提交 84%

Matryoshka Agent: Unfolding Sub-Agents for Long-Horizon Machine Learning Engineering

套娃智能体:展开子智能体以进行长期机器学习工程

Rushi Qiang, Changhao Li, Haotian Sun, Yuchen Zhuang, Chao Zhang, Bo Dai

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对机器学习工程长期决策难题,提出套娃智能体框架,将问题解决分解为协调层次结构,高级协调器发指令,低级子智能体执行,开发有效训练范式,实验证明该方法有效且可扩展,能提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22385 2026-07-27 cs.AI cs.LG 新提交 84%

Agentic Root Cause Analysis through Evidence-Grounded Reasoning

通过基于证据的推理进行智能根本原因分析

Amaury Wei, Olga Fink

机构 * EPFL - IMOS Laboratory(洛桑联邦理工学院 - IMOS实验室)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 研究针对工业异常根本原因诊断依赖人工且现有数据驱动方法有局限的问题,提出AgentRCA框架,结合数字孪生和大语言模型进行推理,在实际设施上评估,性能与监督基线相当且能产生透明推理轨迹,为工业根本原因分析提供实用基础。

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21653 2026-07-27 cs.LG cs.CL cs.DC 新提交 84%

Molt: A Scalable PyTorch-Native Training Framework for Agentic Reinforcement Learning

Molt:用于智能体强化学习的可扩展原生 PyTorch 训练框架

Jian Hu, Huiying Li, Hao Zhang, Binfeng Xu, Yifan Zhang, Shaokun Zhang, Hemil Desai, Michael Demoret, Pavlo Molchanov, Jan Kautz, Yi Dong

机构 * NVIDIA(英伟达)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.CL、cs.LG

AI总结 研究针对智能体强化学习中算法修改成本高的问题,提出原生 PyTorch 训练框架 Molt,其代码简洁,智能体是普通程序,通过异步循环训练策略,在全异步协议下性能与先进堆栈相当,且开源提供资源。

Comments tech report for Molt

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19913 2026-07-23 cs.AI cs.CL cs.CR 新提交 84%

JANUS: Foreseeing Latent Risk for Long-Horizon Agent Safety

JANUS:预见长期智能体安全中的潜在风险

Yuan Xiong, Linji Hao, Shizhu He, Yequan Wang, Lijun Li

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 研究长期智能体安全潜在风险,提出JANUS框架,通过多智能体模拟合成轨迹,经预测与裁决耦合任务学习共享策略,用CoAA-RL联合优化,所产生的Vanguard模型提升了智能体安全防护及任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏