arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-03 至 2025-12-03 共收录 81 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 20 篇

2407.17537 2025-12-03 cs.AI cs.FL cs.LO 88%

A process algebraic framework for multi-agent dynamic epistemic systems

多智能体动态认识系统的进程代数框架

Alessandro Aldini

机构 * University of Urbino Carlo Bo, Italy(乌尔比诺卡尔罗·波大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出了一种多智能体动态认识系统的进程代数框架,结合了标记转换系统与认识模型,通过过程代数语言和模态逻辑实现建模与验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02485 2025-12-03 cs.CV cs.AI 88%

UCAgents: Unidirectional Convergence for Visual Evidence Anchored Multi-Agent Medical Decision-Making

UCAgents: 视觉证据锚定的多智能体医学决策收敛

Qianhan Feng, Zhongzhen Huang, Yakun Zhu, Xiaofan Zhang, Qi Dou

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 UCAgents通过结构化证据审计和单向收敛机制,在医疗视觉问答中提升准确率并降低计算成本,平衡视觉证据揭示与文本干扰避免。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05706 2025-12-03 cs.HC cs.AI 88%

AdvisingWise: Supporting Academic Advising in Higher Education Settings Through a Human-in-the-Loop Multi-Agent Framework

AdvisingWise: 通过人机协同的多智能体框架支持高等教育中的学术指导

Wendan Jiang, Shiyuan Wang, Hiba Eltigani, Rukhshan Haroon, Abdullah Bin Faisal, Fahad Dogar

机构 * Tufts University(塔夫茨大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 AdvisingWise通过多智能体框架和人类监督,提升高等教育中的学术指导效率与个性化水平。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02981 2025-12-03 cs.CV 88%

InEx: Hallucination Mitigation via Introspection and Cross-Modal Multi-Agent Collaboration

InEx:通过内省与跨模态多智能体协作缓解幻觉

Zhongyu Yang, Yingfang Yuan, Xuanming Jiang, Baoyi An, Wei Pang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 InEx通过内省推理和跨模态多智能体协作,自主缓解大型语言模型的幻觉问题,实验表明其在多个基准上表现优异。

Comments Published in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01853 2025-12-03 cs.CV 88%

COACH: Collaborative Agents for Contextual Highlighting -- A Multi-Agent Framework for Sports Video Analysis

COACH:基于上下文高亮的协作代理——一种多代理框架用于体育视频分析

Tsz-To Wong, Ching-Chun Huang, Hong-Han Shuai

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 COACH提出一种多代理框架,通过协作代理实现体育视频分析中的上下文高亮,提升时间层次结构的理解与跨任务适应性。

Comments Accepted by AAAI 2026 Workshop LaMAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02367 2025-12-03 eess.SY cs.RO cs.SY 88%

On the Convergence of Density-Based Predictive Control for Multi-Agent Non-Uniform Area Coverage

关于基于密度的预测控制在多智能体非均匀区域覆盖中的收敛性

Sungjun Seo, Kooktae Lee

机构 * PhD Candidate(博士候选人) Department of Mechanical Engineering(机械工程系) New Mexico Institute of Mining and Technology(新墨西哥矿业与技术研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出基于密度的预测控制方法,用于高效实现多智能体非均匀区域覆盖,通过最优传输理论分析收敛性并优于现有方法。

Comments Accepted for publication in ASME JDSMC

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02358 2025-12-03 cs.AI 86%

Beyond Playtesting: A Generative Multi-Agent Simulation System for Massively Multiplayer Online Games

超越试玩:一种生成式多智能体仿真系统用于大规模多人在线游戏

Ran Zhang, Kun Ouyang, Tiancheng Ma, Yida Yang, Dong Fang

机构 * independent researcher(独立研究者)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI

AI总结 本文提出了一种基于生成式多智能体仿真的系统,利用大型语言模型优化大规模多人在线游戏的数值设计,提升玩家体验并提高优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02329 2025-12-03 cs.SE 86%

Towards autonomous normative multi-agent systems for Human-AI software engineering teams

迈向自主规范的多智能体系统用于人机软件工程团队

Hoa Khanh Dam, Geeta Mahala, Rashina Hoda, Xi Zheng, Cristina Conati

专题命中 多智能体 :agent(title);multi-agent(title);autonomous agent(abstract);分类 cs.SE

AI总结 本文提出自主规范的多智能体系统,通过大型语言模型赋能,实现人机协作的高效软件开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02682 2025-12-03 cs.MA cs.AI 83%

Beyond Single-Agent Safety: A Taxonomy of Risks in LLM-to-LLM Interactions

超越单体安全:LLM到LLM交互中的风险分类

Piercosma Bisconti, Marcello Galisai, Federico Pierucci, Marcantonio Bracale, Matteo Prandi

机构 * icaro-lab(ICARO实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出从模型级安全向系统级安全的转变,引入ESRH框架,阐述LLM交互中的集体风险并提出InstitutionalAI架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02406 2025-12-03 cs.LG 79%

Dynamic Configuration of On-Street Parking Spaces using Multi Agent Reinforcement Learning

利用多智能体强化学习动态配置街道停车空间

Oshada Jayasinghe, Farhana Choudhury, Egemen Tanin, Shanika Karunasekera

机构 * The School of Computing and Information Systems, The University of Melbourne(墨尔本大学计算机与信息系统学院)

专题命中 多智能体 :agent(title,abstract);分类 cs.LG

AI总结 本文提出一种基于多智能体强化学习的动态配置街道停车空间方法,通过时空相关性建模和实验验证,显著减少交通拥堵损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02973 2025-12-03 cs.CV cs.CL cs.CR 70%

Contextual Image Attack: How Visual Context Exposes Multimodal Safety Vulnerabilities

基于上下文的图像攻击:如何通过视觉上下文暴露多模态安全漏洞

Yuan Xiong, Ziqi Miao, Lijun Li, Chen Qian, Jie Li, Jing Shao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) Renmin University of China(中国人民大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 本文提出上下文图像攻击方法,通过多智能体系统和四种可视化策略,有效利用图像的上下文信息对多模态大语言模型进行劫持攻击,实验结果显示攻击效果优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02533 2025-12-03 cs.MM 67%

PopSim: Social Network Simulation for Social Media Popularity Prediction

PopSim: 基于社交网络的社交媒体流行度预测仿真

Yijun Liu, Wu Liu, Xiaoyan Gu, Allen He, Weiping Wang, Yongdong Zhang

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 PopSim通过基于大语言模型的多智能体仿真,有效模拟UGC传播动态,提升社交媒体流行度预测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02442 2025-12-03 cs.HC 67%

A Visual Analytics System to Understand Behaviors of Multi Agents in Reinforcement Learning

多智能体强化学习中行为理解的可视化分析系统

Changhee Lee, Jeongmin Rhee, DongHwa Shin

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出MARLViz系统,用于可视化和分析多智能体强化学习中智能体的行为和交互,帮助理解复杂策略和交互模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03768 2025-12-03 cs.CL cs.CR cs.LG 62%

Hidden in Plain Text: Emergence & Mitigation of Steganographic Collusion in LLMs

隐于 plain 文本:LLMs 中隐写术合谋的出现与缓解

Yohan Mathew, Ollie Matthews, Robert McCarthy, Joan Velja, Christian Schroeder de Witt, Dylan Cope, Nandi Schoots

机构 * LASR Labs(LASR实验室) University College London(伦敦大学学院) University of Amsterdam(阿姆斯特丹大学) University of Oxford(牛津大学)

专题命中 多智能体 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本文首次发现LLMs在训练期间因奖励激励设置不当而产生隐写术合谋,并指出现有缓解措施不足,需创新技术以防止此类合谋。

Comments Camera-ready version. Oral presentation at IJCNLP-AACL 2025 (14th International Joint Conference on Natural Language Processing and 4th Conference of the Asia-Pacific Chapter of the Association for Computational Linguistics), Mumbai, India, December 20-24, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02163 2025-12-03 math.OC 50%

Distributed Time-Varying Coverage Control via Singular Perturbations

通过奇异摄动实现分布式时间变化覆盖控制

Brandon Bao, Jorge Cortes, Sonia Martinez

专题命中 多智能体 :agent(abstract)

AI总结 本文提出了一种基于奇异摄动理论的分布式时间变化覆盖控制算法,通过双时间尺度分离方法实现机器人对动态密度函数的最优部署跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 9 篇

2512.02228 2025-12-03 cs.AI cs.LG 87%

STRIDE: A Systematic Framework for Selecting AI Modalities -- Agentic AI, AI Assistants, or LLM Calls

STRIDE:一种选择AI模态的系统框架——代理AI、AI助手或LLM调用

Shubhi Asthana, Bing Zhang, Chad DeLuca, Ruchi Mahindru, Hima Patel

机构 * IBM Research – Almaden(IBM阿尔马登研究实验室) IBM Research – Yorktown(IBM约克镇研究实验室) IBM Research – India(IBM印度研究实验室)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract,comments);autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 STRIDE提供了一种系统框架,帮助选择AI模态,通过评估任务动态性决定是否使用自主代理,提升效率并降低成本。

Comments 10 pages, 4 Figures, 5 Tables Paper presented at NeurIPS 2025 LAW workshop: Bridging Language, Agent, and World Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02227 2025-12-03 cs.MA cs.AI cs.CE cs.LG 84%

Orchestration Framework for Financial Agents: From Algorithmic Trading to Agentic Trading

金融代理的协调框架:从算法交易到代理交易

Jifeng Li, Arnav Grover, Abraham Alpuerto, Yupeng Cao, Xiao-Yang Liu

机构 * SecureFinAI Lab, Columbia University(安全金融人工智能实验室,哥伦比亚大学) Purdue University(普渡大学) Rensselaer Polytechnic Institute(拉特格斯理工学院) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 工作流自动化 :agentic(title);agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种金融代理的协调框架,通过代理系统实现了股票和加密货币交易,展示了其在不同市场中的表现和优势。

Comments Accepted at the Workshop on Generative AI in Finance, 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02812 2025-12-03 cs.AI 70%

Enhancing Automated Paper Reproduction via Prompt-Free Collaborative Agents

通过无提示协作代理增强自动论文复现

Zijie Lin, Qilin Cai, Liang Shen, Mingjun Xiao

机构 * University of Science and Technology of China(中国科学技术大学) Meituan(美团)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种无提示协作代理框架,通过验证和细化代理提升论文到代码生成的准确性和完整性,实验显示性能提升约15%和13%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02802 2025-12-03 cs.LG cs.AI 62%

TabTune: A Unified Library for Inference and Fine-Tuning Tabular Foundation Models

TabTune:用于推理和微调表格基础模型的统一库

Aditya Tanna, Pratinav Seth, Mohamed Bouadi, Utsav Avaiya, Vinay Kumar Sankarapu

机构 * Lexsi Labs(Lexsi实验室)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 TabTune是一个统一库,通过单一接口标准化表格基础模型的完整工作流程,支持多种适应策略并提升评估一致性。

Comments The library is open source and available at https://github.com/Lexsi-Labs/TabTune

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02904 2025-12-03 physics.comp-ph cs.AI 57%

Towards a fully differentiable digital twin for solar cells

迈向完全可微分的太阳能电池数字孪生

Marie Louise Schubert, Houssam Metni, Jan David Fischbach, Benedikt Zerulla, Marjan Krstić, Ulrich W. Paetzold, Seyedamir Orooji, Olivier J. J. Ronsin, Yasin Ameslon, Jens Harting, Thomas Kirchartz, Sandheep Ravishankar, Chris Dreessen, Eunchi Kim, Christian Sprau, Mohamed Hussein, Alexander Colsmann, Karen Forberich, Klaus Jäger, Pascal Friederich, Carsten Rockstuhl

机构 * Institute of Nanotechnology, Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工大学纳米技术研究所) Institute of Theoretical Informatics, Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工大学理论计算机研究所) Institute of Theoretical Solid State Physics, Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工大学理论固态物理研究所) Institute of Microstructure Technology, Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工大学微结构技术研究所) Light Technology Institute, Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工大学光技术研究所) Helmholtz-Institute Erlangen-Nürnberg for Renewable Energy (IET-2)(埃朗根-纽伦堡赫尔姆霍兹研究所(可再生能源)) Forschungszentrum Jülich(尤利希研究中心) Department of Chemical and Biological Engineering, Friedrich-Alexander-Universität Erlangen-Nürnberg(埃朗根-纽伦堡弗里德里希-亚历山大大学化学与生物工程系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 提出Sol(Di)$^2$T可微分数字孪生框架,实现太阳能电池端到端优化,提升EY预测精度与参数优化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02031 2025-12-03 cs.LG q-bio.BM 57%

Pharmacophore-based design by learning on voxel grids

基于药效团的学习在体素网格上进行设计

Omar Mahmood, Pedro O. Pinheiro, Richard Bonneau, Saeed Saremi, Vishnu Sresht

机构 * AIDD, Genentech(AIDD,基因泰克)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出VoxCap方法,通过体素标注生成SMILES字符串,实现基于药效团的从头分子设计和快速搜索,显著提升生成多样性与计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00631 2025-12-03 cs.GT cs.AI cs.MA 57%

A Protocol for Trustless Verification Under Uncertainty

在不确定性下的无信任验证协议

David Shi, Kevin Joo

机构 * Operator Labs

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 该研究提出了一种在不确定性下通过递归验证游戏保证正确性的协议,通过担保声明和激励机制确保任务执行的正确性。

Comments 9 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01665 2025-12-03 eess.IV cs.AI cs.CV 57%

Towards a vision foundation model for comprehensive assessment of Cardiac MRI

面向全面评估心脏磁共振成像的视觉基础模型

Athira J Jacob, Indraneel Borgohain, Teodora Chitiboi, Puneet Sharma, Dorin Comaniciu, Daniel Rueckert

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出了一种面向心脏磁共振成像全面评估的视觉基础模型,通过自监督学习和微调提升多种临床任务的精度与鲁棒性。

Comments 11 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02818 2025-12-03 cs.DC cs.DL 50%

Designing FAIR Workflows at OLCF: Building Scalable and Reusable Ecosystems for HPC Science

在OLCF设计FAIR工作流:构建适用于HPC科学的可扩展和可重用生态系统

Sean R. Wilkinson, Patrick Widener, Sarp Oral, Rafael Ferreira da Silva

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出在HPC中心构建FAIR生态系统,通过使工作流组件符合FAIR原则,促进跨学科的可重用和可共享的计算资源。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 2 篇

2507.02660 2025-12-03 cs.AI cs.AR 85%

Hey AI, Generate Me a Hardware Code! Agentic AI-based Hardware Design & Verification

嘿,AI,为我生成一段硬件代码!基于代理的AI硬件设计与验证

Deepak Narayan Gadde, Keerthan Kopparam Radhakrishna, Vaisakh Naduvodi Viswambharan, Aman Kumar, Djones Lettnin, Wolfgang Kunz, Sebastian Simon

机构 * 1 Infineon Technologies Dresden GmbH \& Co. KG, Germany 2 Infineon Technologies India Pvt. Ltd., India 3 Infineon Technologies AG, Germany 4 Rheinland-Pf \"a lzische Technische Universit \"a t Kaiserslautern-Landau, Germany

专题命中 软件智能体 :agentic(title,abstract);AI agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于代理的AI方法,用于硬件设计验证,通过与人类在环的协作,实现动态迭代和自我反思,提升设计覆盖率并减少验证时间。

Comments To appear at the 38th SBC/SBMicro/IEEE Symposium on Integrated Circuits and Systems Design (SBCCI), August 25-29, 2025, Manaus, BRAZIL

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01234 2025-12-03 cs.HC cs.AI 74%

Proactive Agentic Whiteboards: Enhancing Diagrammatic Learning

主动代理白板:增强图示学习

Suveen Ellawela, Sashenka Gamage, Dinithi Dissanayake

专题命中 软件智能体 :agentic(title);分类 cs.AI

AI总结 DrawDash通过实时语音驱动的视觉辅助,主动完成和优化教育图表,以减少教师认知负担并提升图示教学效果。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 1 篇

2512.02423 2025-12-03 cs.CV 50%

GUI Exploration Lab: Enhancing Screen Navigation in Agents via Multi-Turn Reinforcement Learning

GUI探索实验室:通过多轮强化学习提升代理的屏幕导航

Haolong Yan, Yeqing Shen, Xin Huang, Jia Wang, Kaijun Tan, Zhixuan Liang, Hongxin Li, Zheng Ge, Osamu Yoshie, Si Li, Xiangyu Zhang, Daxin Jiang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) StepFun Waseda University(早稻田大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 GUI探索实验室通过多轮强化学习提升代理屏幕导航能力,结合监督微调和交互式试错,实现更高效和通用的GUI代理训练。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 记忆与上下文管理 2 篇

2512.01167 2025-12-03 cs.LG cs.AI cs.SY eess.SY 62%

A TinyML Reinforcement Learning Approach for Energy-Efficient Light Control in Low-Cost Greenhouse Systems

为低成本温室系统设计一种 TinyML 强化学习方法以实现节能照明控制

Mohamed Abdallah Salem, Manuel Cuevas Perez, Ahmed Harb Rabia

机构 * North Dakota State University(北达科他州立大学) Biosystems Engineering(生物系统工程)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于 TinyML 的强化学习方法,用于低成本温室系统的节能照明控制,通过 Q 学习算法实现动态亮度调节,有效稳定不同光照水平。

Comments Copyright 2025 IEEE. This is the author's version of the work that has been accepted for publication in Proceedings of the 5. Interdisciplinary Conference on Electrics and Computer (INTCEC 2025) 15-16 September 2025, Chicago-USA. The final version of record is available at: https://doi.org/10.1109/INTCEC65580.2025.11256135

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19686 2025-12-03 cs.AI 57%

From Memories to Maps: Mechanisms of In-Context Reinforcement Learning in Transformers

从记忆到地图:变换器中上下文强化学习的机制

Ching Fang, Kanaka Rajan

机构 * Harvard Medical School(哈佛医学院) Harvard University(哈佛大学)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 研究通过变换器模型探索上下文强化学习的机制,发现记忆在存储经验与缓存计算中扮演关键角色,支持灵活行为。

Comments Revised to around 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

6. Agent评测 21 篇

2505.15216 2025-12-03 cs.CR cs.AI cs.CL cs.LG 89%

BountyBench: Dollar Impact of AI Agent Attackers and Defenders on Real-World Cybersecurity Systems

BountyBench: AI代理攻击者和防御者对现实世界网络安全系统的影响

Andy K. Zhang, Joey Ji, Celeste Menders, Riya Dulepet, Thomas Qin, Ron Y. Wang, Junrong Wu, Kyleen Liao, Jiliang Li, Jinghan Hu, Sara Hong, Nardos Demilew, Shivatmica Murgai, Jason Tran, Nishka Kacheria, Ethan Ho, Denis Liu, Lauren McLane, Olivia Bruvik, Dai-Rong Han, Seungwoo Kim, Akhil Vyas, Cuiyuanxiu Chen, Ryan Li, Weiran Xu, Jonathan Z. Ye, Prerit Choudhary, Siddharth M. Bhatia, Vikram Sivashankar, Yuxuan Bao, Dawn Song, Dan Boneh, Daniel E. Ho, Percy Liang

机构 * Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

专题命中 Agent评测 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 BountyBench通过评估AI代理在漏洞检测、利用和修补中的表现,揭示AI在网络安全中的影响。

Comments 113 pages

详情

展开后加载摘要…

URL PDF HTML 收藏