arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-04-24 至 2026-04-24 共收录 3
2604.21480 2026-04-24 cs.AI

Efficient Agent Evaluation via Diversity-Guided User Simulation

通过多样性引导的用户模拟实现高效的代理评估

Itay Nakash, George Kour, Ateret Anaby-Tavor

机构 * IBM Research(IBM研究院)

AI总结 本文提出DIVERT框架,通过快照和覆盖引导的方式高效探索代理与用户交互,提升评估效率和覆盖范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21138 2026-04-24 cs.RO cs.AI

Navigating the Clutter: Waypoint-Based Bi-Level Planning for Multi-Robot Systems

在杂乱中导航:基于路标的目标级规划用于多机器人系统

Jiabao Ji, Yongchao Chen, Yang Zhang, Ramana Rao Kompella, Chuchu Fan, Gaowen Liu, Shiyu Chang

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) Cisco Research(思科研究)

AI总结 本文提出了一种混合多机器人控制框架,通过引入路标和课程训练策略,解决多机器人任务和运动规划的联合优化问题,提升了任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20994 2026-04-24 cs.CR cs.AI cs.CL

Breaking MCP with Function Hijacking Attacks: Novel Threats for Function Calling and Agentic Models

打破MCP:函数劫持攻击:函数调用和代理模型的新威胁

Yannis Belkhiter, Giulio Zizzo, Sergio Maffeis, Seshu Tirupathi, John D. Kelleher

机构 * IBM Research Europe(IBM欧洲研究院) Trinity College Dublin(三一学院都柏林) Imperial College London(帝国理工学院伦敦) ADAPT Research Centre(ADAPT研究中心)

AI总结 本文提出了一种新的函数劫持攻击,通过操纵代理模型的工具选择过程,迫使调用特定攻击者选择的函数,展示了代理模型在函数调用接口上的新漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏