arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Google(谷歌)

2026-07-24 至 2026-07-24 共收录 3
2607.20982 2026-07-24 cs.AI 新提交

GuardianAgentBench: Where Agents Fail and How to Guard Them

GuardianAgentBench:智能体何处失败及如何防范

Vishal Ishwar Naik, Chenyu Xu, Donna Dong, Hussein Hassan, Abhishek Pradhan, Ofer Mendelevitch, Tallat Shafat, Humayun Irshad

机构 * Vectara, Inc.(Vectara公司) Anthropic(Anthropic公司) OpenAI(OpenAI公司) Google DeepMind(谷歌DeepMind) DeepSeek-AI(DeepSeek人工智能公司)

AI总结 研究大语言模型智能体安全可靠行为问题,提出GuardianAgentBench基准测试,含多阶段验证和攻击模式。实验发现模型有两种失败模式,性能随工具集和轮次深度下降。护栏实现优于系统提示防御,证明执行时结构干预可提升安全性且不影响正确行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20466 2026-07-24 cs.AI 新提交

JAXBench: Benchmarking Autonomous TPU Kernel Optimization

JAXBench:自主TPU内核优化基准测试

Arya Tschand, Charles Hong, Julian Walker, Nina Cai, Shangkun Wang, Suvinay Subramanian, Sundar Dev, Vijay Janapa Reddi, Amir Yazdanbakhsh, Sethu Sankaran

机构 * Harvard University(哈佛大学) Google(谷歌公司) UC Berkeley(加州大学伯克利分校) Google DeepMind(谷歌DeepMind)

AI总结 该研究针对TPU缺乏内核优化基准测试的问题,提出JAXBench套件,包含多个工作负载和算子。通过评估四种反馈驱动方法,发现特定上下文对优化更关键,条件设定和搜索结构能提升性能,最后发布相关基准测试等支持开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20220 2026-07-24 cs.RO cs.AI 版本更新

What Matters for Simulation to Online Reinforcement Learning on Real Robots

在真实机器人上在线强化学习中什么至关重要

Yarden As, Dhruva Tirumala, René Zurbrügg, Chenhao Li, Stelian Coros, Andreas Krause, Markus Wulfmeier

机构 * ETH Zurich(苏黎世联邦理工学院) Google DeepMind(谷歌DeepMind)

AI总结 本研究探讨了在真实机器人上实现稳定在线强化学习的关键设计选择,发现某些默认设置可能有害,而稳健的设计选择能提高学习稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏