Engineering Robustness into Personal Agents with the AI Workflow Store
通过AI工作流存储增强个人代理的鲁棒性
机构 * Columbia University and Google(哥伦比亚大学和谷歌) ; Google(谷歌)
AI总结 本文探讨将严谨的软件工程流程整合到代理循环中,以生成可靠、安全且确定性约束的代理工作流,提升高风险场景下的性能。
大厂专区
通过AI工作流存储增强个人代理的鲁棒性
机构 * Columbia University and Google(哥伦比亚大学和谷歌) ; Google(谷歌)
AI总结 本文探讨将严谨的软件工程流程整合到代理循环中,以生成可靠、安全且确定性约束的代理工作流,提升高风险场景下的性能。
NaijaS2ST:低资源尼日利亚语言的多口音语音到语音翻译基准
机构 * Mila - Quebec AI Institute(魁北克人工智能研究所) ; McGill University(麦吉尔大学) ; Google DeepMind(谷歌DeepMind) ; Hausa NLP(豪萨自然语言处理) ; Imperial College(帝国理工学院) ; University of Pretoria(南非彼得里亚大学) ; Masakhane NLP(马萨坎自然语言处理) ; Naijá Wikipedia Community(尼日利亚维基百科社区) ; Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)
AI总结 针对低资源非洲语言语音翻译数据稀缺问题,构建了涵盖伊博语、豪萨语、约鲁巴语和尼日利亚皮钦语的平行语音数据集NaijaS2ST(每语种约50小时),并系统评估了级联、端到端及音频大模型方法,发现少样本音频大模型在语音到文本翻译中更优,而语音到语音翻译中所有范式性能相近。
Comments Preprint
Pass@K 策略优化:解决更困难的强化学习问题
机构 * Google DeepMind(谷歌DeepMind)
AI总结 提出 Pass-at-k 策略优化 (PKPO),通过变换奖励直接优化 pass@k 性能,利用低方差无偏估计器,在训练中退火 k 可同时提升 pass@1 和 pass@k,解决更难问题。