arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-25 至 2026-08-25 共收录 4 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 4 篇

2608.21377 2026-08-25 cs.CL cs.AI cs.LG cs.MA 新提交 82%

Agentic Scaffolding Amplifies Sycophantic Behavior in Large Language Models

智能体式支架会放大大语言模型中的谄媚行为

Thantham Jittham

机构 * Cornell University(康奈尔大学)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究探究智能体式交互支架是否放大LLM的谄媚行为,发现其会系统性放大且伴随准确率下降,提出ASA概念及相关指标,警示AI自主性提升会加剧谄媚。

Comments 13 pages, 4 figures. Accepted to the UAI 2026 Workshop on Safe AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16053 2026-08-25 cs.CL eess.AS 版本更新 79%

Agentic-DuplexGen: Decoupling Content, Timing, and Acoustics for Synthetic Dialogue Speech

DuplexGen:为合成对话语音解耦内容、时序与声学

Pengcheng Wang, Sheng Li, Jiyi Li, Takahiro Shinozaki

机构 * Institute of Science Tokyo(科学东京大学) Hokkaido University(北海道大学)

专题命中 其他Agent :agentic(title,abstract);分类 cs.CL

AI总结 DuplexGen框架通过解耦对话的内容、时序与声学,生成更贴近真实对话的合成语音,构建了带多类标注的医患对话语料库,性能优于传统拼接式合成方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02208 2026-08-25 cs.AI cs.CL cs.LG 版本更新 75%

Training Proactive and Personalized LLM Agents

训练主动且个性化的大语言模型智能体

Weiwei Sun, Xuhui Zhou, Weihua Du, Xingyao Wang, Sean Welleck, Graham Neubig, Maarten Sap, Yiming Yang

机构 * Carnegie Mellon University(卡内基梅隆大学) OpenHands

专题命中 其他Agent :AI agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究提出训练协作型LLM智能体的新范式,形式化PPP三维度,构建UserVille环境与多目标强化学习框架,在SWE-Bench等任务上使智能体性能优于GPT-5等基线,验证了以用户为中心反馈的重要性。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23181 2026-08-25 cs.CR cs.CL 新提交 57%

CyberFactory: Scaling Cyber Security Capabilities with Instances from the Wild

CyberFactory:利用真实场景实例扩展网络安全能力

Jian Yang, Haau-Sing Li, Shawn Guo, Zixi Zhao, Yibo Tan, Jiajun Wu, Aishan Liu, Xianglong Liu, Tianyu Zheng, Bryan Dai, Chengran Yang

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 本研究提出开源框架CyberFactory,将真实场景漏洞转化为任务实例以训练安全模型Aegis,该模型在CyberGym上的Pass@1较Qwen~3.5提升22.8个百分点,优于通用主干模型。

详情

展开后加载摘要…

URL PDF HTML 收藏