arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-01 至 2026-06-01 共收录 185 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 24 篇

2604.27994 2026-06-01 cs.RO 50%

Dreaming Across Towns: Semantic Rollout and Town-Adversarial Regularization for Zero-Shot Held-Out-Town Fixed-Route Driving in CARLA

跨城镇驾驶:面向CARLA零样本未见城镇固定路线驾驶的语义展开与城镇对抗正则化

Feeza Khan Khanzada, Jaerock Kwon

机构 * Department of Electrical and Computer Engineering, University of Michigan–Dearborn(密歇根大学迪尔伯恩分校电子与计算机工程系)

专题命中 Agent评测 :agent(abstract)

AI总结 提出一种结合未来语义预测与城镇对抗正则化的训练方法,在仅使用Town05和Town06训练的情况下,提升CARLA驾驶代理在未见城镇Town03和Town04上的零样本迁移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16682 2026-06-01 cs.CV 50%

SAW-Bench: Learning Situated Awareness in the Real World

SAW-Bench:在现实世界中学习情境感知

Chuhan Li, Rilyn Han, Joy Hsu, Yongyuan Liang, Rajiv Dhawan, Jiajun Wu, Ming-Hsuan Yang, Xin Eric Wang

机构 * University of California, Santa Barbara(加州大学圣芭芭拉分校) Yale University(耶鲁大学) Stanford University(斯坦福大学) University of Maryland, College Park(马里兰大学学院市分校) Amazon(亚马逊) University of California, Merced(加州大学默塞德分校)

专题命中 Agent评测 :agent(abstract)

AI总结 提出SAW-Bench基准,通过自录视频和问答对评估多模态基础模型的以观察者为中心的情境感知能力,揭示人类与模型间的显著性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 3 篇

2605.31509 2026-06-01 cs.LG cs.AI 81%

Skill Reuse as Compression in Agentic RL

智能体强化学习中的技能重用作为压缩

Zhikun Xu, Yu Feng, Jacob Dineen, Taiwei Shi, Jieyu Zhao, Ben Zhou

机构 * Arizona State University(亚利桑那州立大学) University of Pennsylvania(宾夕法尼亚大学) University of Southern California(南加州大学)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 提出ReuseRL方法,基于最小描述长度原则将成功轨迹压缩为可重用技能字典,并通过分割代价惩罚低效编码行为,在多个环境中提升分布内和分布外成功率。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31275 2026-06-01 cs.HC cs.AI 57%

Personalized to Persuade: The Effects of Contextualization and Warmth on Trust and Reliance in Conversational AI

个性化以说服:情境化和温暖对对话式AI中信任与依赖的影响

Mert Yazan, Suzan Verberne, Frederik Bungaran Ishak Situmeang

机构 * Amsterdam University of Applied Sciences(阿姆斯特丹应用科学大学) University of Leiden(莱顿大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 通过2x2被试间实验(N=380),研究情境化与对话温暖如何交互影响AI助手在反驳专家建议时的说服力与用户依赖,发现情境化降低说服力但与温暖结合通过交叉交互恢复,且AI素养解耦信任与行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31104 2026-06-01 cs.HC 50%

Extending the UXR Point of View Playbook: Triangulating Insights in Complex Developer Domains

扩展UXR观点剧本:在复杂开发者领域中的三角验证洞察

Sarah Kianfar

专题命中 其他Agent :AI agent(abstract)

AI总结 本文通过云开发者工具的多方法研究,提出扩展UXR观点剧本,引入三张新卡片(范式转变、可解释性即信任、摩擦成本),以三角验证定性和定量数据,形成高置信度观点。

详情

展开后加载摘要…

URL PDF HTML 收藏