arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-07 至 2026-08-07 共收录 215 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 43 篇

2510.22884 2026-08-07 econ.EM 版本更新 50%

Complementarities in Sparse Two-Sided Interaction Models

稀疏双边交互模型中的互补性

Federico Crippa

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对仅实现潜在匹配稀疏子集的双边交互模型,引入含互补性参数的Tukey模型,提出基于周期的估计量并应用于世界银行经理-国家匹配,发现负向互补性,验证了能力强的经理在复杂环境中更具价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01013 2026-08-07 quant-ph cond-mat.str-el hep-th 版本更新 50%

Running Quantum Computers in Discovery Mode

以发现模式运行量子计算机

Aydin Deger, Benedikt Placke, G. J. Sreejith, Alessio Lerose, S. L. Sondhi

专题命中 Agent评测 :agent(abstract)

AI总结 研究展示量子计算机与经典机器学习智能体协同运行,可通过定义兴趣函数调整电路,以高概率发现离散时间晶体等量子多体动力学新现象,确立了混合设备中兴趣函数设计的研究范式。

Comments 10 + 8 pages, 4+6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 3 篇

2608.05490 2026-08-07 cs.AI cs.LG stat.ML 新提交 62%

Innovation-Residual Auditing of Autonomous Analysis Agents: Localization, Detection Limits, Error Control, and Identifiability

自主分析智能体的创新残差审计:定位、检测限、误差控制与可识别性

Ahmed Hassoon, Mark Dredze

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文针对自主分析智能体的创新残差审计,分析了错误定位、分数选择、误差控制及审计极限,指出表示维度是关键约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06137 2026-08-07 cs.LG 新提交 57%

SkillTFM: Gated Skill Evolution for Training-Free Adaptation of Tabular Foundation Models

SkillTFM:用于表格基础模型无训练适应的门控技能演化

Yi He, Zhengkang Guan, Anpeng Wu, Peng Cui, Fei Wu, Kun Kuang

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 SkillTFM是一种无训练系统,通过可验证可扩展的技能库将表格基础模型的适应转向技能门控演化,在电价预测等任务中提升了AUC,且在不同骨干网络上均有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00059 2026-08-07 cs.CY cs.AI 版本更新 57%

Stochastic Parrots or Singing in Harmony? Testing Five Leading LLMs for their Ability to Replicate a Human Survey with Synthetic Data

随机鹦鹉还是和谐合唱?测试五种领先的大语言模型在复制人类调查响应方面的能力

Jason Miklian, Kristian Hoelscher, John E. Katsos

机构 * Centre for Global Sustainability, University of Oslo(全球可持续发展中心,奥斯陆大学) Peace Research Institute Oslo(奥斯陆和平研究所) American University of Sharjah(阿联酋沙迦美国大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文比较了420名硅谷程序员和开发者的调查数据与五种大语言模型生成的合成数据,发现AI生成的数据在技术上合理但无法捕捉人类调查的非直观洞察,表明合成调查数据在组织研究中存在局限。

Comments V2

详情

展开后加载摘要…

URL PDF HTML 收藏