arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1239 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 1239 篇

2606.11053 2026-06-10 econ.TH 新提交 50%

Revealing information -- or not -- in a social network of traders

揭示信息——或不揭示——在交易者社交网络中

Patrick Allmis, Paolo Pin, Fernando Vega Redondo

专题命中 Agent评测 :agent(abstract)

AI总结 基于Kyle(1985)的资产交易微观基础模型,研究知情交易者为何可能主动分享信息,并发现均衡中信息部分揭示,导致价格不完全反映资产回报,影响社会剩余分配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10681 2026-06-10 econ.TH 新提交 50%

Limited belief propagation and contingent thinking

有限信念传播与权变思维

Andrew Ellis, Ran Spiegler

专题命中 Agent评测 :agent(abstract)

AI总结 本文通过有向无环图上的有限推理步骤,刻画了观察后信念更新的非贝叶斯特征,解释了相关忽视和迭代期望违背,并应用于公共品供给和社会学习博弈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10330 2026-06-10 cs.GT cs.CY stat.AP 新提交 50%

The Power of Altruism in Sticker Economics: Generosity Minimizes Collective Costs and Overprotective Norms Fuel Inefficiency

利他主义在贴纸经济学中的力量:慷慨最小化集体成本,过度保护规范导致低效率

Luana Ferraz Alvarenga, Caetano Alvarenga Costa, César Rennó-Costa

专题命中 Agent评测 :agent(abstract)

AI总结 通过基于智能体的建模和蒙特卡洛模拟,研究社区规范如何影响FIFA世界杯贴纸收集的集体效率,发现过度保护策略增加成本,而慷慨策略优化网络流动性并显著减少不良运气的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10261 2026-06-10 cs.GT 新提交 50%

Leveraging Machine-Learned Advice in Strategic Interactions with No-Regret Learners

利用机器学习建议与无悔学习者的策略互动

Tinashe Handina, Tongxin Li, Kishan Panaganti, Eric Mazumdar, Adam Wierman

专题命中 Agent评测 :agent(abstract)

AI总结 研究在与无悔学习者博弈时,如何有效利用可能不完美的建议,通过引入伪度量量化建议有用性,并展示其在模拟器和收益矩阵预测中的应用,证明好建议能降低计算近似Stackelberg策略的交互复杂度。

Comments AISTATS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10599 2026-06-10 math.NA cs.NA 新提交 50%

Nonlocal modeling of opinion alignment and environmental feedback: Spatial aggregation and non-consensus patterns

意见对齐与环境反馈的非局部建模:空间聚集与非共识模式

Rui Wang, Yunfeng Xiong, Zhengru Zhang, Xiaofei Zhao

专题命中 Agent评测 :agent(abstract)

AI总结 提出一个注意力介导反馈的空间意见动力学模型,通过非局部对齐与注意力场耦合,推导出非局部对流-交叉扩散系统,分析显示注意力反馈扩大非共识聚类参数区间,促进空间异质性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10081 2026-06-10 math.OC 新提交 50%

Branch and Price for Railway Crew Scheduling: Benchmark Instances and Computational Study

铁路乘务调度的分支定价法:基准实例与计算研究

Bart van Rossum

专题命中 Agent评测 :planning(abstract)

AI总结 提出一种先进的分支定价算法,并构建75个基准实例,通过计算实验表明原始启发式方法有效将最优性差距降至1%以下,而分支和降价固定贡献有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09176 2026-06-09 cs.MA cs.IT math.IT 新提交 50%

Performance Evaluation of Social Learning

社会学习的性能评估

Felice Scala, Marco Carpentiero, Vincenzo Matta, Ali H. Sayed

专题命中 Agent评测 :agent(abstract)

AI总结 针对社会学习中错误信念消失率作为性能指标的悖论,提出错误概率作为替代度量,并在二元高斯问题中推导出分散与集中错误概率之间的不可约差距。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08568 2026-06-09 cs.CY 新提交 50%

Regulating the AI Tutor: Intentions, Help-Seeking, and Self-Regulated Learning in Adolescent GenAI Use

调控AI导师:青少年使用生成式AI时的意图、求助行为与自我调节学习

Rania Abdelghani, Peter Kaiser, Kou Murayama

专题命中 Agent评测 :agentic(abstract)

AI总结 研究通过98名九年级学生的对话数据,分析青少年使用生成式AI学习时的自我调节学习和求助行为,发现学生主要进行工具性请求而缺乏监控评估,且后测成绩显著下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06968 2026-06-08 cs.CR 新提交 50%

HAVE: Host Active Verification Engine for Closing the Contextual Reality Gap in Security Digital Twins

HAVE:用于弥合安全数字孪生中上下文现实差距的主机主动验证引擎

Vincenzo Sammartino, Marco Pasquini

专题命中 Agent评测 :agent(abstract)

AI总结 提出HAVE引擎,通过安全约束主机代理进行最大似然估计,测量经验妥协概率,利用Wilson区间置信权重和贝叶斯混合规则修正CVSS评分导致的上下文现实差距,实验显示在误报和漏报场景中分别降低38.2%和提升132.4%的到达概率。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏