arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-18 至 2026-08-18 共收录 339 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 61 篇

2608.15709 2026-08-18 cs.DB 新提交 50%

Logos: Certified Order-Sensitive SQL Rewrites with Mechanized Semantics and LLM Guidance

Logos:结合机械化语义与LLM指导的可验证顺序敏感型SQL重写

Jingyu Ke, Jingyang Li, Guoqiang Li

专题命中 Agent评测 :agent(abstract)

AI总结 Logos是一款结合Rocq机械化语义与LLM指导的SQL重写验证工具,解决了现有工具的不足,在389个查询对的评估中解决率达86.9%,优于基线工具SQLSolver。

Comments 13 pages, 4 figures, and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15631 2026-08-18 cs.GT econ.TH 新提交 50%

Non-obvious Manipulability with Groups in Shapley-Scarf Housing Markets

沙普利-斯卡夫住房市场中基于群体的非明显可操纵性

Louise Demoor, Martí Jané-Ballarín, Pierre Nunn, Subhajit Pramanik, Antoine Prévotat, Makoto Yokoo

专题命中 Agent评测 :agent(abstract)

AI总结 该研究在沙普利-斯卡夫住房市场中,将策略完备性替换为基于群体的非明显可操纵性,定义了超群体下的顶端交易循环机制类,并证明此类机制的结果具有一致性。

Comments 14 pages, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14967 2026-08-18 cs.DC cs.NI 新提交 50%

When Does Distributed AI Inference Need More Wide-Area Bandwidth? A Co-Design Evaluation of Optical, Packet, and Software Levers

分布式AI推理何时需要更多广域网带宽?光学、分组与软件杠杆的协同设计评估

Prasanna C

专题命中 Agent评测 :agentic(abstract)

AI总结 本文对比了分布式AI推理中,跨站点迁移推理状态与KV重计算等方案的优劣,推导了70B多头注意力模型的带宽交叉点,分析了敏感性因素及经济性,提出了测试计划。

Comments 10 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14753 2026-08-18 cs.CR stat.ME 新提交 50%

SynthGuard-ReleaseBench: Locked-Audit Evidence for Synthetic Tabular Data Releases

SynthGuard-ReleaseBench:合成表格数据发布的锁定审计证据

Jeffery Opoku, David Banahene

专题命中 Agent评测 :workflow(abstract)

AI总结 本文提出SynthGuard-ReleaseBench审计框架,通过锁定审计要素对比工作流,在多类数据上验证其可复现性与区分性,为合成表格数据发布提供特定用途的审计证据。

Comments 45 pages, 20 figures, 11 tables. Software and evidence archive with locked configurations, tests, and a fail-closed release-gate validator archived at Zenodo, DOI 10.5281/zenodo.21909680

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15515 2026-08-18 math.PR 新提交 50%

Weak-Type Bounds for Convolution on the Boolean Hypercube

Junwei Lu, Shengtao Guo, Ethan X. Fang

专题命中 Agent评测 :agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15010 2026-08-18 cond-mat.soft physics.bio-ph 新提交 50%

Shear effects in active models of normal and cancer cells

正常细胞与癌细胞主动模型中的剪切效应

Souvik Sadhukhan, Rajsekhar Das, Lin Zhao, Wolfgang Losert, D. Thirumalai

专题命中 Agent评测 :agent(abstract)

AI总结 本研究通过三维智能体模型结合GMM与平均场理论,探究正常及癌细胞组织在剪切下的力学响应,揭示刚度与活性异质性决定其非仿射运动的规律,与实验结果吻合。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 3 篇

2502.06842 2026-08-18 cs.CY cs.AI 79%

Agentic AI for Scaling Diagnosis and Care in Neurodegenerative Disease

神经退行性疾病诊断与护理的代理AI

Andrew G. Breithaupt, Michael Weiner, Alice Tang, Katherine L. Possin, Marina Sirota, James Lah, Allan I. Levey, Pascal Van Hentenryck, Reza Zandehshahvar, Marilu Luisa Gorno-Tempini, Joseph Giorgio, Jingshen Wang, Andreas M. Rauschecker, Howard J. Rosen, Rachel L. Nosheny, Bruce L. Miller, Pedro Pinheiro-Chagas

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI

AI总结 本文提出了一套六阶段路线图,旨在通过代理AI系统提升神经退行性疾病诊断与护理的效率,强调数据收集、决策支持、临床整合和伦理框架的综合应用。

Comments 28 pages, 2 figures, 1 table, 1 box

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16621 2026-08-18 cs.AI cs.DB cs.IR 新提交 57%

Cost Scales with Change, Not Corpus Size: Incrementally Maintaining an Evolving Semantic Substrate

成本随变化量而非语料库规模变化:增量式维护演化中的语义基底

Yusuke Takahashi, Kyle Wild, Asako Uraki

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 该研究提出语义基底维护成本随变化量而非语料库规模变化,通过增量低秩更新等方法,以远低于完整重构的成本实现语义基底的高效维护,且精度满足要求。

Comments 5 pages, 5 figures, 1 table. Accepted and presented at the 2026 International Electronics Symposium (IES), Yogyakarta, Indonesia, August 1-3, 2026 (IEEE technically co-sponsored). Authors' accepted version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03222 2026-08-18 cs.CY cs.AI cs.HC 版本更新 57%

The Fake Friend Dilemma: Relational Trust and the Political Economy of Conversational AI

虚假朋友困境:信任与对话AI的政治经济学

Jacob Erickson

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文提出虚假朋友困境框架,探讨拟人化AI如何通过隐蔽手段影响用户自主权,分析其在信任与政治经济学中的作用。

Comments Manuscript under review

详情

展开后加载摘要…

URL PDF HTML 收藏