Sparks of Cooperative Reasoning: LLMs as Strategic Hanabi Agents
合作推理的火花:LLMs作为战略汉诺塔代理
专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL
AI总结 本文研究了在不完全信息下多智能体系统的合作推理挑战,通过汉诺塔游戏评估不同LLM模型在策略沟通和状态跟踪中的表现,展示了模型在协作游戏中的改进效果。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
合作推理的火花:LLMs作为战略汉诺塔代理
专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL
AI总结 本文研究了在不完全信息下多智能体系统的合作推理挑战,通过汉诺塔游戏评估不同LLM模型在策略沟通和状态跟踪中的表现,展示了模型在协作游戏中的改进效果。
AI-AI共创在创意任务中优于人类配对
专题命中 多智能体 :agent(abstract);multi-agent(abstract)
AI总结 该研究通过实验发现,具备互补角色的AI-AI共创在创意任务中优于单一AI和人类配对,证实结构化多智能体AI共创的创造力潜力。
Comments 19 pages, 3 figures
竞争性中介博弈与城市自动驾驶车辆(CAV)路径规划市场
专题命中 多智能体 :agent(abstract);multi-agent(abstract)
AI总结 本文针对未来自动驾驶路径规划与驾驶市场,提出竞争性中介博弈,证明特定条件下其均衡为垄断,并探讨相关市场的机制设计问题。
Comments 42 pages, 6 figures, 1 table
HJ-Gauss: 一种蒙特卡洛HJ可达性方案
专题命中 多智能体 :agent(abstract);multi-agent(abstract)
AI总结 本文提出了一种基于局部PDE线性化的方法,通过冻结系数采样方案解决高维系统中经典网格基HJ求解器内存消耗大的问题,实现了存储和网格无关的算法,适用于高维可达性分析。
基于网联车辆的高速公路车道变更调控强化学习方法
专题命中 多智能体 :agent(abstract);multi-agent(abstract)
AI总结 针对低自动驾驶渗透率下车道变更控制适用性受限的问题,提出基于多智能体强化学习的网联车辆高速公路车道变更调控框架,可提升交通效率并保障安全。
SkillSmith:通过自动技能构建与演进增强本地部署智能体
专题命中 多智能体 :agent(abstract);分类 cs.AI
AI总结 SkillSmith是云端-本地智能体协作框架,通过自动构建和演进技能增强本地智能体,使搭载Qwen3.6-27B的本地智能体任务有效性接近云端智能体,在AppWorld上平均动作数从36.1降至9.9且可泛化至其他SLM。
Comments 10 pages,8 figures
基于Atomic Red Team技术的符号化攻击链生成:谓词表示粒度的实证研究
专题命中 多智能体 :planning(abstract);分类 cs.AI
AI总结 本研究对比九类与五类谓词粒度的AALM,发现粒度对攻击链有效性影响小,81.3%结果一致,高粒度仅提升规划论证的内部结构分辨率。
视觉重建作为记忆协商:一种用于口述历史的迭代生成式AI介导框架
专题命中 多智能体 :workflow(abstract)
AI总结 该研究提出迭代AI辅助视觉重建框架,以生成式AI创建视觉探针辅助口述历史的记忆协商,通过五阶段工作流实现反思性公共历史参与与负责任记录。
Comments Accepted as a poster abstract at the 2026 Conference of the European Association for Digital Humanities (EADH 2026)
零和博弈中的算法非对称性:针对缓慢对手的快速收敛的单侧恢复
专题命中 多智能体 :agent(abstract)
AI总结 本文研究零和博弈的算法非对称性,提出智能体用交替乐观梯度下降(AOGD)可补偿普通梯度下降(GD)对手的缓慢收敛,使联合动态以O(1/T)速率收敛到纳什均衡。
近场中由感知诱导的具身通信
专题命中 多智能体 :agent(abstract)
AI总结 本文研究近场感知诱导的具身通信,通过表征位置相关的各向异性可靠性几何、推导三维混淆区域的椭球表示,建立统一框架并证明近场体积装箱的容量增益。
Comments 13 pages, 9 figures
涌现行为对通信延迟具有鲁棒性,但代价是系统演化更缓慢
专题命中 多智能体 :agent(abstract)
AI总结 该研究针对异质智能体集体行为受通信延迟影响的问题,通过减缓智能体动力学保证涌现行为的鲁棒性,明确延迟对向量场的缩放作用,发现延迟诱导的减速或为扩散耦合的普遍特征。
Comments Extended version of the paper accepted for presentation at the 2026 IEEE Conference on Decision and Control (CDC)
公平团队合同
专题命中 多智能体 :agent(abstract)
AI总结 本文研究了在公平性约束下设计收益最优的团队合同问题,提出了基于加法和子模成功函数的高效算法,并展示了公平合同在收益上的优势。
从单一聊天机器人到受管控的智能体生态系统:面向关键任务型医院信息管理系统的智能体AI模式目录与编排框架
专题命中 工作流自动化 :agent(title,abstract);agentic(title,abstract);autonomous agent(abstract);multi-agent(abstract)
AI总结 本研究针对医院信息管理系统提出以合规为核心的智能体AI模式目录与编排框架,可减少文档处理时间等成本、强化管控,助力医院将AI投资转化为可持续回报。
Comments Peer-reviewed published article
Journal ref International Journal of Innovative Science and Research Technology (IJISRT), 11-2026(5), IJISRT26MAY1651
是什么阻碍了智能体技能的可复用性?来自13.8万个SKILL.md文件的证据
机构 * The Graduate Center, City University of New York(纽约城市大学研究生中心) ; The Ohio State University(俄亥俄州立大学) ; Hunter College, City University of New York(纽约城市大学亨特学院)
专题命中 工作流自动化 :agent(title,summary_cn);workflow(abstract);分类 cs.AI
AI总结 本研究通过分析13.8万个SKILL.md文件,发现91.8%的Agent Skills存在可复用性相关缺陷,主要为打包问题,验证了路由元数据对检索可靠性的影响,并提出了结合规范提示等的质量保证生成工作流。
Comments 11 pages, 4 figures
智能体自述文件:对智能体编码的上下文文件的实证研究
专题命中 工作流自动化 :agent(title,abstract);agentic(title,abstract);分类 cs.SE
AI总结 本文对2303个智能体上下文文件开展大规模实证研究,发现其为动态演变的复杂产物,开发者优先规定功能需求却极少明确非功能需求,凸显改进相关工具与实践的必要。
Guixu:面向具备链上证明的自主AI智能体的估值驱动型数据发现
专题命中 工作流自动化 :AI agent(title);agent(abstract);autonomous agent(abstract);workflow(abstract)
AI总结 Guixu是面向自主AI智能体的估值驱动型数据发现系统,采用三阶段估值管线等技术,整合智能体支付协议与链上数据市场,实现任务、预算感知且可信的数据发现与采购。
Comments This paper has been accepted for presentation at VLDB 2026
NeuroPilot:一种用于神经影像处理、质量控制与管理的智能体驱动智能流程
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中 工作流自动化 :agent(title,abstract);multi-agent(abstract);分类 cs.AI
AI总结 该研究提出NeuroPilot多智能体系统,整合神经影像处理、质控与管理流程,在17个超12.3万受试者的队列中验证,将传统2-3个月的工作压缩至一周,提升了可扩展性与效率。
Comments 21 pages, 6 figures
为MCP启用的智能工作流优化FaaS平台
专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);workflow(abstract)
AI总结 本文提出FAME架构,利用FaaS平台优化MCP启用的智能工作流,实现模块化组合和状态持久化,提升效率与成本效益。
Comments Extended version of paper to appear in the proceedings of the International Conference on Web Services (ICWS), 2026
恢复即恢复:工作流持久层中检查点、中断与恢复语义的机器可检查一致性契约
专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.LG、cs.SE
AI总结 该研究提出了RESUME CONTRACT契约,用TLA+模型等方法验证了五个智能体工作流框架的一致性问题,并通过REMIT修复了相关故障。
Comments 25 pages, 10 tables, 1 figure. Supplementary material included as an ancillary file. v3: rejoins a paragraph split across a table float and harmonizes a label glyph in the supplement; no change to results, claims, or numbers
OBLIVION:面向已部署智能体的工作流级操作技能遗忘
专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.AI
AI总结 研究大型语言模型智能体的技能撤销问题,提出OBLIVION框架,通过工作流建模、跨表面连贯擦除等技术降低技能复活风险,在基准与沙箱实验中有效减少攻击成功率与影响加权暴露。
语义交易:用于预测市场聚类和关系发现的代理AI
机构 * Columbia University(哥伦比亚大学) ; IBM Research(IBM研究院)
专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI
AI总结 本文提出一种代理AI方法,通过自然语言处理将预测市场划分为主题组并发现市场间的关系,利用历史数据验证其预测准确性及交易策略收益。
flowengineR:R语言中用于公平性与可复现性工作流设计的模块化可扩展框架
专题命中 工作流自动化 :workflow(title,abstract);分类 cs.LG
AI总结 flowengineR是R语言的模块化可扩展框架,用于构建可复现的机器学习工作流,支持公平性等场景下的方法整合与评估,具备透明、可扩展等特性。
Comments 27 pages, 7 figures, 1 table. v2: revised terminology (S7 renamed "Regulatory Suitability", FAIR acronym corrected), added discussion of AI governance frameworks, updated related-work positioning and references, added a caveat on LLM-assisted engine generation, and hedged claims on runtime overhead and synthetic data. Software and reported benchmarks unchanged
面向机器学习应用的开源可扩展声呐数据处理工作流
专题命中 工作流自动化 :workflow(title,abstract)
AI总结 该研究提出一种两阶段开源工作流,基于Echopype和Echoregions库构建可扩展的机器学习就绪回声测深数据集,含数据划分与掩码创建,提供教程验证其可行性。
智能体驱动的柔性光纤束内窥镜用于体内高分辨率近红外二区(NIR-II)荧光成像
专题命中 工作流自动化 :agentic(title);agent(abstract)
AI总结 该研究开发了AI驱动的柔性光纤束内窥镜平台,通过光学-计算协同设计及GAME流水线提升NIR-II成像分辨率,实现体内生物样本高分辨率成像,为临床转化奠定基础。
在量子软件开发中通过CI/CD工作流捕获转译漂移
专题命中 工作流自动化 :workflow(title,abstract)
AI总结 该研究针对量子软件开发中工具链变更导致的转译漂移问题,提出了基于GitHub Actions和MLflow的量子DevOps CI/CD工作流,可检测转译漂移并提升量子编译的可观测性与可审计性。
Comments Accepted for publication in the Q-SET Workshop at IEEE QCE 2026
能力阶梯:AI时代劳动力准备的课程现代化框架
机构 * Utah Valley University(犹他谷大学)
专题命中 工作流自动化 :agent(abstract);AI agent(abstract);workflow(abstract);分类 cs.AI
AI总结 本文提出AI时代劳动力准备的能力阶梯课程现代化框架,将AI增强工作按操作自主性分为五级,映射到课程更新等,主张围绕持久能力针对性现代化而非全面替换。
PolicyKG:一种用于将机构政策转换为SHACL知识图谱的智能体大语言模型流水线
机构 * Asian Institute of Technology(亚洲理工学院)
专题命中 工作流自动化 :agentic(title);分类 cs.AI、cs.CL
AI总结 本研究提出PolicyKG流水线,可自动将机构政策转换为SHACL知识图谱,在AIT语料库上取得高分类准确率,适配新领域仅需替换注册表,解决了人工转换的效率问题。
Comments 23 pages, 3 figures, 4 tables. Under review at IJCKG 2026, Bangkok, Thailand
幻觉与约束:超越准确率的手术工作流程识别调控
机构 * Université de Rennes(雷恩大学) ; Inserm(法国国家健康与医学研究院)
专题命中 工作流自动化 :workflow(title);分类 cs.LG
AI总结 该研究针对医学图像处理中AI的幻觉问题,提出用线性时序逻辑谓词结合概率图模型调控,在机器人辅助子宫切除术阶段识别中准确率提约10%且消除多数拓扑错误。
Comments 11 pages, 1 figure, 1 table, accepted to the MICCAI 2026 Workshop on Fairness, Regulation, and Ethics (FAIMI-BRIDGE-EPIMI 2026)
双对抗安全对齐:在大型推理模型(LRMs)中培养内在威胁理解
机构 * King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) ; Stony Brook University(石溪大学)
专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG
AI总结 针对现有LRMs安全对齐方法依赖模式泛化不足的问题,提出双对抗框架AdvSafe,通过两阶段对抗博弈生成不安全知识数据集,使LRMs实现鲁棒安全对齐且权衡性能更优。
SiriusDeliver:腾讯的数据仓库交付自动化方案
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE
AI总结 腾讯提出SiriusDeliver端到端交付自动化智能体,集成三类组件,经离线实验和腾讯云WeData大规模部署验证,可显著提升DW交付的成功率、效率,缩短交付时间与工程师工作量。
Comments 13 pages, 13 figures, 3 tables. Under submission