The Bin Packing Problem with Setups: Formulations, Structural Properties and Computational Insights
带准备时间的装箱问题:公式化、结构性质与计算见解
专题命中 规划决策 :planning(abstract)
AI总结 该研究针对带准备时间的装箱问题,提出整数线性规划与弧流两种公式,推导最小类不等式等性质,构建含612个实例的基准,实验表明弧流公式对大权重及真实实例更有效。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
带准备时间的装箱问题:公式化、结构性质与计算见解
专题命中 规划决策 :planning(abstract)
AI总结 该研究针对带准备时间的装箱问题,提出整数线性规划与弧流两种公式,推导最小类不等式等性质,构建含612个实例的基准,实验表明弧流公式对大权重及真实实例更有效。
基于STL-GO的时空与拓扑约束下的多智能体规划
专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI
AI总结 针对多智能体规划中的时空与拓扑约束难题,提出基于STL-GO的混合整数规划与可满足性模理论两种编码方案,在多无人机搜索与救援基准上验证了其表达能力。
Comments Accepted at Formal Methods for Computer-Aided Design 2026
SeekBrain:用于加速神经科学发现的自主多智能体系统
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);agentic(abstract)
AI总结 SeekBrain是用于加速神经科学发现的自主多智能体框架,通过分层规划与跨模态分析生成分析流程,在BrainArena基准上优于现有智能体,实际研究中成功揭示了斑马鱼与小鼠的神经表征规律。
PEMANT:面向旅行的个性化多智能体谈判
机构 * Department of Civil and Costal Engineering, University of Florida(佛罗里达大学土木与海岸工程系)
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI
AI总结 本文提出PEMANT框架,结合行为理论与多智能体谈判,改进家庭旅行决策建模,提升预测能力。
超越组件测试:验证智能体AI系统
机构 * University of Messina(墨西拿大学)
专题命中 多智能体 :agentic(title,abstract);agent(abstract);tool use(abstract);planning(abstract)
AI总结 该综述综合257篇相关文献,构建五维分类法分析智能体AI系统验证问题,指出现有方法的缺口,提出面向生命周期的研究议程,主张需在上下文中验证智能体轨迹以实现可信部署。
Comments 61 pages, 3 figures, to be submitted to Springer Artificial Intelligence Review
基于蒙特卡洛树搜索的多智能体系统自主修复
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG
AI总结 该研究提出基于蒙特卡洛树搜索的MARS框架,将多智能体系统修复建模为搜索过程,结合分类学增强评估与诊断引导扩展,在StateMAS基准上性能优于现有方法,且令牌消耗相当。
Comments Under conference review
裁决式字幕生成:用于严格零样本图像字幕生成的多智能体对齐评分与共识蒸馏束仲裁
机构 * AI Platform OneNexus, OneMount(OneMount AI平台OneNexus) ; School of Electronic Engineering, Soongsil University(崇实大学电子工程学院) ; MoAdata(MoAdata公司) ; University of Economics Ho Chi Minh City (UEH)(胡志明市经济大学)
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL
AI总结 该研究提出裁决式字幕生成多智能体框架,通过多阶段对齐评分与共识蒸馏重排序,在不微调IFCap的情况下,显著提升COCO等数据集的零样本图像字幕生成性能,且可跨数据集迁移。
开源大语言模型驱动的形式化验证:用于RTL修复的多智能体流水线
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG、cs.SE
AI总结 本文提出将LLM与开源形式化后端结合的多智能体RTL修复流水线,通过反例引导迭代实现RTL修复,经ALU案例及6基准测试验证可行性并分析失效模式。
Comments 6 pages, 3 figures
基于图神经网络的稀疏车载自组织网络中交通激波的多智能体控制
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG
AI总结 研究稀疏车载自组织网络中交通激波问题,提出集成图神经网络的去中心化多智能体强化学习框架,车辆利用本地信息和邻车交互学习协同控制策略,能有效减少交通激波传播,即使低比例车辆联网时也能减少80%。
基于FEA-AI混合方法的IPMSM设计优化多智能体系统
机构 * Cho Chun Shik Graduate School of Mobility, KAIST(KAIST Cho Chun Shik 移动研究生院) ; Department of Mechanical Engineering, Hanyang University(汉阳大学机械工程系) ; Narnia Labs
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI
AI总结 提出一种端到端自动化IPMSM设计优化框架,通过RAG结构化问题定义与不确定性感知的FEA-AI混合优化流水线,平衡计算成本与预测可靠性,在同等FEA预算下优于纯FEA或纯AI方法。
Comments 37 pages, 31 figures
MARGIN:多智能体基础模型协调的运行时置信度校准
机构 * Ericsson, Athlone, Ireland(爱立信,Athlone,爱尔兰)
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG
AI总结 提出在线校准方法MARGIN,通过任务流学习每个智能体每个置信度带的校准因子,无需模型访问或重训练,在分布漂移下将校准误差降低3-6倍,并显著提升多智能体选择性能。
M3MAD-Bench: 多智能体辩论在不同领域和模态中真的有效吗?
机构 * Shandong University(山东大学) ; MBZUAI ; Nanjing University of Posts and Telecommunications(南京邮电大学) ; BOB Cloud(BOB云)
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI
AI总结 M3MAD-Bench通过多领域、多模态和多维指标评估多智能体辩论方法的有效性,提供全面的性能-成本分析。
Comments Accepted by ACMMM 2026
耦合策略下约束多智能体强化学习的分布式原始对偶算法
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)
AI总结 研究耦合环境下的约束多智能体强化学习,针对现有方法不足,提出智能体采用依赖邻居状态和参数的耦合策略及分布式可扩展原始对偶算法,证明算法收敛性,仿真验证其优于现有算法。
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)
Comments Minor corrections. 12 pages, 2 figures, 3 tables; 20 pages with appendix and references
Journal ref Foundations of Science, 30(4), 971-1002 (2025)
培养智能体工程师:AI时代的课程、协作与持续学习
专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.SE
AI总结 针对AI时代软件与系统工程的转型需求,本文提出ACCEL框架,构建智能体工程师的教育架构,明确核心能力与实施路径,识别风险并主张开展系统性教育变革。
转录本管理Transformer:具有两个启用弹出的转录本的单调多智能体崩溃与普适性
专题命中 多智能体 :agent(title,abstract);multi-agent(title,comments);分类 cs.LG
AI总结 该研究针对固定有限精度因果Transformer的转录本管理,提出转录本管理转换器模型,证明两个启用弹出的转录本足以实现普适性,明确不同通道数对应的语言层次及相关模拟特性。
Comments 14 pages, 2 tables, 0 figures. Theoretical results on transcript management for fixed-precision Transformers: monotone multi-agent collapse to finite-state transducers, and universality with two pop-enabled transcript channels
形式主义陷阱:社会负荷下作为评判者的大语言模型是否会被共识模仿蒙蔽?
机构 * University of Waterloo(滑铁卢大学)
专题命中 多智能体 :agentic(summary_cn,abstract);分类 cs.AI、cs.CL
AI总结 该研究提出Agentic形式主义陷阱与评估失调指数,通过多领域轨迹分析揭示作为评判者的大语言模型易受句法触发影响,且该漏洞与领域无关,需架构特定的警戒过滤器。
为何会痛苦:识别情感支持对话中消极想法的驱动因素
专题命中 多智能体 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL
AI总结 本研究针对LLM情感支持任务中认知评估维度显著性被忽视的问题,推出AppraiSal基准并提出基于贝叶斯逆规划的多智能体概率框架PRISM,提升了LLMs识别情境特定显著评估维度的能力。
ViSAGE:为长视频理解构建自修正记忆
机构 * Zhejiang University(浙江大学) ; Xidian University(西安电子科技大学)
专题命中 多智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI
AI总结 ViSAGE是一种多模态智能体记忆框架,通过跨模态绑定、双向记忆精调及多智能体交叉验证解决长视频理解中的实体混淆等问题,较最强基线准确率提升5.9%。
Comments Accept by ACMMM 2026
混合翻译器:跨异构大语言模型的KV缓存转换
专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL
AI总结 提出MoT框架解决异构LLM间KV缓存无法复用问题,通过多翻译器模块和上下文校正损失实现缓存转换,在多模型转换和实际场景中验证了性能与复用效果。
模式0:面向路侧计算单元辅助安全通信的新型3GPP V2X资源分配类别
专题命中 多智能体 :agent(abstract);multi-agent(abstract)
AI总结 针对现有3GPP V2X资源分配框架中基站与车辆UE二元分类的结构性缺陷,提出以路侧计算单元(RCU)为核心实体的新模式0,通过集成感知、通信与计算能力,实现高密度交通场景下的低延迟安全通信,并利用MAPPO仿真验证了其性能优势。
Comments v4: substantial restructure; new sections on institutional authority, escalation security, and pool sizing; title revised; references expanded to 34. 44 pages, 7 figures, 4 tables
通过基于运动约束的动作预测来引导无人机群
专题命中 多智能体 :agent(abstract);autonomous agent(abstract)
AI总结 本文提出了一种基于动态窗口方法的三维引导控制律,通过预测自主无人机群的行为来提高引导效率,考虑了运动约束下的可行运动候选生成和评估。
通过抽象符号工程提升概念模型的可理解性
专题命中 多智能体 :workflow(abstract);分类 cs.SE
AI总结 本研究提出抽象符号工程方法,将其应用于DCR图形成DeCleaR,通过用高层级语义透明构造替代底层配置,提升了概念模型的可理解性及用户对DCR图的相关质量与偏好。
一种用于相互依赖的电力通信网络中组件关键性排序的机器学习代理模型
专题命中 多智能体 :workflow(abstract);分类 cs.LG
AI总结 研究相互依赖的电力通信网络中组件关键性排序问题,基于改进隐含相互依赖模型开发机器学习代理模型,能从结构特征预测故障严重性并排序,在IEEE 118母线系统上表现良好,支持两阶段工作流程。
Comments Accepted for publication in 2026 IEEE International Conference on Communications, Control, and Computing Technologies for Smart Grids (SmartGridComm): Workshop on Cyber-Physical Power System Resilience: Challenges and Emerging Solutions
从C到地道Rust:Theseus之船智能体翻译
专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.SE
AI总结 本文提出一种智能体AI驱动的结构化C到Rust迁移工作流,先生成语义保留的非地道Rust基线,再逐步重写为地道Rust,经12.5千行代码的iodine验证可实现可靠迁移。
编译AI:基于LLM的工作流自动化确定性代码生成
机构 * XY.AI Labs, Palo Alto, CA(XY.AI实验室,帕洛阿尔托) ; Stanford University School of Medicine, Stanford, CA(斯坦福大学医学院,斯坦福) ; Cornell University, Department of Computer Science, Ithaca, NY(康奈尔大学计算机科学系,伊萨卡) ; Brigham and Women’s Hospital / Harvard Medical School, Boston, MA(布莱根妇女医院/哈佛医学院,波士顿)
专题命中 工作流自动化 :workflow(title);planning(abstract);分类 cs.AI、cs.SE
AI总结 本文研究编译AI,一种大语言模型在编译阶段生成可执行代码,随后工作流确定性执行的范式。重点探讨其在高风险企业工作流中的应用,尤其在医疗领域,强调可靠性与可审计性。
Comments 14 pages, 2 figures, 3 tables
使用智能体AI构建流程建模工具:PM4Py-UCM的经验报告
专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.SE
AI总结 本文通过AI辅助构建开源流程建模工具PM4Py-UCM的深入案例,提出相关工具包与分类法,总结了开发经验教训及验证策略。
Comments 17 pages, 9 figures, 4 tables, submitted to a conference
生成AI在行动:来自阿里巴巴客户服务中心的实地实验证据
机构 * Fudan University(复旦大学) ; Zhejiang University(浙江大学) ; Dartmouth College(达特茅斯学院) ; Alibaba Group Inc.(阿里巴巴集团)
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 本研究通过大规模实地实验评估生成AI助手对电商售后客服人员绩效的影响,发现AI显著提升服务速度和服务质量,但对顶级员工产生负面影响,提示需定制化部署策略。
AnyLog 边缘数据架构
专题命中 工作流自动化 :agent(abstract);AI agent(abstract)
AI总结 本文提出 AnyLog 边缘数据架构,该基于智能体与边缘的平台可在源端管理运营数据,通过多项技术让用户无需知晓资源位置即可操作分布式资源,为分布式 SQL 等提供类云操作模式,无单点故障且不依赖集中式基础设施。
Comments Keywords: IoT Data Management, Edge Data Management, Edge Data Fabric, Distributed Query, Edge AI, P2P Data Layer, Decentralized Data Layer. 30 pages, 6 figures
HDFS日志数据分析中的块异常检测探索
专题命中 工作流自动化 :workflow(abstract);分类 cs.LG、cs.SE
AI总结 本研究针对HDFS日志人工异常检测复杂枯燥的问题,提出结合LLM-BiLSTM模型与Kafka流式管道的检测方案,实现HDFS块异常的快速准确检测。
Comments 37 pages