Shapley Meets Tutte
沙普利值与图特多项式相遇
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究存在预先对齐代理组的合作博弈,通过连通性增强局部值的沙普利值建模局部连接对网络连通性的贡献,并将其与色多项式、图特多项式及Potts模型配分函数相联系,以解决相关网络问题。
Comments 14 pages, 0 figures
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
沙普利值与图特多项式相遇
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究存在预先对齐代理组的合作博弈,通过连通性增强局部值的沙普利值建模局部连接对网络连通性的贡献,并将其与色多项式、图特多项式及Potts模型配分函数相联系,以解决相关网络问题。
Comments 14 pages, 0 figures
ReferTrack:用于具身视觉跟踪的先指认后跟踪
机构 * SUSTech(南方科技大学) ; Tencent Robotics X(腾讯机器人X实验室) ; Peking University(北京大学) ; Futian Laboratory(福田实验室)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究针对具身视觉跟踪问题,提出ReferTrack先指认后跟踪范式,用单个摄像头,先选目标再解码跟踪航点,通过滑动窗口队列保留运动线索,经数据集协同训练增强识别,在EVT - Bench上达先进单视图性能并验证了迁移能力。
一个全国规模的电动汽车充电调度框架:基础设施容量约束下的最优迂回路由
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究在现有充电基础设施下电动汽车长途旅行调度负担与成本,提出基于优化的可扩展框架,分三阶段计算最优充电调度,应用于大量车辆轨迹,能快速生成可行调度并评估电动汽车成本竞争力。
Retriever:组合闭环异步机器人程序
机构 * Stanford University(斯坦福大学) ; MIT(麻省理工学院) ; Northeastern University(东北大学)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究构建长期运行机器人智能体的闭环管道问题,提出Retriever,它涵盖异步决策模型等整个堆栈,将智能体表示为有状态因果流函数图,编译到支持多后端的运行时,可系统调试和确定性重放,通过案例研究等进行评估。
Comments Project website: http://retriever.systems; Package open-source website: http://openretriever.org
一种用于社区感知犯罪热点检测的模糊逻辑框架:城市计算平台的原型应用架构与探索性验证
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 该研究针对城市犯罪预防挑战,构建基于模糊逻辑的框架用于社区感知犯罪热点检测和实时通知,结合多种数据与规则估计风险,经探索性验证,虽未证明能减少犯罪或预测准确,但为相关研究提供了以人为本的框架。
Comments 12 pages, 6 tables, 1 figure. Framework paper with Python prototype and exploratory validation with 25 participants
将视频搜索为树:用于有基础的长视频问答的自校正智能体
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) ; Sony(索尼)
专题命中 规划决策 :agent(abstract);agentic(abstract)
AI总结 研究有基础的长视频问答问题,提出VideoTreeSearch框架,通过构建自适应时间树及可学习的离散操作让智能体导航,经监督微调与强化学习训练,在多个基准测试中表现出色,证明自校正分层搜索是关键机制。
用于云原生卫星平台的基于代码即政策护栏的地面任务计划编译
专题命中 规划决策 :AI agent(abstract);workflow(abstract)
AI总结 研究针对卫星云原生运行时缺少地面开源工具链的问题,提出卫星任务编译器这一四阶段管道,能依据规则检查并编译任务计划为相关工件,经多种方式验证,还向AI代理暴露管道,有相关工具及发布协议。
Comments 13 pages. Extended version of the paper accepted at IEEE SMC-IT/SCC 2026 (Space Mission Challenges for Information Technology / Space Computing Conference); adds a unified GPU+CPU DRA quota and a scheduler-level accelerator fallback re-validated on Kueue v0.18.3
AdaTurn:用于主动视觉感知智能体的预算感知测试时缩放
机构 * University of Rochester(罗切斯特大学) ; Univeristy of Michigan(密歇根大学)
专题命中 规划决策 :agent(abstract);tool use(abstract)
AI总结 研究主动视觉感知智能体在不同预算下的任务执行问题,提出AdaTurn框架,通过强制答案DAPO等组件,根据预算调整智能体行为,提高低预算准确率,且能有效转移到多基准测试中。
ReflectVLN:通过反思推理训练视觉语言导航智能体
机构 * Amap, Alibaba Group(高德软件有限公司,阿里巴巴集团) ; Beihang University(北京航空航天大学)
专题命中 规划决策 :agent(abstract);agentic(abstract)
AI总结 研究针对现有视觉语言导航方法缺乏闭环机制问题,提出ReflectVLN框架,通过双向交互智能体决策,引入行动思维链训练方案,实验证明该框架在有限数据下提升成功率和路径效率,且具良好训练成本与可解释性。
CoMind:从多视角理解人类协作活动
机构 * ETH Zurich(苏黎世联邦理工学院) ; MPI for Informatics(马克斯·普朗克信息研究所) ; Microsoft Switzerland(微软瑞士公司) ; TU Munich(慕尼黑工业大学)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究旨在填补人类协作认知过程研究空白,引入CoMind数据集,整合多模态数据并标注,建立相关基准,有助于开发和评估能建模复杂社会互动及推理人类行为的AI系统。
Comments Accepted to ECCV 2026
不退化文本智能的统一音频智能
机构 * Nemotron-Labs(Nemotron实验室)
专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本文提出统一音频-文本大语言模型Audex,通过单Transformer解码器架构与多阶段训练,在实现多音频任务SOTA性能的同时,几乎不损失骨干文本LLM的原有文本智能能力。
Comments We release the Audex models at https://huggingface.co/collections/nvidia/nemotron-labs-audex
男性不育症精液分析深度学习技术:计算机视觉、多模态融合与临床转化
机构 * Department of Gynaecology and Obstetrics, The Affiliated Jiangyin Hospital of Nantong University(南通大学附属江阴医院妇产科) ; Department of Oncology, the Affiliated Jiangyin Hospital of Nantong University(南通大学附属江阴医院肿瘤科) ; Thrust of AI, Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)人工智能推力实验室) ; FertiTech AI(生殖科技人工智能公司) ; Department of Oncology, Suzhou Xiangcheng People’s Hospital(苏州市相城区人民医院肿瘤科) ; Department of Biological Sciences and Bioinformatics, School of Science, Xi’an Jiaotong-Liverpool University(西交利物浦大学理学院生物科学与生物信息学系) ; School of Artificial Intelligence and Computer Science, Nantong University(南通大学人工智能与计算机科学学院)
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 针对传统精液分析的主观性强等缺陷,综述聚焦计算机视觉与深度学习驱动的精子分析技术,梳理方法、数据集与落地障碍,提出分阶段临床转化路线。
Comments 46 pages, 14 figures
一种精确的广义k细胞分解
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究为配备k调制解调器的智能体在多边形环境中进行可见性规划提出精确k细胞分解,通过消除冗余线,确保可见性事件发生在分解线上,改进复杂度,明确关键事件位置并适用于带孔多边形,有实际应用。
Comments To appear in the Proceedings of the 38th Canadian Conference on Computational Geometry (CCCG 2026)
在有预定位设施的区域间定位桥梁的机制设计
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究在两个有预定位设施的区域间建桥的机制设计问题,考虑不同机制下社会成本和最大成本,给出最优解特性及多种近似机制和下界。
Comments 12 pages, 1 figure; includes supplementary material
超越场景先验:通过基准测试和查询引导的小目标聚焦进行细粒度交通场景推理
机构 * The University of Hong Kong(香港大学) ; Sun Yat-Sen University(中山大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中 规划决策 :agent(abstract);multi-agent(abstract)
AI总结 针对安全关键交通场景中复杂问题,提出细粒度交通推理基准FGTR - Bench和文本引导小目标推理MLLM(TSR - MLLM),解决视觉语言对齐中关键小目标被忽视问题,提升模型性能。
CRRL:一种用于自主系统恢复的基于因果关系的强化学习框架
机构 * Simula Research Laboratory(Simula研究实验室) ; University of Oslo(奥斯陆大学)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 研究自主系统恢复中传统强化学习问题,引入基于因果关系的CRRL框架,利用驾驶日志因果关系塑造训练信号,使策略与基于规则的恢复有效协作,提升相关指标。
Comments 30 pages
SessionBound: 将企业任务审批转化为预算化的数据库会话
专题命中 规划决策 :agent(abstract);AI agent(abstract)
AI总结 提出SessionBound框架,将审批的企业任务转化为短期、预算化、可审计的数据库会话,通过控制平面和SessionBoundDB实现安全边界,无需LLM判断查询安全性。
Comments 7 pages, research prototype. Code: https://github.com/SessionBound/sessionbound
基于近似查询处理和代理模型的AI工作流查询中心优化
专题命中 规划决策 :workflow(abstract);agentic(abstract)
AI总结 提出将AI工作流视为声明式查询,利用近似查询处理(AQP)和代理模型(PM)过滤减少昂贵模型调用,在TPC-DS和LLM流水线上实现85-90%和60-70%的调用减少。
探究性行动逻辑
专题命中 规划决策 :agent(abstract);multi-agent(abstract)
AI总结 提出探究性行动逻辑InqAL,一种用于推理行动的多主体模态逻辑,通过问题模态分析主体对结果的确定作用,并证明其完备性和可判定性。
Comments In Proceedings AiML 2026, arXiv:2606.29444
Journal ref EPTCS 447, 2026, pp. 222-241
先规划正确,再规划紧凑:面向高效具身推理的符号强化学习
机构 * Tsinghua University(清华大学) ; The Hong Kong University of Science and Technology(香港科技大学) ; Tencent(腾讯) ; University of London(伦敦大学)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 针对具身任务规划中缺乏低成本确定性验证的问题,提出基于BDDL规范的符号强化学习框架,通过视频解析、LLM验证和轻量符号引擎提供毫秒级密集反馈,并引入难度感知长度调度GroupAdapt,在BEHAVIOR-1000上实现97.3的严格通过率,相对Qwen3-8B提升25.9%。
Comments 18 pages, 10 figures, 14 tables; includes appendix
大声思考:非对称LLM谈判中的实时欺骗监控
专题命中 规划决策 :agent(abstract);agentic(abstract)
AI总结 提出轻量级实时思维链监控器,在二手车销售场景中检测卖家隐藏缺陷的欺骗行为,实验表明监控能提高买家退出率但存在智能差距。
Vera C. Rubin 天文台调试和早期运行期间使用 Zephyr Scale 的测试管理与协调
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 采用 Jira 原生测试管理工具 Zephyr Scale 协调数百项集成和天空测试,通过测试用例和测试周期管理流程,并集成调度器实现部分自动化,总结了其在大规模天文台调试中的优缺点。
Comments 4 pages, 3 figures. To be published in Proc. SPIE 13381, Observatory Operations: Strategies, Processes, and Systems X, 2026
长程LLM推理的上下文回收
机构 * Independent Researcher(独立研究员)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出ContextForge系统,通过结构化查询生成、外部记忆检索和受控合成实现上下文回收,在15轮对话基准中减少令牌消耗并保持回答质量。
BiPACE:基于双模拟引导与动作反事实估计的LLM智能体策略优化
机构 * University of Chicago(芝加哥大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; Stanford University(斯坦福大学) ; University of Science and Technology of China(中国科学技术大学) ; Meituan(美团)
专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 针对分组强化学习中状态-动作信用分配不匹配问题,提出BiPACE优势估计器,通过双模拟引导的状态聚类和动作反事实基线,在无需批评网络或额外采样的前提下提升LLM智能体训练效果。
NeuXtalViz:单晶中子衍射的交互式三维可视化与分析
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 开发了基于Python的NeuXtalViz软件,利用Mantid框架和PyVista/Matplotlib实现单晶中子衍射数据的交互式三维可视化与分析,支持UB矩阵确定、实验规划、倒易空间可视化和实空间结构计算。
基于光学扫描的表浅模具近距离治疗合成CT图像生成
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 提出利用光学3D扫描数据生成合成CT图像,结合3D建模和商业治疗计划系统,实现表浅近距离治疗模具的导管定位和剂量优化,无需内部解剖信息。
Comments 8 pages, 3 figures, accepted for publication in the IFMBE Proceedings on the World Congress on Medical Physics and Biomedical Engineering 2022
有毒剧本:揭秘知识投毒对AI安全代理的影响
专题命中 规划决策 :agent(abstract);AI agent(abstract)
AI总结 研究揭示通过RAG注入单条有毒安全知识可系统性改变AI安全代理行为,提出验证边界(VB)分类法,并评估验证提示与多源检索的防御效果。
RoBoSR:面向具身机器人推理的结构化场景表示
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 提出RoBoSR,一种基于语义对象中心场景图的中间结构表示,将操作建模为逐步状态转换,实现因果推理和长期任务规划,并在零样本泛化中优于提示方法和经典TAMP基线。
EmbodiedUS-FS:用于超声机器人的快速慢速智能
机构 * independent researcher(独立研究员) ; Shanghai World Foreign Language Academy(上海世界外国语中学) ; University of Wyoming(怀俄明大学) ; SUNY Binghamton(纽约州立大学宾汉姆顿分校)
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 提出一种分层快慢思考的具身超声系统,通过慢脑进行意图解析和任务规划,快脑融合多模态反馈优化局部动作,并集成安全防护机制,在动态临床环境中提高任务成功率并减少安全违规。
STARE: 基于惊讶度的令牌级优势重加权以实现策略熵稳定性
机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) ; Tencent Hunyuan(腾讯 Hunyuan)
专题命中 规划决策 :tool use(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 针对GRPO等RL算法中策略熵崩溃问题,提出STARE方法,通过惊讶度分位数识别熵关键令牌并重加权其优势,结合目标熵闭环门控稳定熵,在1.5B-32B模型和多种任务上实现稳定训练,AIME24/25准确率提升4%-8%。
Comments LLM, Reinforcement Learning