Complex Autonomous UAV Task Execution and Decision-Making With s(CASP)
基于s(CASP)的复杂自主无人机任务执行与决策
专题命中 工具调用 :agent(abstract)
AI总结 提出使用s(CASP)回答集编程系统构建符号状态中心的无人机代理,在虚幻引擎5环境中实现基于约束的常识推理,支持多步骤自主行为并动态调整计划,确保决策正确可解释。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
基于s(CASP)的复杂自主无人机任务执行与决策
专题命中 工具调用 :agent(abstract)
AI总结 提出使用s(CASP)回答集编程系统构建符号状态中心的无人机代理,在虚幻引擎5环境中实现基于约束的常识推理,支持多步骤自主行为并动态调整计划,确保决策正确可解释。
“局部发生,全局泄露”:检测MCP服务器中的隐私泄露风险
专题命中 工具调用 :agent(abstract)
AI总结 提出MCPPrivacyDetector,一种上下文感知的跨语言静态分析框架,用于检测MCP服务器中由协议引发的隐私泄露,在10,655个真实服务器中发现超过10%的泄露率。
从惩罚到保护:通过主题建模和LLM辅助分析描绘美国少年司法的六十年变迁
专题命中 工具调用 :tool use(abstract)
AI总结 本文通过主题建模和LLM辅助分析60470份美国上诉意见(1970-2025),发现儿童福利案件激增、性犯罪登记案件翻倍,而传统惩罚机制(移交成人法庭、少年死刑)大幅下降,并揭示了法律词汇的十年演变和司法管辖区碎片化风险。
Comments 7 figures, 4 tables, includes appendices
PACMS: 作为LLM代理可插拔引擎的子模上下文选择
专题命中 工具调用 :agent(abstract)
AI总结 提出PACMS,一种基于子模函数最大化的上下文选择方法,在提示组装时按相关性从会话、记忆和工具输出中挑选内容,替代截断机制,提升长对话中的信息保持能力。
LLM介导的人机交互在搜索与救援中的应用:专业知识对注意力分配的影响
专题命中 工具调用 :planning(abstract)
AI总结 本研究通过模拟搜索救援任务,比较有无大语言模型(LLM)指导的条件,结合眼动追踪和行为分析,发现LLM提升任务效率但未增加总救援人数,并揭示了注意力-指导权衡,其中专业知识调节了用户对AI的依赖模式。
HEACalculator:用于高熵合金热力学性质计算和固溶体预测的开源Python工具
专题命中 工具调用 :workflow(abstract)
AI总结 本文介绍HEACalculator,一个开源Python包,可计算16种常用热力学和结构描述符,并评估8种固溶体形成规则,支持CLI、GUI和API三种使用模式。
Comments 7 pages, 1 figure
Tangram: 隐藏GPU异构性以实现高效的大语言模型并行化
专题命中 工具调用 :planning(abstract)
AI总结 提出Tangram系统,通过将并行化规划与GPU异构性解耦,利用同构GPU岛和模型切片组合成工作平衡流水线,实现现有异构不可知并行化器在异构集群中的高效使用,训练吞吐量提升高达2.3倍。
CacheWise:理解工作负载并优化KVCache管理以高效服务LLM编码代理
专题命中 工具调用 :agent(abstract)
AI总结 针对编码代理会话中大量前缀复用导致KVCache压力的问题,提出CacheWise管理层,结合前缀感知调度和基于工具调用元数据的轻量级预测驱逐策略,减少KVCache驱逐并提升会话完成时间。
一种基于模型与无模型混合框架的主动多视角声纳目标识别视点优化
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 工具调用 :agent(abstract)
AI总结 提出混合模型与无模型框架,结合CNN观测似然与Radon方向估计,通过信息增益奖励训练PPO智能体离线学习视点选择策略,部署时仅用CNN信念更新实现实时视点选择,在声纳数据集上以更少感知步数和运动成本达到竞争性识别精度。
面向搜索与推荐系统的可验证用户模拟
专题命中 工具调用 :agent(abstract)
AI总结 提出一个七组件可审计框架,将用户模拟器视为可验证工程制品,通过动手实验检查模拟器行为、诊断差异并检测人口偏差。
Comments Presented as a half-day tutorial at SIGIR 2026, 4 pages
Journal ref In Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026)
基普问题:分布式认知下的制度可读性
专题命中 工具调用 :agent(abstract)
AI总结 针对分布式AI系统认知分散导致制度可读性丧失的问题,提出“基普问题”概念,强调需要维护解释连续性而非仅保留痕迹,并建议构建治理工作空间和承载收据的治理界面作为解释基础设施。
Comments 17 pages, 2 figures, 1 table. Conceptual governance paper on institutional legibility, distributed cognition, and interpretive continuity in AI systems
GLIDE:未知环境下的空地协同搜索与救援框架
机构 * University of California, Berkeley(加州大学伯克利分校) ; Stanford University(斯坦福大学)
专题命中 工具调用 :planning(abstract)
AI总结 提出GLIDE框架,通过两架无人机与一辆无人地面车协同,实现未知环境中的快速受害者定位和障碍物感知导航,利用角色分离和地形侦察提升救援效率。
消失的行为:生成式搜索与影子封禁
专题命中 工具调用 :agentic(abstract)
AI总结 本文研究生成式搜索和影子封禁对互联网开放生态的破坏,分析其法律与监管问题,并提出增强透明度与公平性的解决方案。
Journal ref 27 German Law Journal 1211 - 1234 (2025)
迈向量子分类器的实现
专题命中 工具调用 :tool use(abstract)
AI总结 研究量子电路作为二元分类模型,使用Qibo框架设计分类器,在MNIST和高能碰撞数据集上测试,与经典CNN比较性能。
Comments Bachelor's Thesis in Physics, Lorenzo Confalonieri, supervised by Adrián Pérez-Salinas and Stefano Carrazza, Università degli Studi di Milano (July 2021). 55 pages, 28 figures. Code implementations utilize the Qibo framework
AttriGuard: 通过工具调用的因果归因击败LLM代理中的间接提示注入
专题命中 工具调用 :agent(abstract)
AI总结 针对LLM代理易受间接提示注入攻击的问题,提出基于并行反事实测试的运行时防御AttriGuard,通过因果归因区分用户意图驱动与不可信观察驱动的工具调用,在多个基准上实现0%攻击成功率。
Comments Accepted by USENIX Security 2026
OpenPCC:在商用TEE上提供开放且保密的LLM服务
专题命中 工具调用 :AI agent(abstract)
AI总结 针对云推理服务中用户请求包含敏感信息的问题,提出OpenPCC框架,利用商用TEE实现开放、保密的LLM服务,并通过原型验证其可行性与安全性。
LieIPM:用于刚体直接轨迹优化的李群内点法
机构 * University of California, Berkeley(加州大学伯克利分校) ; MIT(麻省理工学院) ; Ohio University(俄亥俄大学) ; University of Michigan, Ann Arbor(密歇根大学安娜堡分校)
专题命中 工具调用 :planning(abstract)
AI总结 提出一种基于李群结构的约束轨迹优化框架LieIPM,利用二阶刚体模型和变分积分器,实现无奇异、快速收敛的牛顿型更新。
LEAP: 欧罗巴多流体磁流体动力学的快速神经替代模型
专题命中 工具调用 :planning(abstract)
AI总结 针对欧罗巴地下海洋探测中MHD模型计算成本高的问题,提出基于Transformer的替代模型LEAP,实现毫秒级预测磁场扰动,速度提升约40000倍,精度与MHD相当。
如何在基于线性混合模型的集群随机试验中进行样本量和功效计算以检测治疗效应异质性
专题命中 工具调用 :planning(abstract)
AI总结 本文探讨了在集群随机试验中使用线性混合模型检测治疗效应异质性的样本量和功效计算方法,提供了计算工具和关键考虑因素。
Comments v3: accepted, 33 pages (19 main, supplemental 14); v2: revision under review, 36 pages (main 22, supplemental 14); v1: 28 pages, 4 tables, 5 figures
Journal ref International Journal of Epidemiology (2026) Volume 55, Issue 3
基于区间分支定界的逆运动学算法实现全局最优冗余度解析
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 工具调用 :planning(abstract)
AI总结 提出一种结合快速数值IK求解器搜索启发式的区间分支定界方法,高效求解机械臂广义逆运动学问题,生成邻域解以提供自运动流形的丰富几何信息,支持最优规划和任意时间求解。
面向文本到3D室内场景生成的视觉-语言模型中的全局-局部蒙特卡洛树搜索
机构 * State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications, China(网络与交换技术国家重点实验室,北京邮电大学)
专题命中 工具调用 :planning(abstract)
AI总结 提出一种全局-局部蒙特卡洛树搜索方法,通过分层场景表示和PRM引导的MCTS解决文本到3D室内场景生成中的错误传播问题,并构建新基准数据集3DTindo-bench。
二元行动单维契约设计中的遗憾最小化
专题命中 工具调用 :agent(abstract)
AI总结 针对在线主-代理问题中代理类型对抗性序列,提出基于非均匀离散化的阈值优化方法,实现与结果数量无关的Θ(T^{2/3})遗憾界;对于固定隐藏类型,采用探索后提交策略达到Θ̃(√T)遗憾界。
WebKnoGraph: 基于GNN的内部链接优化
专题命中 工具调用 :workflow(abstract)
AI总结 提出WebKnoGraph框架,利用GraphSAGE对网站爬取数据建模为有向图,通过PageRank和语义一致性评估自动与专家辅助链接选择策略,发现自动选择带来更强权威重分配但语义成本更高。
基于LLM的通过去优化和再优化将优化C++移植到CUDA
专题命中 工具调用 :workflow(abstract)
AI总结 提出Deopt-Reopt工作流,通过先简化CPU优化代码再重新翻译优化为CUDA,利用LLM提升移植性能,实验表明该方法在部分内核上有效但非普遍适用。
审查新闻媒体曝光中的LLM编辑偏见
专题命中 工具调用 :agentic(abstract)
AI总结 本文研究了LLM在新闻聚合中的编辑偏见问题,通过比较三种领先的LLM与Google News,发现LLM在媒体多样性、意识形态和可靠性方面存在显著差异。
Comments Under Peer Review
Argus-Retriever: 基于区域感知查询条件混合专家模型的视觉-大语言模型后期交互检索用于视觉文档检索
专题命中 工具调用 :agentic(abstract)
AI总结 提出Argus系列查询条件后期交互检索器,通过区域感知混合专家模块使文档表示依赖查询,在ViDoRe基准上以更低维度和更少训练数据取得领先性能。
关于用于热和湿度参数估计的最优实验设计
专题命中 工具调用 :planning(abstract)
AI总结 本文提出最优实验设计的概念,旨在通过传感器数量和位置以及边界条件来优化实验条件,以提高参数估计的准确性,应用于纯导热和热-湿度耦合传热两种情况。
Comments 32 pages, 14 figures, 3 tables, 34 references. Other author's papers can be downloaded at http://www.denys-dutykh.com/
Journal ref Experimental Thermal and Fluid Science (2017), Vol. 81, pp. 109-122
技术报告:基于可达性的安全激进四旋翼飞行轨迹设计
机构 * Mechanical Engineering, University of Michigan, Ann Arbor, MI(机械工程,密歇根大学,安娜堡,MI)
专题命中 工具调用 :planning(abstract)
AI总结 本文提出了一种基于可达性的四旋翼飞行轨迹设计方法,通过在线规划中创新性地使用Zonotopes来确保在存在轨迹依赖性跟踪误差的情况下飞行安全,实验显示在500个随机复杂环境中实现了最高5m/s的激进飞行且无碰撞。
Comments 12 Pages, 3 Figures, 1 Table
在存在时间逻辑约束下的部分可观测环境中的安全控制
专题命中 工具调用 :agent(abstract)
AI总结 本文研究了在存在对手的情况下,代理在部分可观测环境中满足时间逻辑规范的控制策略合成问题,通过有限状态控制器空间中的搜索方法来确定策略,以最大化满足给定的时间逻辑规范。
Comments To appear at the American Control Conference, 2019
为电力分配网络重构的子模方法
专题命中 工具调用 :tool use(abstract)
AI总结 本文提出利用子模函数最小化方法解决电力分配网络重构中的损耗最小化问题,证明该问题为强NP难,并提出多项式时间局部搜索算法,理论分析其性能并验证与传统分支交换算法等效。
Comments 10 pages, 6 figures, to appear in 51st Hawaii International Conference on System Sciences (HICSS), Hawaii, USA, Jan. 3-6, 2018
Journal ref HICSS 51 (2018) 2717-2726