Scout: Scalable Document Extraction via Data Similarity
Scout:基于数据相似度的可扩展文档提取工具
专题命中 工具调用 :agent(abstract)
AI总结 Scout是一款基于文档相似度的可扩展文档提取工具,通过生成优化规则集实现高性价比数据提取,在多个真实数据集上达到与前沿LLM相当的准确率,成本大幅降低且优于同类基于程序的方法。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
Scout:基于数据相似度的可扩展文档提取工具
专题命中 工具调用 :agent(abstract)
AI总结 Scout是一款基于文档相似度的可扩展文档提取工具,通过生成优化规则集实现高性价比数据提取,在多个真实数据集上达到与前沿LLM相当的准确率,成本大幅降低且优于同类基于程序的方法。
用于纳姆和(Nahm sums)的机器引导递推边界理论
专题命中 工具调用 :agent(abstract)
AI总结 该研究开发了机器引导的递推边界理论,结合符号搜索与Q学习发现关键结果,证明了Shi和Wang的猜想3.8,得到Zagier第十二个三阶秩示例对偶纳姆和的二阶递推与五单元证明。
Comments Comments Welcome!
基于物理学原理的材料人工智能用于可靠的材料发现
专题命中 工具调用 :AI agent(abstract)
AI总结 该研究提出PhysMat AI框架,整合物理知识用于材料发现,通过多领域示例说明其应用,还规划了从物理感知到自主AI的发展路线,助力可靠材料发现。
以精度和决断性为目标:采用双重停止准则的可靠序贯假设检验
专题命中 工具调用 :planning(abstract)
AI总结 该研究提出DPitG方法,结合精度目标与明确裁决,将PitG的不确定率从62%降至2%且零假阳性,符合预注册标准,适用于需可靠裁决的场景。
Comments Main section 17 pages and 9 figures, Seven Abstracts in 7 pages and 1 figure
TensorCast:大语言模型基础设施中缺失的张量管理层
专题命中 工具调用 :agent(abstract)
AI总结 该研究针对LLM基础设施中张量管理策略复用受阻的问题,提出TensorCast分布式张量管理层,将张量状态管理与计算逻辑解耦,在保持性能的同时提升多轮智能体工作负载的TTFT达93.2%。
生成式人工智能是否缩小了基于教育背景的生产力差距?来自随机实验的证据
专题命中 工具调用 :tool use(abstract)
AI总结 通过对1174名成年人的随机实验发现,生成式AI缩小了不同教育背景劳动者的任务执行生产力差距,且提升效果并非完全源于任务委托。
带一般涡量的水波的全密度退化驻点
专题命中 工具调用 :tool use(abstract)
AI总结 本文针对带一般涡量的二维行进重力水波,利用改进的Weiss型单调性公式与Almgren型频率公式,证明了严格双侧线性增长区域外不存在全密度退化驻点,并推广了旋转波的Stokes猜想。
Comments 26 Pages. Comments and suggestions are welcome
虚拟化环境中的GPU性能分析:一项案例研究
专题命中 工具调用 :tool use(abstract)
AI总结 本文针对当前性能工具不支持虚拟GPU(vGPU)的问题,提出一款兼容Intel GVT-g的新型性能分析工具,通过软件追踪技术收集数据并生成指标,助力识别vGPU虚拟机的性能瓶颈。
Comments 18 pages, 12 figures, 5 tables
Journal ref Future Internet 2024, 16, 72
面向自主公式化阿尔法发现:进化计算视角
专题命中 工具调用 :agentic(abstract)
AI总结 本文从进化计算视角,提出自动化公式化阿尔法发现的统一分析与评估框架,为开发可靠的自主阿尔法发现系统奠定基础。
面向KV缓存的互联网:在大语言模型推理时代重新思考经典基础设施边界
专题命中 工具调用 :tool-use(abstract)
AI总结 该研究提出面向KV缓存的互联网愿景,主张跨云与数据中心解耦计算与KV缓存存储,将KV缓存管理作为内容分发系统,以最小化大语言模型推理的延迟与成本。
从微观认知到自我建构:人机交互中心理学理论的四层整合综述
专题命中 工具调用 :tool use(abstract)
AI总结 本文针对HCI从“工具使用”向“心智共生”的范式转变,提出四层整合心理学理论框架,明确其对生成式AI等场景的启示及核心挑战与未来方向。
GRaTer-JAX:用于碎屑盘建模的加速软件包
专题命中 工具调用 :workflow(abstract)
AI总结 GRaTer-JAX是用于碎屑盘建模的Python软件包,结合GRaTer框架与JAX的高性能计算能力,提供强大高效的建模框架,能统一正向建模等工作流程,还能进行更高级建模,推动相关研究发展。
Comments 4 pages, 3 figures
CAP-DO:用于跨相关零和博弈的认证双预言机求解的学习上下文动作提议
专题命中 工具调用 :planning(abstract)
AI总结 研究针对解决一系列相关零和博弈问题,提出CAP-DO框架,通过离线训练排序器、在线提议动作集,结合学习与当前博弈确定输出,理论上保留认证保证且有限收敛,实验中在多规模基准测试里有更好表现。
Comments 10 pages, 5 figures
通过大规模数据集上的逆合成实现具有低损耗的单调谐元件加载像素化可调带通滤波器
专题命中 工具调用 :workflow(abstract)
AI总结 该论文提出三相逆设计流程合成可调像素化带通滤波器,先获取大规模数据集,经暴力搜索识别初始种子,再用直接二分搜索算法微调。考虑4G和5G频段目标,设计的滤波器实现28%调谐范围,且仅用单个变容二极管,是微波领域首次连续可重构逆设计演示。
Comments 4 pages, 4 figures
PerceptDrive:用于端到端自动驾驶的具有自适应专家路由的感知先验世界-动作建模
机构 * Tsinghua University(清华大学) ; AMap, Alibaba Group(高德软件有限公司,阿里巴巴集团)
专题命中 工具调用 :planning(abstract)
AI总结 研究针对自动驾驶中感知基础模型的问题,提出PerceptDrive框架,将教师提炼先验和观察潜变量输入可训练模型,经特定分支处理、先验保留及场景条件路由,实验表明其性能领先,证实相关方法的有效性及对先验的依赖。
当HTTP 402遇上区块链:新兴x402支付的风险
专题命中 工具调用 :AI agent(abstract)
AI总结 研究x402支付协议,通过系统研究确定促进者的安全规则,基于规则违规分析得出新攻击向量,提出半自动黑盒工具评估安全性,发现部署均有违规,还通过实证测量量化相关指标,揭示其安全风险。
Journal ref USENIX Security 2026
FARO:可行性感知机器人运动优化
机构 * Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich (TUM)(慕尼黑工业大学慕尼黑机器人与机器智能研究所) ; Institute for Advanced Study, Technical University of Munich(慕尼黑工业大学高级研究所) ; Carnegie Mellon University(卡内基梅隆大学) ; SIEMENS AG(西门子公司) ; Huawei-TUM joint laboratory(华为-慕尼黑工业大学联合实验室)
专题命中 工具调用 :planning(abstract)
AI总结 针对机器人在未知场景快速规划新行为的挑战,提出嵌套运动动力学框架,结合可行性引导树搜索和大语言模型采样策略,能改善搜索过程,生成的轨迹可用强化学习控制器跟踪,质量高可用于实际运动操作场景。
用哈密顿量导出的克利福德变换减少纠缠
专题命中 工具调用 :tool use(abstract)
AI总结 研究利用Q-Cliff算法生成化学系统基态的高效近似,该算法精度在MP2和CISD之间,计算量为\(O(N^6)\)。通过DMRG计算减少量子比特纠缠,改进算法生成低深度且CNOT高效的电路,为经典和量子算法提供新工具。
Comments 11 pages, 4 figures
基于蒙特卡洛树搜索的实时飞行测试机动选择
专题命中 工具调用 :planning(abstract)
AI总结 研究如何在资源限制下安排飞行架次机动动作以降不确定性,提出结合高斯过程与蒙特卡洛树搜索的实时规划框架,用加权综合方差减少评分,经模拟评估,该方法在降不确定性上优于基线,是提高飞行测试效率的有前途方法。
Comments N. E. Bostock and H. Pruitt-Kennett contributed equally. 9 pages, 4 figures. Accepted to the 45th AIAA/IEEE Digital Avionics Systems Conference (DASC 2026)
通过分析模型驱动的神经网络预测机器人手的抓握顺应性
机构 * Stevens Institute of Technology(史蒂文斯理工学院)
专题命中 工具调用 :tool use(abstract)
AI总结 研究旨在开发强力交互时抓握工具行为的预测模型,引入分析模型驱动神经网络(AMINN),结合分析力学层与数据驱动学习,在三指欠驱动机器人手上评估,有强预测能力且实现更好物理一致性,推动了物理可解释学习。
Comments Preprint. 9 pages, 8 figures, 1 table
XMatcher:用于X射线衍射相识别的开源框架
专题命中 工具调用 :workflow(abstract)
AI总结 介绍开源框架XMatcher,用于X射线衍射相识别。它集成多种功能于便携工作流程,能生成理论库、检索候选相、校正匹配并报告指标证据,其AutoMix模块可处理多相模式,通过图形界面提供可解释且可重现的相识别平台。
多旋翼无人机的动态车辆定向问题
专题命中 工具调用 :planning(abstract)
AI总结 研究多旋翼无人机的动态车辆定向问题,提出结合非线性规划与混合整数线性规划的分支定界程序和大邻域搜索元启发式算法两种解决方案,实验表明改进显著,实际部署验证了所提质点模型解决方案轨迹。
Comments 28 pages, 10 figures, preprint submitted to European Journal of Operational Research
直觉主义动态逻辑
专题命中 工具调用 :agent(abstract)
AI总结 研究直觉主义动态逻辑的数学理论,涵盖五种该逻辑。通过开发证明论工具、进行语义研究,建立相关性质与界限。主要贡献为开发演算、获有限模型性质及可判定性、给出直觉主义线性时态逻辑完备公理系统。
Comments PhD Thesis
测量已发表分子对接声明的可重新执行性
专题命中 工具调用 :agent(abstract)
AI总结 研究探讨已发表分子对接声明的可重新执行性,引入MERS-Dock及可执行性阶梯,通过对236篇相关论文审核发现可执行性低,验证审核并分析结果,表明再现差距是几何效应,将E类作可执行性门,发布测量层助数字系统核查计算声明。
Comments 19 pages, 6 figures. Data, code, and the MERS-Dock reporting standard: https://github.com/giapha/mpro-dockexec
迈向人类水平的灵巧遥操作
机构 * Tsinghua University(清华大学) ; State Key Lab of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,字节跳动公司) ; Peking University(北京大学)
专题命中 工具调用 :tool use(abstract)
AI总结 研究如何通过遥操作赋予机器人手内灵巧性,提出TeleDexter手 - 物体协同跟踪控制器,利用混合奖励训练,经单阶段强化学习及随机化处理可零样本迁移到真实机器人,在多项任务上取得高成功率并能训练自主策略。
Comments Project Website: https://bigai-dex.github.io/blog/teledexter/
SLIDER:使用滑动局部地图的稀疏历史引导空中机器人目标搜索
专题命中 工具调用 :planning(abstract)
AI总结 针对空中机器人在大规模未知环境中目标搜索难题,提出SLIDER框架,结合局部滑动地图与稀疏全局历史信息,通过新评估方法、聚类策略及维护拓扑地图实现高效搜索,性能优于现有方法。
Comments Accepted by IEEE Robotics and Automation Letters (RA-L), 2026. https://github.com/Poaos/SLIDER
基于软演员-评论家强化学习的自主过渡态搜索
专题命中 工具调用 :agent(abstract)
AI总结 研究针对过渡态搜索计算量大且依赖初始猜测等问题,基于软演员-评论家模型,将搜索设为内部坐标的序列决策过程,通过奖励函数自适应更新结构,成功识别标准反应过渡态几何结构,展现强化学习在反应发现中的潜力。
每个样本都很重要:基于逐点约束的语言模型监督微调
专题命中 工具调用 :function calling(abstract)
AI总结 研究语言模型微调中逐点约束问题,提出新对齐框架,通过逐样本约束最小化平均损失,引入学习松弛方法并开发增广拉格朗日方法,在多任务和约束下实例化,减少约束违反且保留模型性能。
Weightflow:R 中声明式、可感知配方的调查加权
专题命中 工具调用 :workflow(abstract)
AI总结 研究为复杂调查生成权重的方法,提出 Weightflow 包,通过声明式 API 构建权重,将定义与应用分离,可重现可审计,能传播各阶段不确定性,实现多种校准及调整,经验证在实际数据中能恢复已知贫困率。
Comments 13 pages, 7 figures. Software on CRAN: https://CRAN.R-project.org/package=weightflow ; docs: https://jpferreira33.github.io/weightflow/
小程序、大问题:通过动态分析揭示小程序中基于 OAuth 的认证滥用情况
专题命中 工具调用 :workflow(abstract)
AI总结 研究通过动态分析揭示小程序中基于 OAuth 的认证滥用问题,设计 MINIAUTH 框架,对大量微信和百度小程序进行分析,发现多种滥用案例及百度 API 加密缺陷,强调加强开发者指导与平台保护的必要性。
Comments Accepted by ACM CCS 2026