Building atomistic models of heterointerfaces with optimal transport
基于最优传输构建异质界面的原子模型
专题命中 工具调用 :workflow(abstract)
AI总结 本文提出融合格罗莫夫-瓦瑟斯坦(FGW)距离结合贝叶斯优化的工作流,构建异质界面原子模型,可高效筛选界面晶格匹配关系,性能优于随机搜索及预训练MACE能量引导方法。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
基于最优传输构建异质界面的原子模型
专题命中 工具调用 :workflow(abstract)
AI总结 本文提出融合格罗莫夫-瓦瑟斯坦(FGW)距离结合贝叶斯优化的工作流,构建异质界面原子模型,可高效筛选界面晶格匹配关系,性能优于随机搜索及预训练MACE能量引导方法。
DynCur-Geo:面向多模态主动地理定位的动态好奇心奖励塑造
专题命中 工具调用 :agent(abstract)
AI总结 本文提出DynCur-Geo动态好奇心框架,通过距离感知门与势能奖励塑造优化多模态主动地理定位,在多场景实验中较基线方法取得一致性能提升。
Comments 24 pages, 18 figures, 15 tables. The main paper is 7 pages, with supplementary material included
面向序列约束机器人装配的反向布局搜索
机构 * College of Computer and Information Sciences, Fujian Agriculture and Forestry University(福建农林大学计算机与信息学院) ; School of Mechatronic Engineering and Automation, Shanghai University(上海大学机电工程与自动化学院) ; Department of System Innovation, Graduate School of Engineering Science, Osaka University(大阪大学工程科学研究生院系统创新系)
专题命中 工具调用 :planning(abstract)
AI总结 针对序列约束机器人装配布局规划的挑战,提出反向布局搜索(BLS)算法,通过反向分配零件初始位姿并结合多维度检查与波束选择,在5个装配模型上实现了更优的无碰撞布局规划,减少了评估次数与搜索时间。
Comments Submit to ROBIO2026
基于视觉语言模型的X射线荧光(XRF)与光学显微镜视场(FOV)定位
机构 * Northwestern University(西北大学) ; University of Chicago(芝加哥大学) ; Oregon Health and Science University(俄勒冈健康与科学大学) ; Argonne National Laboratory(阿贡国家实验室)
专题命中 工具调用 :workflow(abstract)
AI总结 本文针对跨模态显微图像的视场定位难题,提出结合视觉语言模型(VLM)的候选生成-验证工作流,在低对应度的相邻切片成像数据中实现了有效定位,为关联XRF与光学显微测量提供了支撑。
回溯极端事件:在最终状态条件下初始化生成1000成员集合
专题命中 工具调用 :planning(abstract)
AI总结 本研究使用非自回归基础模型cBottle-video生成1000成员集合,针对三个极端事件验证了终点约束集合的多样性与有效性,为罕见高影响事件的情景规划提供了高效方案。
Comments 38 pages, 21 figures; includes 17 pages of Supporting Information with 15 figures
可搜索菜单
专题命中 工具调用 :agent(abstract)
AI总结 本文研究代理人视角下受可处理性约束的最优筛选机制,提出可搜索菜单要求,在多产品垄断等不同场景推导最优可搜索菜单形式,得出多维筛选中可搜索性限制可实施结果集合的结论。
Comments 83 pages, 1 figure
VisDocAgentBench:面向视觉丰富文档检索的智能体基准测试
专题命中 工具调用 :agentic(abstract)
AI总结 该研究提出VisDocAgentBench基准,对比静态与智能体检索,发现视觉检索优于OCR文本检索,智能体可改善双桥项检索性能,为检索智能体发展提供方向。
ScenarioCharacterization:用于刻画轨迹数据集安全性的模块化工具包
机构 * Robotics Institute, School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机学院机器人研究所) ; Stack AV ; Bosch Center for Artificial Intelligence(博世人工智能中心)
专题命中 工具调用 :agent(abstract)
AI总结 本文提出开源模块化框架ScenarioCharacterization,可自动刻画轨迹数据集的驾驶场景安全性,适配多数据集,在Waymo等数据集上验证,支持下游应用。
Comments 9 pages, 7 figures, 3 tables
面向6G数字孪生信道的高效高精度代理辅助电磁参数校准方法
专题命中 工具调用 :workflow(abstract)
AI总结 针对6G数字孪生信道电磁参数校准的效率与精度瓶颈,提出SGWO-IM算法,通过代理模型预筛选与优化策略,使RT仿真调用量降62.5%、RMSE降至2.97 dB,实现效率与精度的平衡。
平面上的搜索与救援问题
专题命中 工具调用 :agent(abstract)
AI总结 该研究针对平面搜索与救援问题,确定临界角$\theta^* \approx 15.6^\circ$,据此给出不同角度下智能体的最优检查点,推导竞争比闭式表达式,优化搜索与交付的竞争性能。
APCReg:基于解剖先验的、经多视图投影与可靠性控制残差校正的CBCT与口腔内扫描(IOS)粗到精配准方法
专题命中 工具调用 :planning(abstract)
AI总结 针对CBCT与IOS自动配准不可靠的问题,提出APCReg框架,通过多视图解剖粗配准、重叠感知残差配准及牙弓结构假设选择等技术,在60个颌骨对的评估中多项指标优于开源基线。
Comments 10 pages, 7 figures
从提示注入到Web漏洞利用:重新审视集成大语言模型的应用中的经典漏洞
专题命中 工具调用 :agentic(abstract)
AI总结 本文研究集成大语言模型的Web应用的新型攻击LLM介导的Web攻击,提出LLM2X系列攻击类型,通过实现TicketOracle实验发现模型易感性差异,给出多层缓解策略。
用工具思考,而非用像素思考:工具调用作为视觉推理的文本支架
机构 * Hong Kong University of Science and Technology(香港科技大学) ; The Chinese University of Hong Kong(香港中文大学) ; Ant Group(蚂蚁集团) ; Zhejiang University(浙江大学)
专题命中 工具调用 :tool use(abstract)
AI总结 该研究提出工具调用支架假设,引入TextCall方法验证返回图像冗余,仅用结构化文本支架即可实现视觉推理,降低延迟并消除工具API调用,结论适用于现有相关基准。
Scout:基于数据相似度的可扩展文档提取工具
专题命中 工具调用 :agent(abstract)
AI总结 Scout是一款基于文档相似度的可扩展文档提取工具,通过生成优化规则集实现高性价比数据提取,在多个真实数据集上达到与前沿LLM相当的准确率,成本大幅降低且优于同类基于程序的方法。
用于纳姆和(Nahm sums)的机器引导递推边界理论
专题命中 工具调用 :agent(abstract)
AI总结 该研究开发了机器引导的递推边界理论,结合符号搜索与Q学习发现关键结果,证明了Shi和Wang的猜想3.8,得到Zagier第十二个三阶秩示例对偶纳姆和的二阶递推与五单元证明。
Comments Comments Welcome!
基于物理学原理的材料人工智能用于可靠的材料发现
专题命中 工具调用 :AI agent(abstract)
AI总结 该研究提出PhysMat AI框架,整合物理知识用于材料发现,通过多领域示例说明其应用,还规划了从物理感知到自主AI的发展路线,助力可靠材料发现。
以精度和决断性为目标:采用双重停止准则的可靠序贯假设检验
专题命中 工具调用 :planning(abstract)
AI总结 该研究提出DPitG方法,结合精度目标与明确裁决,将PitG的不确定率从62%降至2%且零假阳性,符合预注册标准,适用于需可靠裁决的场景。
Comments Main section 17 pages and 9 figures, Seven Abstracts in 7 pages and 1 figure
TensorCast:大语言模型基础设施中缺失的张量管理层
专题命中 工具调用 :agent(abstract)
AI总结 该研究针对LLM基础设施中张量管理策略复用受阻的问题,提出TensorCast分布式张量管理层,将张量状态管理与计算逻辑解耦,在保持性能的同时提升多轮智能体工作负载的TTFT达93.2%。
生成式人工智能是否缩小了基于教育背景的生产力差距?来自随机实验的证据
专题命中 工具调用 :tool use(abstract)
AI总结 通过对1174名成年人的随机实验发现,生成式AI缩小了不同教育背景劳动者的任务执行生产力差距,且提升效果并非完全源于任务委托。
带一般涡量的水波的全密度退化驻点
专题命中 工具调用 :tool use(abstract)
AI总结 本文针对带一般涡量的二维行进重力水波,利用改进的Weiss型单调性公式与Almgren型频率公式,证明了严格双侧线性增长区域外不存在全密度退化驻点,并推广了旋转波的Stokes猜想。
Comments 26 Pages. Comments and suggestions are welcome
虚拟化环境中的GPU性能分析:一项案例研究
专题命中 工具调用 :tool use(abstract)
AI总结 本文针对当前性能工具不支持虚拟GPU(vGPU)的问题,提出一款兼容Intel GVT-g的新型性能分析工具,通过软件追踪技术收集数据并生成指标,助力识别vGPU虚拟机的性能瓶颈。
Comments 18 pages, 12 figures, 5 tables
Journal ref Future Internet 2024, 16, 72
面向自主公式化阿尔法发现:进化计算视角
专题命中 工具调用 :agentic(abstract)
AI总结 本文从进化计算视角,提出自动化公式化阿尔法发现的统一分析与评估框架,为开发可靠的自主阿尔法发现系统奠定基础。
面向KV缓存的互联网:在大语言模型推理时代重新思考经典基础设施边界
专题命中 工具调用 :tool-use(abstract)
AI总结 该研究提出面向KV缓存的互联网愿景,主张跨云与数据中心解耦计算与KV缓存存储,将KV缓存管理作为内容分发系统,以最小化大语言模型推理的延迟与成本。
从微观认知到自我建构:人机交互中心理学理论的四层整合综述
专题命中 工具调用 :tool use(abstract)
AI总结 本文针对HCI从“工具使用”向“心智共生”的范式转变,提出四层整合心理学理论框架,明确其对生成式AI等场景的启示及核心挑战与未来方向。
GRaTer-JAX:用于碎屑盘建模的加速软件包
专题命中 工具调用 :workflow(abstract)
AI总结 GRaTer-JAX是用于碎屑盘建模的Python软件包,结合GRaTer框架与JAX的高性能计算能力,提供强大高效的建模框架,能统一正向建模等工作流程,还能进行更高级建模,推动相关研究发展。
Comments 4 pages, 3 figures
CAP-DO:用于跨相关零和博弈的认证双预言机求解的学习上下文动作提议
专题命中 工具调用 :planning(abstract)
AI总结 研究针对解决一系列相关零和博弈问题,提出CAP-DO框架,通过离线训练排序器、在线提议动作集,结合学习与当前博弈确定输出,理论上保留认证保证且有限收敛,实验中在多规模基准测试里有更好表现。
Comments 10 pages, 5 figures
通过大规模数据集上的逆合成实现具有低损耗的单调谐元件加载像素化可调带通滤波器
专题命中 工具调用 :workflow(abstract)
AI总结 该论文提出三相逆设计流程合成可调像素化带通滤波器,先获取大规模数据集,经暴力搜索识别初始种子,再用直接二分搜索算法微调。考虑4G和5G频段目标,设计的滤波器实现28%调谐范围,且仅用单个变容二极管,是微波领域首次连续可重构逆设计演示。
Comments 4 pages, 4 figures
PerceptDrive:用于端到端自动驾驶的具有自适应专家路由的感知先验世界-动作建模
机构 * Tsinghua University(清华大学) ; AMap, Alibaba Group(高德软件有限公司,阿里巴巴集团)
专题命中 工具调用 :planning(abstract)
AI总结 研究针对自动驾驶中感知基础模型的问题,提出PerceptDrive框架,将教师提炼先验和观察潜变量输入可训练模型,经特定分支处理、先验保留及场景条件路由,实验表明其性能领先,证实相关方法的有效性及对先验的依赖。
当HTTP 402遇上区块链:新兴x402支付的风险
专题命中 工具调用 :AI agent(abstract)
AI总结 研究x402支付协议,通过系统研究确定促进者的安全规则,基于规则违规分析得出新攻击向量,提出半自动黑盒工具评估安全性,发现部署均有违规,还通过实证测量量化相关指标,揭示其安全风险。
Journal ref USENIX Security 2026
FARO:可行性感知机器人运动优化
机构 * Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich (TUM)(慕尼黑工业大学慕尼黑机器人与机器智能研究所) ; Institute for Advanced Study, Technical University of Munich(慕尼黑工业大学高级研究所) ; Carnegie Mellon University(卡内基梅隆大学) ; SIEMENS AG(西门子公司) ; Huawei-TUM joint laboratory(华为-慕尼黑工业大学联合实验室)
专题命中 工具调用 :planning(abstract)
AI总结 针对机器人在未知场景快速规划新行为的挑战,提出嵌套运动动力学框架,结合可行性引导树搜索和大语言模型采样策略,能改善搜索过程,生成的轨迹可用强化学习控制器跟踪,质量高可用于实际运动操作场景。