From Research Questions to Columns: Operationalization-Aware Data Discovery
从研究问题到列:感知操作化的数据发现
专题命中 代码评测 :repository(abstract)
AI总结 该研究提出感知操作化的数据发现(OADD)任务,构建基准OADD-Bench,评估多种方法后发现OADD仍是未解决问题,其中OADD定向智能体表现最佳。
Comments 6 pages, 2 figures
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
从研究问题到列:感知操作化的数据发现
专题命中 代码评测 :repository(abstract)
AI总结 该研究提出感知操作化的数据发现(OADD)任务,构建基准OADD-Bench,评估多种方法后发现OADD仍是未解决问题,其中OADD定向智能体表现最佳。
Comments 6 pages, 2 figures
VespaSeg:一种用于指代表达分割的资源感知“先定位后分割”流水线
机构 * University of Moratuwa(莫拉图瓦大学)
专题命中 代码评测 :repository(abstract)
AI总结 本文针对指代表达分割中整体式模型部署成本高的问题,提出模块化流水线VespaSeg,采用轻量型视觉-语言模型定位与MobileSAM分割,经适配后在RefCOCO数据集上实现高精度,且内存占用低、推理速度快。
Comments 5 pages, 3 figures. Code and result artifacts: https://github.com/Savidilsh/VespaSeg
JUNO OMILREC顶点与能量重建的八倍等效保持加速
专题命中 代码评测 :coding agent(abstract)
AI总结 本研究针对JUNO的OMILREC重建算法,通过分阶段等效保持优化实现了最高8.6倍的单线程加速,保持物理输出一致,为大型探测器似然重建加速提供了可转移模板。
Comments 7 pages, 1 figure
在不信任服务器的情况下实施密码学分布式版本控制系统访问控制
专题命中 代码评测 :repository(abstract)
AI总结 针对现有分布式VCS访问控制需中央服务器参与、写权限细粒度控制缺失的问题,提出基于ABE和ABS的DVAC方案,借助以太坊智能合约实现无中央服务器的文件粒度读写访问控制,原型开销较小且可与Git集成。
Comments Accepted manuscript. 15 pages, 7 figures. Published in Journal of Information Security and Applications, Vol. 93 (2025), Article 104103
Journal ref Journal of Information Security and Applications, 93 (2025), 104103
WaspMOT:赤眼蜂长期多目标跟踪基准
机构 * Inria(法国国家信息与自动化技术研究院) ; INRAE Institut Sophia Agrobiotech(法国国家农业生物技术研究院) ; Université Côte d'Azur(蔚蓝海岸大学) ; Indian Institute of Technology Delhi(德里印度理工学院) ; Institute of Plant Protection, Chinese Academy of Agricultural Sciences(中国农业科学院植物保护研究所)
专题命中 代码评测 :repository(abstract)
AI总结 研究针对多目标跟踪在长期身份保持评估不足的问题,引入WaspMOT基准,通过对赤眼蜂长时间跟踪构建数据集,评估五种检测跟踪方法,发现都有轨迹碎片化问题,简单拼接基线可提升性能,揭示了现有方法局限。
Journal ref AVSS 2026
Nautilus:从一个提示到即插即用的机器人学习
机构 * TU Darmstadt(图宾根大学) ; KIT(卡尔斯鲁厄理工学院) ; FZI(弗劳恩霍夫研究所) ; Robotics Institute Germany(德国机器人研究所) ; Honda Research Institute Europe(本田欧洲研究院)
专题命中 代码评测 :coding agent(abstract)
AI总结 Nautilus通过单个提示生成可复现、评估、微调和部署的机器人学习工作流程,提供即插即用的代理技能集和统一接口,减少跨家族验证的工程负担。
绝不向漏洞妥协:人工智能治理综合调查
专题命中 代码评测 :repository(abstract)
AI总结 针对人工智能发展带来的技术漏洞及社会风险,提出整合技术与社会维度的框架,围绕三个支柱构建,通过系统回顾识别核心挑战,给出综合研究议程,为开发可靠且符合伦理的人工智能系统提供指导。
Comments 26 pages, 3 figures, accepted by SCIS2026
一般静态时空中光的半解析轨迹分析
专题命中 代码评测 :code model(abstract)
AI总结 提出一个统一的半解析框架,通过同伦摄动法、变分迭代法和脉冲近似法研究一般静态球对称时空中的零测地线和弱场光偏折,并应用于标量毛Reissner-Nordström黑洞,比较三种方法的精度和收敛性。
Comments 23 pages
Journal ref Nucl. Phys. B 1029, 117557 (2026)
SPECS:特定进化电路合成
专题命中 代码评测 :repository(abstract)
AI总结 提出用于自动模拟电路合成的SPECS遗传算法,借鉴NEAT原理,重新制定基因组表示并调整遗传算子,纳入布线约束和物种形成,在计算电路合成任务中,其解决方案质量和可靠性优于基准方法。
智能体技能安全:威胁模型、攻击、防御与评估
专题命中 代码评测 :repository(abstract)
AI总结 研究智能体可复用技能安全,提出SkillSec-Eval框架,刻画技能生命周期并开发威胁分类法,通过对327个真实技能实证评估,发现多阶段有漏洞,强调需进行生命周期感知安全分析。
全景场景分析:从畸变感知工程到球面原生基础建模的综述
机构 * University of Liverpool(利物浦大学) ; Xi’an Jiaotong-Liverpool University(西交利物浦大学)
专题命中 代码评测 :repository(abstract)
AI总结 本文综述全景场景分析从投影适应、畸变感知工程到球面原生建模的演进,指出当前方法无法同时实现严格球面等变性和重用预训练基础模型权重,并揭示评估协议中的五个系统性缺陷。
零设置量子电路模拟器的基准测试
专题命中 代码评测 :repository(abstract)
AI总结 该研究对GPU加速的MPS和PPS量子模拟方法进行基准测试,比较多个工具,发现MPS中GPU运行时随键维度次二次缩放,PPS中GPU在特定基准测试下加速显著且能达高精度,还提供模拟器特征描述及代码配置仓库。
Comments 12 pages, 12 figures
语言模型代理的上下文到执行完整性
专题命中 代码评测 :repository(abstract)
AI总结 研究语言模型代理执行中的上下文到执行完整性问题,提出CXI系统,通过策略标记、类型化释放等机制保障安全执行,经多方面评估,在AgentDojo和代码代理基准测试等中取得良好效果,确保权限绑定才允许执行。
Comments 20 pages
衡量无形:评估公共资金对开源软件的影响
专题命中 代码评测 :repository(abstract)
AI总结 研究公共资金对开源软件的影响,结合目标-问题-指标框架与广义合成控制法,估计主权科技基金对OSS仓库活动的因果效应,发现资金对项目速度指标有显著正向影响,为公共OSS资金评估框架设计提供实践启示。
扩展度量TSP的子游走松弛整数规划间隙计算
专题命中 代码评测 :repository(abstract)
AI总结 本文通过扩展子游走松弛的整数规划间隙验证,发现n=11和n=12时极端点列表不完整,并将极端点枚举扩展到14个顶点,为4/3猜想提供支持。
Comments We extended the enumeration to n=15 in the general case
动态空域管理用于不断演变的城市环境中的无人机:协同协调与人类安全
专题命中 代码评测 :repository(abstract)
AI总结 针对复杂城市环境中无人机安全运行难题,提出协作多无人机空域管理系统Pharos,介于分布式与集中式范式间,采用MAPPO算法,经仿真验证其有效协调能力及在减少人类恐惧、提升空间利用率方面优势。
从目标到应用:对齐音频自监督学习中的架构偏差
专题命中 代码评测 :repository(abstract)
AI总结 本文通过预训练目标、架构归纳偏差与下游应用的对齐,系统分析音频自监督学习,围绕五种范式讨论不同监督信号对表征的影响,并关联到CNN、RNN、状态空间模型、Transformer及混合架构的偏差,最后解读在语音、环境声、音乐、医学及多模态等领域的应用。
复杂度准度量空间上的扩展同胚
专题命中 代码评测 :repository(abstract)
AI总结 本文研究复杂度准度量空间上的扩展同胚理论,证明缩放变换在该空间上扩张当且仅当α≠1,并将轨道分离与经典时间层级定理联系起来。
MSU-Bench:面向对话多说话人场景中以说话人为中心的理解
专题命中 代码评测 :repository(abstract)
AI总结 提出MSU-Bench基准,包含16个说话人中心任务和2300个问答实例,用于评估多说话人对话中的说话人定位与推理能力,揭示现有模型在复杂场景下的不足。
Comments 4 pages, accepted by interspeech 2026
SoliDualSPHysics:一种用于固体力学的DualSPHysics扩展,支持超弹性、塑性及断裂
专题命中 代码评测 :repository(abstract)
AI总结 本文提出SoliDualSPHysics,一种基于SPH的开源软件,扩展DualSPHysics以模拟超弹性、有限应变塑性及脆性断裂行为,采用总拉格朗日格式,支持动态加载下的裂纹萌生与扩展,验证了其准确性和可扩展性。
Journal ref Computer Physics Communications 327 (2026) 110257
Human-on-the-Bridge: 可扩展的AI智能体评估方法
专题命中 代码评测 :code generation(abstract)
AI总结 提出Human-on-the-Bridge (HOB)范式,通过专家预先策划可复用的评估智能体(包括领域上下文、红队陷阱、陪审员角色等),结合ProofAgent测试框架进行多轮对抗评估,实现可扩展的AI智能体行为评估。
Comments 33 pages, 3 figures
3D高斯泼溅应用综述:分割、编辑与生成
机构 * Shanghai University of Finance and Economics(上海财经大学) ; University College London(伦敦大学学院) ; Xiamen University(厦门大学) ; Fudan University(复旦大学)
专题命中 代码评测 :repository(abstract)
AI总结 综述3D高斯泼溅在分割、编辑和生成三大任务中的应用,总结代表性方法、监督策略和学习范式,并分析公共基准上的比较结果。
Comments IEEE TPAMI, GitHub Repo: https://github.com/heshuting555/Awesome-3DGS-Applications
Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2026
自然环境中机器人感知的跨模态基准测试
机构 * CSIRO Robotics, CSIRO, Australia(CSIRO机器人研究所,CSIRO,澳大利亚) ; University of Sydney (USyd), Australia(悉尼大学(USyd),澳大利亚) ; Queensland University of Technology (QUT), Australia(昆士兰理工大学(QUT),澳大利亚)
专题命中 代码评测 :repository(abstract)
AI总结 针对自然环境中机器人感知的挑战,提出WildCross跨模态基准,用于大规模自然场景下的地点识别和度量深度估计,并扩展了度量深度估计实验。
Comments Accepted to the IEEE ICRA Workshop on Open Challenges for Rigorous Robot Perception 2026
unimpeded: 用于宇宙学模型比较和张力分析的公共嵌套采样链网格
专题命中 代码评测 :repository(abstract)
AI总结 发布公共Python库unimpeded,提供预计算嵌套采样和MCMC链,对8个宇宙学模型和39个数据集进行系统分析,发现ΛCDM模型最受青睐,并量化了DES与Planck、SH0ES与Planck之间的显著张力。
Comments 49 pages, 13 figures. Version 3: Revised in response to the JCAP editor's report. Added Section 3.2.12 on the treatment of nuisance parameters in the evidence and tension calculations. Results unchanged
ULMShare:用于微血管成像的大规模体内超声定位显微镜数据集
专题命中 代码评测 :repository(abstract)
AI总结 本文介绍ULMShare,一个包含99次全脑经颅超声定位显微镜采集的开放数据集,旨在为微血管成像方法开发、验证和基准测试提供标准化资源。
Abaqus中基于单元的平滑有限元方法的UEL实现
专题命中 代码评测 :repository(abstract)
AI总结 本文讨论了在商业有限元软件Abaqus中实现基于单元的平滑有限元方法(CSFEM)的方法。CSFEM的特点是不需要显式导出形状函数的导数,也不需要等参数映射。通过使用软件的用户元素子程序(UEL)功能实现了该方法。给出了输入数据格式的细节以及所提出的用户元素子程序,这是有限元分析的核心。通过解决线性弹性静力学问题的二维和三维基准问题来验证所提出的实现。开发的UEL和相关的输入文件可以从GitHub仓库下载:https://github.com/nsundar/SFEM_in_Abaqus。
Journal ref International Journal of Computational Methods, 2019
泰勒-迪菲方法用于奇异四面体积积分:用于离散化体积积分方程(VIE)求解器的加权伽辽金积分的高效评估
专题命中 代码评测 :code generation(abstract)
AI总结 本文提出一种高效准确的数值方法,用于计算四面体积域上六维奇异积分,适用于计算离散化体积积分方程求解器的加权伽辽金矩阵元素,通过扩展通用泰勒-迪菲策略,实现将六维奇异积分转化为低维非奇异积分,提升计算效率。
Comments 9 pages, 2 figures
一种用于切换系统鲁棒综合的反例引导框架使用控制证书
专题命中 代码评测 :program synthesis(abstract)
AI总结 本文提出通过生成
Comments The paper has been withdrawn by the author. The main reason is incorrect proof of Theorem 4 and some incorrect results in the evaluation parts due to some bugs in the code
公共部门LLM的提示应作为公共资源进行治理
专题命中 代码评测 :repository(abstract)
AI总结 本文提出公共部门部署大型语言模型时使用的提示应作为受治理的制品,而非私有临时输入,并设计了带版本控制、社区维护的提示模板仓库及协商集成方法。
Comments To appear in the Proceedings of the 43rd International Conference on Machine Learning (ICML 2026)
工业回收中的小目标检测:新数据集与YOLO性能评估
机构 * Mines Saint-Etienne, CNRS, UMR 5307 LGF(圣艾蒂安 Mines、法国国家科学研究中心、UMR 5307 LGF)
专题命中 代码评测 :repository(abstract)
AI总结 针对工业回收中小、密集、重叠目标的检测难题,本文提出新数据集并对比基于深度学习的监督方法,评估YOLO等系统的性能、精度与计算效率,同时探索数据增强与合成图像的优势。
Journal ref Journal of Electronic Imaging 2026