EDUKG: a Heterogeneous Sustainable K-12 Educational Knowledge Graph
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 17 pages, 8 figures
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 17 pages, 8 figures
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG、cs.PL
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to ACL 2021 Findings. GitHub repo with paper list at https://github.com/styfeng/DataAug4NLP ; Talk at https://www.youtube.com/watch?v=kNBVesKUZCk&ab_channel=StevenFeng ; Podcast at https://www.youtube.com/watch?v=qmqyT_97Poc&ab_channel=GradientFlow and https://thedataexchange.media/data-augmentation-in-natural-language-processing
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG
Comments The 36th ACM/SIGAPP Symposium on Applied Computing (SAC'21), 10 pages
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 6 pages. More details are shared at https://github.com/QData/TextAttack
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.LG
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG
利用大语言模型在学术知识图谱中进行语义查询处理
机构 * Australian National University(澳大利亚国立大学)
专题命中 仓库级理解 :repository(abstract,comments);分类 cs.CL、cs.AI
AI总结 本文提出利用大语言模型与学术知识图谱结合,提升语义查询处理的准确性和效率,以改进学术研究中的知识管理与发现。
Comments for the associated repository, see http://w3id.org/kgcp/KGQP
专题命中 仓库级理解 :code generation(abstract,comments);分类 cs.SE、cs.AI
Comments 15 pages, 5 figures, research paper on multi-agent LLM systems for code generation
专题命中 仓库级理解 :repository(abstract,comments);分类 cs.AI、cs.LG
Comments Code repository: https://github.com/aailab-uct/Automated-Robust-and-Reproducible-Voice-Pathology-Detection, Supplementary materials: https://doi.org/10.5281/zenodo.14793017
专题命中 仓库级理解 :repository(abstract,comments);分类 cs.CL、cs.AI
Comments Ongoing work. Compared to the first version, several references have been added and a GitHub repository link has been provided
专题命中 仓库级理解 :repository(abstract,comments);分类 cs.AI、cs.LG
Comments repository maintained at https://github.com/SuDIS-ZJU/awesome-tabular-data-augmentation
Skillware:用于持久行为工件的软件本体与工程生命周期
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI
AI总结 研究针对智能体技能成为持久行为工件却缺乏相关软件本体的问题,引入Skillware,通过Skill Artifact和Skillware Unit管理工件,阐述相关条件与证据,为智能体能力提供可识别、可组合、可维护及可演化的软件本体与工程生命周期。
Comments 26 pages, 6 figures, 5 tables
SkillForge:面向项目特定问题解决的自蒸馏智能体
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI
AI总结 SkillForge是一种主动从代码库获取项目特定知识的自蒸馏框架,通过合成问题蒸馏技能,可提升LLM智能体解决特定代码库软件问题的性能。
Comments Our code and data are available at https://github.com/cslsolow/SkillForge
信任并不足够:智能体强化学习中策略内自蒸馏的影响校准
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI
AI总结 针对策略内自蒸馏的信任-效用不匹配问题,提出ICSD方法,在多基准任务上提升语言智能体性能,降低反向令牌的教师支持占比并提高梯度兼容性。
从BERT到前沿智能体:八年语言模型进展、能力-成本曲线的崩溃及任务定向模型的兴起
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG
AI总结 该文梳理2018-2026年语言模型进展,发现2024年末后编码能力年提升近6倍、能力-成本曲线崩溃,专用模型成趋势,Qwen 2.5数学测试及置信度工具验证了相关结论,研究材料全公开。
ReCodeAgent:一种多智能体工作流用于语言无关的大规模仓库翻译与验证
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Amazon(亚马逊)
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.LG
AI总结 ReCodeAgent通过多智能体方法实现大规模仓库代码翻译与验证的语言无关性,提升翻译正确率并降低成本,验证其效率和设计影响。
Comments Published in ASE 2026
REVERE:面向科学工作流的反思性进化研究工程师
机构 * TCS Research(TCS研究) ; Yale University(耶鲁大学)
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI
AI总结 REVERE通过全局训练上下文学习和反思优化框架,提升科研编码任务性能,实现4.50%、3.51%和4.89%的提升。
Comments Published as a conference paper at COLM 2026
LLM智能体工厂:领域特定大语言模型智能体的检索
机构 * Sber AI ; Moscow Institute of Physics and Technology(莫斯科物理技术学院) ; National University of Science and Technology MISIS(莫斯科国立科学技术大学MISIS) ; Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究所) ; Artificial Intelligence Research Institute(人工智能研究所)
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI
AI总结 本研究提出LLM Agents Factory框架,通过检索2万余个预设智能体配置文件按需构建领域特定智能体,在多基准测试中实现高准确率与低推理成本,为工业应用提供动态智能体生成的替代方案。
Comments 7 pages, 1 figure, SIGIR 2026
SkillClaw: 让技能与代理进化者共同进化
机构 * DreamX Team(DreamX团队)
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI
AI总结 SkillClaw通过聚合多用户交互数据,实现技能的集体进化,提升代理在现实场景中的性能。
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG
Comments Under Review
Journal ref ACM CSUR 2026
SkillTrace:面向LLM智能体技能复用的多溯源审计
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG
AI总结 本文提出SKILLTRACE框架,通过提取三种溯源审计LLM智能体技能复用,在SKILLTRACE-BENCH上取得高指标,野外审计显示其能生成更具操作性的复用审查队列。
基于拓扑的不完整知识图谱推理与图基软提示
机构 * Chalmers University of Technology and University of Gothenburg, Sweden(楚姆勒大学技术学院和哥德堡大学,瑞典) ; Technical University of Denmark, Kgs. Lyngby, Denmark(丹麦技术大学,基斯勒吕辛,丹麦)
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI
AI总结 本文提出基于图的软提示框架,通过图神经网络编码子图生成软提示,使LLM在更丰富的结构上下文中推理,减少缺失边的影响,提升多跳KBQA性能。
Comments 17 pages, 2 figures
代理AI技能的正式分析与供应链安全
机构 * Independent Research(独立研究)
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI
AI总结 SkillFortify是首个用于代理技能供应链的形式化分析框架,通过六大贡献提升安全性和检测效率。
Comments 32 pages, 5 theorems with full proofs, 68 references, open-source tool: https://github.com/qualixar/skillfortify
激活是真实存在的,且存在于读出层:循环深度推理器中的潜在组成、难度驱动的激活以及由界面构成的提交
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG
AI总结 本研究验证潜在推理模型的“组成激活”为真实计算,复现30M参数循环深度推理器,发现激活存在于读出层,决策时边际跃升,隐藏状态方向突变后冻结,撤回早期速度低谷声明。
Comments 9 pages, 2 figures, 3 tables
AgentGUI:用于观测与调控长期运行AI智能体的界面
机构 * ETH Zürich(苏黎世联邦理工学院)
专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI
AI总结 针对AI智能体观测与调控的界面缺失问题,研究人员推出AgentGUI,通过轨迹可视化、手动自动调控等功能提升智能体任务处理效率,成果已开源。
MambaTS:用于长期时间序列预测的改进型选择性状态空间模型
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG
AI总结 MambaTS是基于线性扫描的改进型选择性状态空间模型,以Mamba为骨干,通过VAST和TMB等技术解决LTSF问题,在8个公开数据集上取得了优异预测性能。
Comments Accepted by Pattern Recognition 2026
AiFlow:面向流式大语言模型应用的带界背压令牌原生反应式编排框架
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI
AI总结 针对现有流式LLM工作流编排的背压等管理缺陷,提出AiFlow令牌原生反应式编排模型,经实验验证可降低应用TTFPT并控制队列深度。
Comments 24 pages, 5 figures, 12 tables, 1 algorithm, and 1 code listing. Public implementation: https://github.com/ModelEngine-Group/fit-framework
RadYOLO:面向CT和MRI的计算高效型3D目标检测与分割方法
机构 * Fraunhofer Institute for Digital Medicine MEVIS(弗劳恩霍夫数字医学MEVIS研究所)
专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG
AI总结 本文提出针对医学图像的YOLO11 3D扩展模型RadYOLO,通过与nnU-Net、nnDetection在5个CT/MRI数据集上对比,证实其检测性能与推理速度均具优势,适配临床及边缘设备部署需求。
单一文化的搭便车指南
专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI
AI总结 研究通过Kaggle竞赛提交代码,探讨人工智能编码助手对代码的影响,采用多种方法在不同层面研究代码同质化,发现句法有显著同质化,语义同质化不明显,表明编码助手规范了实现细节但未使方法和策略趋同。