ReCode: Updating Code API Knowledge with Reinforcement Learning
ReCode: 通过强化学习更新代码API知识
专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI
AI总结 ReCode通过强化学习方法提升LLMs在动态API环境下的代码生成能力,尤其在CodeUpdateArena任务中表现优异。
Comments AAAI 2026
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
ReCode: 通过强化学习更新代码API知识
专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.CL、cs.AI
AI总结 ReCode通过强化学习方法提升LLMs在动态API环境下的代码生成能力,尤其在CodeUpdateArena任务中表现优异。
Comments AAAI 2026
利用Tsetlin机约束搜索空间的可扩展贝叶斯网络结构学习
机构 * Department of ICT University of Agder(信息与通信技术系阿格德大学)
专题命中 代码评测 :repository(abstract);分类 cs.LG
AI总结 本文提出利用Tsetlin机约束搜索空间,以提高贝叶斯网络结构学习的效率和准确性。
LLM-CSEC: 对大型语言模型生成的C/C++代码安全性的实证评估
机构 * Independent Researcher(独立研究者) ; Newcastle University(新castle大学)
专题命中 代码评测 :code generation(abstract);分类 cs.AI
AI总结 本研究评估了大型语言模型生成的C/C++代码安全性,发现存在大量漏洞,强调开发人员需谨慎使用此类代码。
大型语言模型的源代码去学习
专题命中 代码评测 :code generation(abstract);分类 cs.SE
AI总结 本研究提出PROD方法,通过精确去学习源代码中的违规片段,提升代码生成的可靠性与安全性。
Comments Accepted to AAAI'26
ORIGAMISPACE:基于数学约束的多模态大语言模型多步空间推理基准测试
机构 * Fudan University(复旦大学) ; SII ; INF Technology(INF技术)
专题命中 代码评测 :code generation(abstract);分类 cs.AI
AI总结 ORIGAMISPACE通过折纸任务评估多模态大语言模型在多步空间推理和数学约束处理中的能力,提出四个评估任务并探索强化学习训练方法。
基于元形态规范变异代理的LLM编码
专题命中 代码评测 :code generation(abstract);分类 cs.SE
AI总结 CodeMetaAgent通过元形态关系驱动LLM代理,提升代码生成准确性与覆盖率,有效解决规范不一致问题。