SecureCodeRL: Security-Aware Reinforcement Learning for Code Generation with Partial-Credit Rewards
SecureCodeRL: 为代码生成的具有安全意识的强化学习
专题命中 代码生成 :code generation(title,abstract)
AI总结 SecureCodeRL通过部分信用奖励提升代码生成的语法正确性和安全性,实现更高的测试通过率和更清洁的代码输出。
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
SecureCodeRL: 为代码生成的具有安全意识的强化学习
专题命中 代码生成 :code generation(title,abstract)
AI总结 SecureCodeRL通过部分信用奖励提升代码生成的语法正确性和安全性,实现更高的测试通过率和更清洁的代码输出。
因果一致性正则化:在大型语言模型中训练可验证的敏感推理
机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学) ; Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建筑与环境工程系,爱荷华州立大学)
专题命中 代码生成 :code generation(abstract);分类 cs.AI
AI总结 CSR通过强制因果一致性提升大语言模型的推理忠实性,实现更可靠的结构化领域推理。