Program Synthesis from Visual Specification
专题命中 代码生成 :program synthesis(title,abstract);分类 cs.AI、cs.PL
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
专题命中 代码生成 :program synthesis(title,abstract);分类 cs.AI、cs.PL
专题命中 代码生成 :program synthesis(title,abstract);分类 cs.AI、cs.PL
Comments 16 pages (without citations); Literature Review
专题命中 代码生成 :code generation(title,abstract);分类 cs.CL、cs.AI
Comments 5 pages, 1 figure, 3 tables
专题命中 代码生成 :program synthesis(title,abstract);分类 cs.AI、cs.PL
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE、cs.PL
Comments In Proceedings Festschrift for Dave Schmidt, arXiv:1309.4557
Journal ref EPTCS 129, 2013, pp. 419-428
专题命中 代码生成 :program synthesis(title,abstract);分类 cs.LG、cs.PL
AuditCoder:用于可审计代码生成与有界修复的责任保留任务图
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE;repository(comments)
AI总结 AuditCoder通过带契约注释的任务图为代码生成保留责任标识,结合保守定位器与有界修复,在APPS、ClassEval数据集上取得优于CoT+重试的可审计代码生成效果。
Comments Preprint. 37 pages, 5 figures. Code and data are available at the project repository
专题命中 代码生成 :program synthesis(title,abstract);分类 cs.LG;repository(comments)
Comments There was a typo in Figure 1 (a step in the Lemma solution was accidentally included twice). Additionally, our final experiment runs have MathDSL using one less step for this question, and ConPoLe using one more step to differentiate a division and a fraction in its final solution. Figure 1 has been updated to provide an exact copy of the experiment runs in the GitHub repository
行为规范引导的二进制代码反混淆程序合成
专题命中 代码生成 :program synthesis(title,abstract);分类 cs.SE
AI总结 针对二进制反混淆领域的局限,本文提出BinMirror方法,将二进制反混淆转化为行为规范引导的程序合成任务,在150万个合成混淆二进制文件上的评估显示其性能优于现有基线,单元测试Pass@1达74.5%。
PRAXIS:面向领域代码生成的基于图的默会知识
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 PRAXIS框架通过模拟人类开发工作流提取代码依赖图上的默会知识,提升智能体领域代码生成性能,优于现有方法且可适配多种智能体框架与大语言模型
编码智能体作为世界模拟器
机构 * Department of Mechanical & Aerospace Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校机械与航空航天工程系) ; School of Computer, Data, and Information Sciences, University of Wisconsin-Madison(威斯康星大学麦迪逊分校计算机、数据与信息科学学院)
专题命中 代码生成 :coding agent(title);code generation(abstract);分类 cs.AI
AI总结 提出一个通过可执行模拟代码构建基于物理的世界模型的智能体框架,协调规划、代码生成、视觉审查和物理分析智能体,迭代修正代码以满足物理约束,在物理准确性、指令忠实度和视觉质量上超越视频模型。
SeqFeed:通过顺序行为反馈改进智能体RTL代码生成
专题命中 代码生成 :code generation(title,abstract);分类 cs.CL
AI总结 针对智能体RTL代码生成的时序信息传递难题,本研究提出含SeQuery和SeGraph机制的SeqFeed,通过满足三项反馈要求提升LLM的RTL代码生成通过率。
用于Verilog代码生成的大型语言模型:文献综述与未来方向
机构 * Zhejiang University \& Northwestern Polytechnical University China ; Northwestern Polytechnical University China ; Nantong University China ; Zhejiang University China ; Monash University Australia ; Singapore Management University Singapore ; Zhejiang University \& Northwestern Polytechnical University ; Northwestern Polytechnical University ; Nantong University ; Zhejiang University ; Monash University ; Singapore Management University
专题命中 代码生成 :code generation(title,abstract);分类 cs.AI
AI总结 本文综述了LLMs在Verilog代码生成中的应用,分析了现有方法的有效性、局限性及未来研究方向。
Comments Accept in ACM Computing Surveys
当前谁主导?用于图表转代码生成的令牌级模态仲裁
专题命中 代码生成 :code generation(title,abstract);分类 cs.AI
AI总结 提出MoCA模型,通过CAB分离视觉与编码能力并动态仲裁贡献,经两阶段训练后在三个基准测试中取得与同类模型相当的图表转代码性能。
SimuScene: 通过训练和基准测试代码生成来模拟物理场景
专题命中 代码生成 :code generation(title,abstract);分类 cs.LG
AI总结 SimuScene通过训练和基准测试代码生成模型,旨在提高模拟物理场景的能力,实验显示即使最强模型也仅达21.5%的通过率,表明该任务具有挑战性。
GraphAlignCoder:对齐程序与证明图的代码生成框架
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 GraphAlignCoder是将显式正确性结构迁移至代码生成的训练框架,通过对齐程序与证明图提升性能,在多个基准测试中优于现有方法,验证图注入与验证到代码的整合是关键。
Comments 9 pages, 3 figures
安全测试作为LLM代码生成的可执行规范:益处、权衡与覆盖范围限制
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 该研究提出将安全测试作为LLM代码生成的可执行规范,开发SecTDD框架,通过多维度评估发现预先展示可见测试可提升联合成功率,结构化反馈修复效果更优但益处受多因素影响。
BashCoder-R1: 面向鲁棒且可解释的Bash代码生成——鲁棒感知组相对策略优化
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 提出BashCoder-R1框架,结合持续预训练、长思维链监督微调和鲁棒感知组相对策略优化,在BashBench基准上实现高语法通过率、低鲁棒警告率和功能完整率,显著超越DeepSeek-V3.2。
Comments Accepted to ISSTA 2026
Pseudo2CodeQA:面向基于大语言模型的代码生成中结构化算法推理的基准测试
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 本文提出Pseudo2Code基准测试及Pseudo2Code Agentic Framework,实验表明该框架性能优于现有基线,验证了结构化伪代码对代码生成的提升作用。
Comments 8 pages, 3 figures
理解与改进用于安全代码生成的模型编辑
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 本研究系统探究模型编辑用于安全代码生成,提出SafeEdit方法缓解模型编辑的安全与功能权衡,其与CoSec结合可提升安全代码生成性能。
Comments ISSTA 2026
CodeChemist:通过测试时扩展实现低资源代码生成的功能知识迁移
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 提出CodeChemist框架,通过合成测试用例将模型功能知识从高资源语言迁移到低资源语言,无需训练,显著提升低资源语言代码生成性能。
Comments This paper is accepted by ICML 2026
CodeAssay:带有审计基准真值的多指标大语言模型代码生成基准
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 本文提出CodeAssay基准,涵盖185个Python任务,结合多类测试与度量,经审计后发现模型正确性标签有9.0%变化,且验证了多类LLM代码生成的评估特性。
TaPR:面向反馈条件代码生成的感知测试策略优化
专题命中 代码生成 :code generation(title,abstract);分类 cs.AI
AI总结 该研究针对代码智能体强化学习中反馈利用不足的问题,提出TaPR框架,通过将执行反馈转换为密集每轮测试通过率奖励,在219个代码问题上提升了多轮代码生成成功率。
Comments 9 pages, 3 figures, 3 tables. Aofan Liu and Jingxiang Meng contributed equally; Fangxin Liu and Yongbiao Chen are corresponding authors
合成轨迹反映真实的奖励黑客行为吗?对监控真实世界代码生成中黑客行为的系统研究
机构 * Peking University(北京大学) ; University of California, Los Angeles(加州大学洛杉矶分校) ; Arena ; University of Maryland(马里兰大学) ; Mohamed bin Zayed University of Artificial Intelligence(莫莫迪 bin Zayed 人工智能大学)
专题命中 代码生成 :code generation(title,abstract);分类 cs.LG
AI总结 本文研究合成轨迹与真实世界中代码生成奖励黑客行为的差异,通过对比监控器在合成与真实数据上的表现,发现合成数据训练的监控器无法泛化到真实黑客行为,而真实数据训练的监控器对未见过的黑客类型更具泛化能力。
Comments Corrected a typo in the title; no other changes
结构化安全审计:在LLM生成代码的正确性与内容安全之间平衡
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 本文提出NLSafety-Utility Duality Score和Dual Reasoning,通过结构化安全审计和任务导向的代码审查,提升LLM生成代码的安全性和正确性,实验显示其在多个模型上显著提升SUDS评分。
Comments 13 pages. Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026). Artifact: https://doi.org/10.5281/zenodo.19245736
Artisan: 自动化代理评估
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 Artisan通过自动化LLM代理生成重现脚本,提升软件工程研究结果的可重复性,生成44/60个有效脚本并发现20个新错误。
Comments Accepted at ASE 2026
CoGate:用于安全代码生成的置信门控协同解码
专题命中 代码生成 :code generation(title,abstract);分类 cs.SE
AI总结 针对现有协同解码未考虑专家模型置信度的问题,提出CoGate方法,在多LLM后端和代码生成基准上优于CoSec+,在CWEval的Func-Sec@10指标最高提升12.6%。
更好地调用Grep:评估和改进用于仓库级代码补全的类Grep词汇检索方法
专题命中 代码生成 :repository(title,abstract);分类 cs.SE
AI总结 本文评估改进类Grep词汇检索,提出Naive GrepRAG基线,又结合后处理流水线的GrepRAG在代码补全任务上优于SOTA,为轻量检索支撑仓库级代码补全提供方案。
Comments ISSTA2026
海报:通过现实世界风险场景重新思考大语言模型代码生成中的安全性
专题命中 代码生成 :code generation(title,abstract);分类 cs.AI
AI总结 研究LLM代码生成的安全行为,识别出三种风险场景,构建含2700个测试用例的基准评估安全性,发现先进LLMs平均漏洞率超56%,证明安全感知提示可大幅降低风险。
MKEvolve:用于内核代码生成的模块化多智能体框架
专题命中 代码生成 :code generation(title,abstract);分类 cs.AI
AI总结 针对硬件加速器内核代码生成瓶颈,MKEvolve框架通过迭代共同进化PyTorch模块分解与子模块内核,经拆分融合优化分解并以束搜索改进子内核,实验证明其在正确性、加速及减少LLM令牌使用上有优势。