arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2025-12-24 至 2025-12-24 共收录 6 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 1 篇

2512.20328 2025-12-24 cs.SE cs.AI cs.LG 67%

Toward Explaining Large Language Models in Software Engineering Tasks

向软件工程任务解释大型语言模型

Antonio Vitale, Khai-Nguyen Nguyen, Denys Poshyvanyk, Rocco Oliveto, Simone Scalabrino, Antonio Mastropaolo

机构 * University of Molise \& Politecnico di Torino Termoli Italy University of Molise Italy University of Molise \& Politecnico di Torino University of Molise

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 FeatureSHAP为软件工程任务提供首个自动化、模型无关的可解释性框架,通过Shapley值归因模型输出,提升代码生成和总结任务的解释性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 1 篇

2512.20482 2025-12-24 cs.SE cs.AI 62%

SweRank+: Multilingual, Multi-Turn Code Ranking for Software Issue Localization

SweRank+: 多语言、多轮次代码排名用于软件问题定位

Revanth Gangi Reddy, Ye Liu, Wenting Zhao, JaeHyeok Doo, Tarun Suresh, Daniel Lee, Caiming Xiong, Yingbo Zhou, Semih Yavuz, Shafiq Joty

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Salesforce AI Research(Salesforce AI研究院) KAIST AI(韩国科学技术院AI研究中心)

专题命中 软件智能体 :repository(abstract);分类 cs.SE、cs.AI

AI总结 SweRank+结合跨语言代码排名工具和代理搜索设置,实现多轮次的代码库推理,提升多语言软件问题定位的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 程序修复 1 篇

2510.06187 2025-12-24 cs.SE cs.AI cs.CY 81%

Automated Program Repair of Uncompilable Student Code

不可编译学生代码的自动化程序修复

Griffin Pitts, Aum Pandya, Darsh Rank, Tirth Bhatt, Muntasir Hoq, Bita Akram

机构 * North Carolina State University(北卡罗来纳州立大学)

专题命中 程序修复 :program repair(title,abstract);分类 cs.SE、cs.AI

AI总结 本研究利用大型语言模型修复不可编译的学生代码,以保留其结构意图,从而提升学生建模和知识追踪的分析能力。

Comments In Proceedings of the 57th ACM Technical Symposium on Computer Science Education V.2 (SIGCSE TS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 代码评测 2 篇

2512.20159 2025-12-24 cs.SE cs.AI 62%

AXIOM: Benchmarking LLM-as-a-Judge for Code via Rule-Based Perturbation and Multisource Quality Calibration

AXIOM:通过基于规则的扰动和多源质量校准构建LLM-as-a-Judge代码评估基准

Ruiqi Wang, Xinchen Wang, Cuiyun Gao, Chun Yong Chong, Xin Xia, Qing Liao

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Monash University Malaysia(墨尔本大学马来西亚分校) Zhejiang University(浙江大学)

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

AI总结 AXIOM通过基于规则的扰动和多源质量校准构建代码评估基准,以实现高质量代码评分的平衡分布和可靠评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10927 2025-12-24 cs.CR 50%

VeriFuzzy: A Dynamic Verifiable Fuzzy Search Service for Encrypted Cloud Data

VeriFuzzy:一种动态可验证模糊搜索服务用于加密云数据

Jie Zhang, Xiaohong Li, Man Zheng, Ruitao Feng, Shanshan Xu, Zhe Hou, Guangdong Bai

专题命中 代码评测 :repository(abstract)

AI总结 VeriFuzzy通过整合增强虚拟二叉树、区块链重构验证和双仓库状态管理,实现了高效且安全的动态可验证模糊搜索服务。

Comments 15 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 仓库级理解 1 篇

2511.21878 2025-12-24 cs.SE cs.PL 81%

Advancing Automated In-Isolation Validation in Repository-Level Code Translation

在仓库级代码翻译中推进自动化独立验证

Kaiyao Ke, Ali Reza Ibrahimzada, Rangeet Pan, Saurabh Sinha, Reyhaneh Jabbarvand

专题命中 仓库级理解 :repository(title,abstract);分类 cs.SE、cs.PL

AI总结 TRAM通过结合上下文感知的类型解析与基于模拟的独立验证,实现了高质量的编程语言间翻译,尤其在Java到Python的翻译中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏