arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2025-11-27 至 2025-11-27 共收录 14 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 4 篇

2510.15585 2025-11-27 cs.SE cs.CL cs.PL 78%

Leveraging Test Driven Development with Large Language Models for Reliable and Verifiable Spreadsheet Code Generation: A Research Framework

利用大型语言模型进行测试驱动开发以实现可靠且可验证的电子表格代码生成:一种研究框架

Simon Thorne, Advait Sarkar

专题命中 代码生成 :code generation(title);分类 cs.SE、cs.CL、cs.PL

AI总结 本文提出一种结合测试驱动开发与大型语言模型的框架,以提高电子表格代码生成的可靠性与准确性。

Comments 16 pages

Journal ref Proceedings of the EuSpRIG 2025 Conference "Spreadsheet Productivity & Risks" ISBN : 978-1-905404-60-5

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07850 2025-11-27 cs.CL cs.AI cs.DB cs.LG 78%

Bring Your Own KG: Self-Supervised Program Synthesis for Zero-Shot KGQA

自带知识图谱:零样本知识图谱问答的自监督程序合成

Dhruv Agarwal, Rajarshi Das, Sopan Khosla, Rashmi Gangadharaiah

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) AWS AI Labs(AWS人工智能实验室)

专题命中 代码生成 :program synthesis(title);分类 cs.CL、cs.AI、cs.LG

AI总结 BYOKG通过自监督程序合成实现零样本知识图谱问答,利用探索机制和LLM生成查询程序,提升问答准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20987 2025-11-27 math.CO cs.AI cs.LG cs.NE 62%

Even with AI, Bijection Discovery is Still Hard: The Opportunities and Challenges of OpenEvolve for Novel Bijection Construction

即使有AI,双射发现仍然困难:OpenEvolve在新型双射构造中的机遇与挑战

Davis Brown, Jesse He, Helen Jenne, Henry Kvinge, Max Vargas

专题命中 代码生成 :program synthesis(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了OpenEvolve在双射构造中的应用,发现尽管AI有潜力,但寻找新颖双射仍具挑战性,需人类数学家参与。

Comments 16 pages, 3 figures. This is an extended abstract submitted to FPSAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20656 2025-11-27 cs.HC cs.AI 57%

Context-Aware Visual Prompting: Automating Geospatial Web Dashboards with Large Language Models and Agent Self-Validation for Decision Support

基于上下文的视觉提示:利用大语言模型和代理自我验证自动化地理空间网络看板

Haowen Xu, Jose Tupayachi, Xiao-Ying Yu

机构 * Computational Urban Sciences Group, Oak Ridge National Laboratory(计算城市科学组,橡树岭国家实验室) Materials Science and Technology Division, Oak Ridge National Laboratory(材料科学与技术 division,橡树岭国家实验室) Industrial and Systems Engineering, The University of Tennessee, Knoxville(工业与系统工程,田纳西大学, Knoxville)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型和代理自我验证的地理空间看板自动化框架,通过上下文感知视觉提示提升风险分析和决策支持的可视化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 1 篇

2509.01010 2025-11-27 cs.RO math.AG 50%

Analytical Solvers for Common Algebraic Equations Arising in Kinematics Problems

运动学问题中常见代数方程的解析求解器

Hai-Jun Su

专题命中 软件智能体 :coding agent(abstract)

AI总结 本文提出四种常见代数方程的解析求解器,用于机器人运动学问题,提供闭式表达式、数值算法和鲁棒性考虑,并通过Python实现和示例提示展示其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 程序修复 1 篇

2511.20090 2025-11-27 cs.AR cs.AI 70%

R3A: Reliable RTL Repair Framework with Multi-Agent Fault Localization and Stochastic Tree-of-Thoughts Patch Generation

R3A:一种可靠的RTL修复框架,结合多智能体故障定位和随机树状思维补丁生成

Zizhang Luo, Fan Cui, Kexing Zhou, Runlin Guo, Mile Xia, Hongyuan Hou, Yun Liang

机构 * Peking University(北京大学) Beihang University(北航)

专题命中 程序修复 :program repair(abstract);program synthesis(abstract);分类 cs.AI

AI总结 R3A通过多智能体故障定位和随机树状思维补丁生成方法,有效提高了RTL修复的可靠性,修复率高达90.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 测试生成 2 篇

2511.20403 2025-11-27 cs.SE cs.AI 76%

LLMs for Automated Unit Test Generation and Assessment in Java: The AgoneTest Framework

基于大型语言模型的Java自动化单元测试生成与评估:AgoneTest框架

Andrea Lops, Fedelucio Narducci, Azzurra Ragone, Michelantonio Trizio, Claudio Bartolini

机构 * University of Bari, Bari, Italy(巴里大学)

专题命中 测试生成 :unit test generation(title);分类 cs.SE、cs.AI

AI总结 AgoneTest框架通过标准化评估流程,评估大型语言模型生成的Java单元测试质量,展示其在覆盖率和缺陷检测上的表现,并探讨提示策略对测试质量的影响。

Comments Accepted at 40th IEEE/ACM International Conference on Automated Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11659 2025-11-27 cs.CV 50%

DWFF-Net : A Multi-Scale Farmland System Habitat Identification Method with Adaptive Dynamic Weight

DWFF-Net:一种多尺度农田系统栖息地识别方法,具有自适应动态权重

Kesong Zheng, Zhi Song, Peizhou Li, Shuyi Yao, Zhenxing Bian

专题命中 测试生成 :repository(abstract)

AI总结 DWFF-Net通过自适应动态权重融合多尺度特征,提升农田栖息地识别精度与细粒度监测能力

Comments 30 pages,13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 代码评测 4 篇

2511.20955 2025-11-27 cs.SE cs.AI 62%

SpaceX: Exploring metrics with the SPACE model for developer productivity

SpaceX:探索SPACE模型用于开发者生产力的度量

Sanchit Kaul, Kevin Nhu, Jason Eissayou, Ivan Eser, Victor Borup

机构 * University Of California, Davis(加州大学戴维斯分校)

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.AI

AI总结 SpaceX研究通过SPACE模型探索开发者生产力的多维度量,揭示负面情绪与提交频率的正相关性,并提出复合生产力分数以解决开发者效能异质性问题。

Comments Code available at https://github.com/knhu/ECS260Project

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21380 2025-11-27 cs.SE 57%

Multi-Agent Systems for Dataset Adaptation in Software Engineering: Capabilities, Limitations, and Future Directions

多智能体系统在软件工程数据集适应中的应用:能力、限制与未来方向

Jingyi Chen, Xiaoyan Guo, Songqiang Chen, Shing-Chi Cheung, Jiasi Shen

专题命中 代码评测 :code generation(abstract);分类 cs.SE

AI总结 本文研究了多智能体系统在软件工程数据集适应中的能力与限制,发现提示干预能显著提升适应效果,为未来更可靠的智能体发展提供方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01658 2025-11-27 cs.CL 57%

A Survey on Inference Engines for Large Language Models: Perspectives on Optimization and Efficiency

对大型语言模型推理引擎的综述:优化与效率的视角

Sihyeong Park, Sungryeol Jeon, Chaelyn Lee, Seokhun Jeon, Byung-Soo Kim, Jemin Lee

机构 * Korea Electronics Technology Institute(韩国电子技术研究所) Electronics and Telecommunications Research Institute(电子电信研究院)

专题命中 代码评测 :repository(abstract);分类 cs.CL

AI总结 本文综述了大型语言模型推理引擎的优化与效率,评估了25种开源和商用引擎,探讨了其设计目标及生态系统成熟度,并提供未来研究方向和公开存储库。

Comments Under review; 106 pages; 46 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21130 2025-11-27 math.NA cs.NA 50%

Numerical Performance of the Implicitly Restarted Arnoldi Method in OFP8, Bfloat16, Posit, and Takum Arithmetics

在OFP8、bfloat16、posit和takum算术中隐式重启Arnoldi方法的数值性能

Laslo Hunhold, James Quinlan, Stefan Wesner

专题命中 代码评测 :repository(abstract)

AI总结 本文评估了OFP8、bfloat16、posit和takum算术中隐式重启Arnoldi方法的数值性能,发现takum算术表现优于posit,而bfloat16在float16上表现更优,OFP8则不适合通用计算。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 仓库级理解 1 篇

2511.19142 2025-11-27 cs.LO cs.FL 56%

Formalizing Computational Paths and Fundamental Groups in Lean

在Lean中形式化计算路径与基本群

Arthur F. Ramos, Anjolina G. de Oliveira, Ruy J. G. B. de Queiroz, Tiago M. L. de Veras

专题命中 仓库级理解 :repository(abstract,comments)

AI总结 本文在Lean 4中形式化了计算路径理论,并通过六个代数拓扑例子展示了其在同伦计算中的应用。

Comments 27 pages, 2 figures. All definitions and proofs are available in the ComputationalPathsLean GitHub repository

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他AI编程 1 篇

2511.20654 2025-11-27 cs.HC cs.AI 57%

CodeVaani: A Multilingual, Voice-Based Code Learning Assistant

CodeVaani:一种多语言、基于语音的代码学习助手

Jayant Havare, Srikanth Tamilselvam, Ashish Mittal, Shalaka Thorat, Soham Jadia, Varsha Apte, Ganesh Ramakrishnan

机构 * Indian Institute of Technology Bombay(印度理工学院班加罗尔分校) IBM Research(IBM研究院)

专题命中 其他AI编程 :code model(abstract);分类 cs.AI

AI总结 CodeVaani通过多语言语音交互帮助非英语母语学生更高效地学习编程,实现75%的响应准确率和高用户满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏