arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 3944 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 3944 篇

2606.14470 2026-06-23 cs.AI cs.CL cs.LG 新提交 67%

GitOfThoughts: Version-Controlled Reasoning and Agent Memory You Can Replay, Diff, and Merge

GitOfThoughts: 版本控制的推理与可回放、差异比较和合并的智能体记忆

Pavan C Shekar, Abhishek H S, Aswanth Krishnan

机构 * QpiAI

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出GitOfThoughts框架,将智能体推理树存储为git仓库,实现推理的可回放、审计和合并;实验表明,对于新问题,任何记忆格式均不能可靠提升准确率,仅当检索案例与当前问题高度相似(>0.8)时才有显著提升,且收益来自答案检索而非方法迁移。

Comments 10 pages, 1 figure, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06492 2026-06-05 cs.SE cs.AI cs.CL 67%

Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolution

Code2LoRA:用于软件演化下代码语言模型的超网络生成适配器

Liliana Hotsko, Yinxi Li, Yuntian Deng, Pengyu Nie

机构 * University of Waterloo(滑铁卢大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 提出Code2LoRA超网络框架,通过生成仓库特定的LoRA适配器注入仓库知识,无需推理时令牌开销,支持静态和演化两种场景,在RepoPeftBench上达到与逐仓库LoRA相当或更优的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31264 2026-06-01 cs.AI cs.CL cs.LG 67%

COLLEAGUE.SKILL: Automated AI Skill Generation via Expert Knowledge Distillation

COLLEAGUE.SKILL: 通过专家知识蒸馏实现自动化AI技能生成

Tianyi Zhou, Dongrui Liu, Leitao Yuan, Jing Shao, Xia Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出一个从异构痕迹到可检查、可修正、可代理使用的技能包的自动化蒸馏系统,用于生成基于人的AI技能。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04671 2026-06-01 cs.AI cs.LG cs.LO cs.PL 67%

ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving

ProofWala: 多语言证明数据合成与定理证明框架

Amitayush Thakur, George Tsoukalas, Greg Durrett, Swarat Chaudhuri

机构 * University of Texas, Austin, USA(得克萨斯大学奥斯汀分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG、cs.PL

AI总结 提出ProofWala框架,通过itp-interface库实现与交互式定理证明器的程序化交互,支持多语言证明数据合成、并行证明搜索,并验证了跨语言与跨领域迁移的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17626 2026-04-21 cs.AI cs.CL cs.SE 67%

Toward Reusability of AI Models Using Dynamic Updates of AI Documentation

迈向通过动态更新AI文档提高AI模型重用性

Peter Bajcsy, Walid Keyrouz

机构 * Hugging Face AI consortium

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文提出通过动态更新AI文档模板,缩短AI模型卡片更新滞后时间,提升AI模型重用性。

Comments 28 pages, 16 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06212 2026-04-09 cs.SE cs.AI cs.CL 67%

Code Sharing In Prediction Model Research: A Scoping Review

预测模型研究中的代码共享:一项范围综述

Thomas Sounack, Raffaele Giancotti, Catherine A. Gao, Lasai Barreñada, Hyeonhoon Lee, Hyung-Chul Lee, Leo Anthony Celi, Karel G. M. Moons, Gary S. Collins, Charlotta Lindvall, Tom Pollard

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文通过综述预测模型研究中的代码共享现状,发现代码共享率随时间增加,但普遍存在可重现实体不足的问题,为TRIPOD-Code扩展提供实证基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27277 2026-03-31 cs.SE cs.AI cs.PL 67%

Codebase-Memory: Tree-Sitter-Based Knowledge Graphs for LLM Code Exploration via MCP

基于MCP的代码库记忆:通过Tree-Sitter构建的知识图谱用于LLM代码探索

Martin Vogel, Falk Meyer-Eschenbach, Severin Kohler, Elias Grünewald, Felix Balzer

机构 * Independent Researcher, Berlin, Germany(独立研究者,柏林,德国) Institute of Medical Informatics, Charité – Universitätsmedizin Berlin, Berlin, Germany(柏林夏里特医学院医学信息学研究所,柏林,德国) Clinical Study Center, Berlin Institute of Health, Berlin, Germany(柏林健康研究所临床研究中心,柏林,德国) Institute of Informatics, Humboldt University, Berlin, Germany(柏林洪堡大学信息学研究所,柏林,德国) Institute of Informatics, Freie Universität Berlin, Berlin, Germany(柏林自由大学信息学研究所,柏林,德国) Health Data Science Unit, University Hospital Heidelberg, Heidelberg, Germany(海德堡大学医院健康数据科学部,海德堡,德国)

专题命中 仓库级理解 :coding agent(abstract);分类 cs.SE、cs.AI、cs.PL

AI总结 Codebase-Memory通过MCP协议构建Tree-Sitter知识图谱,提升LLM代码探索效率,实现更高准确性与更低资源消耗。

Comments 10 pages, 5 authors, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16733 2026-03-18 cs.AI cs.CL cs.SE 67%

IQuest-Coder-V1 Technical Report

IQuest-Coder-V1 技术报告

Jian Yang, Wei Zhang, Shawn Guo, Zhengmao Ye, Lin Jing, Shark Liu, Yizhi Li, Jiajun Wu, Cening Liu, X. Ma, Yuyang Song, Siwei Wu, Yuwen Li, L. Liao, T. Zheng, Ziling Huang, Zelong Huang, Che Liu, Yan Xing, Renyuan Li, Qingsong Cai, Hanxu Yan, Siyue Wang, Shikai Li, Jason Klein Liu, An Huang, Yongsheng Kang, Jinxing Zhang, Chuan Hao, Haowen Wang, Weicheng Gu, Ran Tao, Mingjie Tang, Peihao Wu, Jianzhou Wang, Xianglong Liu, Weifeng Lv, Bryan Dai

机构 * IQuest Coder Team(IQuest Coder团队)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

AI总结 本文介绍IQuest-Coder-V1系列模型,通过代码流多阶段训练范式提升软件逻辑动态演化能力,结合预训练、中训练和后训练阶段,实现代码智能在代理软件工程、编程竞赛和复杂工具使用中的先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13258 2026-03-17 cs.LG cs.AI cs.SE 67%

Your Code Agent Can Grow Alongside You with Structured Memory

你的代码代理可以与你一同成长,借助结构化记忆

Yi-Xuan Deng, Xiaoqin Liu, Yi Zhang, Guo-Wei Yang, Shuojin Yang

机构 * Tsinghua University(清华大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 本文提出MemCoder框架,通过结构化记忆和实时反馈实现人类与AI的持续共进化,提升代码代理在复杂软件工程任务中的性能。

Comments Code Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09071 2026-02-11 cs.SE cs.AI cs.LG 67%

DRAGON: Robust Classification for Very Large Collections of Software Repositories

DRAGON:用于非常大规模软件仓库集合的鲁棒分类

Stefano Balla, Stefano Zacchiroli, Thomas Degueule, Jean-Rémy Falleri, Romain Robbes

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 DRAGON通过利用版本控制系统中的轻量信号实现对大规模软件仓库的鲁棒分类,提升分类准确率并释放大规模开源数据集用于未来研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05568 2026-02-03 cs.CL cs.AI cs.LG 67%

Large Multimodal Models for Low-Resource Languages: A Survey

大规模多模态模型在低资源语言中的应用:综述

Marian Lupascu, Ana-Cristina Rogoz, Mihai Sorin Stupariu, Radu Tudor Ionescu

机构 * Department of Computer Science, University of Bucharest(布加勒斯特大学计算机科学系)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文综述了大规模多模态模型在低资源语言中的应用,分析了适应技术及挑战,提供了方法导向的贡献比较和开放源代码资源。

Comments Accepted in Information Fusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22887 2026-02-02 cs.LG cs.AI cs.CL cs.CV 67%

MoVE: Mixture of Value Embeddings -- A New Axis for Scaling Parametric Memory in Autoregressive Models

MoVE:价值嵌入的混合——扩展自回归模型参数内存的新轴

Yangyan Li

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MoVE通过引入价值嵌入的混合机制,实现了自回归模型参数内存的独立扩展,提升了文本和图像生成任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18454 2026-01-16 cs.CL cs.AI cs.LG 67%

Fairness Definitions in Language Models Explained

语言模型中的公平性定义解析

Zhipeng Yin, Zichong Wang, Avash Palikhe, Wenbin Zhang

机构 * Florida International University(佛罗里达国际大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文系统解析了语言模型中公平性定义的分类与应用,介绍了现有公平性概念及新分类方法,通过实验探讨其实际影响,旨在推动公平性研究的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14716 2026-01-06 cs.LG cs.AI cs.CL 67%

A Systematic Survey on Large Language Models for Algorithm Design

大型语言模型在算法设计中的系统性调研

Fei Liu, Yiming Yao, Ping Guo, Zhiyuan Yang, Zhe Zhao, Xi Lin, Xialiang Tong, Kun Mao, Zhichao Lu, Zhenkun Wang, Mingxuan Yuan, Qingfu Zhang

机构 * City University of Hong Kong(香港城市大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Xi'an Jiaotong University(西安交通大学) Huawei Cloud EI Service Product Dept.(华为云EI服务产品部) Southern University of Science(南方科技大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文系统性地综述了大型语言模型在算法设计中的应用,提出分类法分析其角色并指出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00726 2025-12-17 cs.SE cs.AI cs.LG 67%

Free and Customizable Code Documentation with LLMs: A Fine-Tuning Approach

基于LLM的免费且可定制的代码文档生成:一种微调方法

Sayak Chakrabarty, Souradip Pal

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Northwestern University(西北大学) School of Electrical & Computer Engineering(电气与计算机工程学院) Purdue University(普渡大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

AI总结 本文提出一种基于LLM的免费代码文档生成工具,通过微调方法解决现有开源应用在成本和可定制性上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04146 2025-12-16 cs.LG cs.AI cs.CL 67%

Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models

超越单个令牌预测:扩散模型与自回归语言模型性能的对比分析

Minseo Kim, Coleman Hooper, Aditya Tomar, Chenfeng Xu, Mehrdad Farajtabar, Michael W. Mahoney, Kurt Keutzer, Amir Gholami

机构 * Seoul National University(首尔国立大学) University of California, Berkeley(加州大学伯克利分校) ICSI LBNL(劳伦斯伯克利国家实验室) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 仓库级理解 :code generation(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文比较了扩散模型与自回归语言模型在性能上的差异,发现DLMs在算术强度上占优但难以扩展,而ARMs在批量推理中表现更优。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01225 2025-10-30 cs.CE cs.AI cs.CL cs.SE 67%

Utilizing Modern Large Language Models (LLM) for Financial Trend Analysis and Digest Creation

Andrei Lazarev, Dmitrii Sedov

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

Comments This is the version of the article accepted for publication in SUMMA 2024 after peer review. The final, published version is available at IEEE Xplore: 10.1109/SUMMA64428.2024.10803746

Journal ref 2024 6th International Conference on Control Systems, Mathematical Modeling, Automation and Energy Efficiency (SUMMA), Lipetsk, Russian Federation, 2024, pp. 317-321

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10806 2025-10-22 cs.CL cs.AI cs.IR cs.LG 67%

Is Implicit Knowledge Enough for LLMs? A RAG Approach for Tree-based Structures

Mihir Gupte, Paolo Giusto, Ramesh S

机构 * General Motors(通用汽车公司)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Waiting for Conference Response

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05567 2025-10-02 cs.CL cs.AI cs.LG 67%

ATLAS: Autoformalizing Theorems through Lifting, Augmentation, and Synthesis of Data

Xiaoyang Liu, Kangjie Bao, Jiashuo Zhang, Yunqi Liu, Yu Chen, Yuntian Liu, Yang Jiao, Tao Luo

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07006 2025-09-10 cs.CY cs.AI cs.CL cs.LG 67%

ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code

Kapil Madan

机构 * Principled Evolution(原则进化)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 53 pages, 7 figures, 8 tables. Open-source implementation available at: https://github.com/Principled-Evolution/argen-demo. Work explores the integration of policy-as-code for AI alignment, with a case study in culturally-nuanced, ethical AI using Dharmic principles

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19485 2025-08-21 cs.DC cs.AI cs.LG cs.SE 67%

Action Engine: Automatic Workflow Generation in FaaS

Akiharu Esashi, Pawissanutt Lertpongrujikorn, Shinji Kato, Mohsen Amini Salehi

机构 * University of North Texas (UNT)(北卡罗来纳州立大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

Comments Published in the Future Generation Computer Systems (FGCS) journal; Source code is available at: https://github.com/hpcclab/action_engine

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00255 2025-08-08 cs.CL cs.AI cs.MA cs.SE 67%

SciReplicate-Bench: Benchmarking LLMs in Agent-driven Algorithmic Reproduction from Research Papers

Yanzheng Xiang, Hanqi Yan, Shuyin Ouyang, Lin Gui, Yulan He

机构 * King’s College London(伦敦国王学院) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21899 2025-07-30 cs.AI cs.LG cs.SE 67%

LLM-based Content Classification Approach for GitHub Repositories by the README Files

Malik Uzair Mehmood, Shahid Hussain, Wen Li Wang, Muhammad Usama Malik

机构 * Department of Computing and Built Environment(计算与环境系) Birmingham City University(伯明翰城市大学) Department of Computer Science and Software Engineering(计算机科学与软件工程系) School of Engineering(工程学院) Penn State University, Behrend, Erie PA(宾夕法尼亚州立大学贝伦分校,埃里普斯帕州) Department of Electrical Engineering(电气工程系) UET Taxila(塔希尔工程大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI、cs.LG

Comments 8 pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18115 2025-07-25 cs.AI cs.CL cs.CY cs.ET cs.LG 67%

Agentic AI framework for End-to-End Medical Data Inference

Soorya Ram Shimgekar, Shayan Vassef, Abhay Goyal, Navin Kumar, Koustuv Saha

机构 * University of Illinois - Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Illinois - Chicago(伊利诺伊大学芝加哥分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 5 figures, 2 tables, BIBM conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21567 2025-07-03 cs.CL cs.AI cs.LG 67%

BioPars: A Pretrained Biomedical Large Language Model for Persian Biomedical Text Mining

Baqer M. Merzah, Tania Taami, Salman Asoudeh, Saeed Mirzaee, Amir reza Hossein pour, Amir Ali Bengari

机构 * Department of Computer Science, Faculty of Education, University of Kufa(计算机科学系,教育学院,科菲大学) Department of Computer Science, Florida State University(计算机科学系,佛罗里达州立大学) Department of Computer Engineering, Velayat University(计算机工程系,瓦莱yat大学) Department of Mechanical Engineering, Amirkabir University of Technology(机械工程系,阿米卡比尔技术大学) Department of Computer Engineering, Ferdowsi University of Mashhad(计算机工程系,法尔德大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04227 2025-06-18 cs.HC cs.AI cs.CL cs.LG 67%

Agent Laboratory: Using LLM Agents as Research Assistants

Samuel Schmidgall, Yusheng Su, Ze Wang, Ximeng Sun, Jialian Wu, Xiaodong Yu, Jiang Liu, Michael Moor, Zicheng Liu, Emad Barsoum

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09340 2025-06-12 cs.CL cs.AI cs.LG 67%

RePO: Replay-Enhanced Policy Optimization

Siheng Li, Zhanhui Zhou, Wai Lam, Chao Yang, Chaochao Lu

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Project Page: https://github.com/SihengLi99/RePO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24715 2025-06-02 cs.LG cs.AI cs.CL 67%

CoRet: Improved Retriever for Code Editing

Fabio Fehr, Prabhu Teja Sivaprasad, Luca Franceschi, Giovanni Zappella

机构 * EPFL(苏黎世联邦理工学院) Idiap Research Institute(伊迪亚普研究机构) AWS AI Labs(亚马逊AI实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06426 2025-05-30 cs.CR cs.AI cs.CL cs.LG 67%

SequentialBreak: Large Language Models Can be Fooled by Embedding Jailbreak Prompts into Sequential Prompt Chains

Bijoy Ahmed Saiem, MD Sadik Hossain Shanto, Rakib Ahsan, Md Rafi ur Rashid

机构 * Bangladesh University of Engineering and Technology(孟加拉工程科技大学) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17178 2025-05-28 cs.CL cs.AI cs.LG 67%

Tuning LLM Judge Design Decisions for 1/1000 of the Cost

David Salinas, Omar Swelam, Frank Hutter

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏