arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

2026-08-26 至 2026-08-26 共收录 11 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码生成 5 篇

2607.08010 2026-08-26 cs.CL cs.LG cs.SE 版本更新 67%

Tool-Making and Self-Evolving LLM Agents in Low-Latency Systems

低延迟系统中的工具制作与自我进化大语言模型智能体

Kalle Kujanpää, Ning Liu, Shahnawaz Alam, Yeshwanth Reddy Sura, Tianyu Yang, Kristina Klinkner, Shervin Malmasi

机构 * Amazon(亚马逊)

专题命中 代码生成 :code generation(abstract);分类 cs.SE、cs.CL、cs.LG

AI总结 研究如何解决生产LLM智能体因重复生成代码浪费延迟和可靠性的问题,提出用智能工具制作管道取代推理时编码循环,部署该方法使系统更快、更可靠、易操作,降低延迟和错误率,提高可审计性。

Comments To appear at EMNLP 2026 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23200 2026-08-26 cs.CL 版本更新 57%

LongWoF-Bench: Evaluating EvoMap Genes for Verifiable Long-Workflow Tasks

LongWoF-Bench:评估用于可验证长工作流任务的EvoMap基因

Xiao Zhang, Qumeng Sun, Jiahao Li, Yiming Ren, Xiang Liu, Haoyang Zhang, Junjie Wang

机构 * EvoMap Tsinghua University(清华大学)

专题命中 代码生成 :code generation(abstract);分类 cs.CL

AI总结 该研究提出LongWoF-Bench基准,发现通过EvoMap将验证的执行轨迹转化为可复用的Gene,能显著提升多模型在长工作流任务上的表现,且优于Skill和参考蒸馏的Gene。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08405 2026-08-26 cs.AI physics.flu-dyn 版本更新 57%

Self-Evolving Scientific Agent Designs Physically-Reasoned Whitebox Fluid Control

自进化科学智能体发现可泛化的物理推理流体控制

Boai Sun, Wenjin Guo, Zongmin Yu, Liu Yang

机构 * National University of Singapore(新加坡国立大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 提出一种由大语言模型驱动的自进化科学智能体工作流,通过迭代代码生成和物理仿真诊断,自动构建可解释的控制器,并在欠驱动双关节狗鲨游泳器目标到达任务中实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11578 2026-08-26 cs.AI 版本更新 57%

Efficient LLM Collaboration via Planning

通过规划实现高效的LLM协作

Byeongchan Lee, Jonghoon Lee, Dongyoung Kim, Jaehyung Kim, Kyungjoon Park, Dongjun Lee, Jinwoo Shin

机构 * KAIST(韩国科学技术院) Yonsei University(延世大学)

专题命中 代码生成 :code generation(abstract);分类 cs.AI

AI总结 本文提出COPE框架,通过规划模型与执行模型的协作,提升小模型和大模型在复杂任务中的性能,同时显著降低推理成本。

Comments Accepted at TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00704 2026-08-26 cs.LG 版本更新 57%

QiMeng-ChipV-RTL: Exploiting Information Locality for IP-level Verilog Generation

LocalV: 利用信息局部性进行IP级Verilog生成

Hanqi Lyu, Di Huang, Yaoyu Zhu, Kangcheng Liu, Bohan Dou, Chongxiao Li, Pengwei Jin, Shuyao Cheng, Rui Zhang, Zidong Du, Qi Guo, Xing Hu, Yunji Chen

机构 * University of Science(科学大学) SKL of Processors, Institute of Computing Technology, CAS(处理器研究所,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 代码生成 :code generation(abstract);分类 cs.LG

AI总结 LocalV通过利用模块化硬件设计中的信息局部性,解决IP级Verilog生成中的长文档处理、长代码生成和调试挑战,实现更高的生成准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 代码评测 3 篇

2606.29717 2026-08-26 cond-mat.mtrl-sci cs.AI cs.LG 版本更新 62%

Optimizing Expert-Designed Crystal Graph Networks for Band-Gap Prediction with an Autonomous LLM Research Loop

利用自主LLM研究循环优化专家设计的晶体图网络用于带隙预测

Chenmu Zhang, Boris I. Yakobson

机构 * Department of Materials Science and NanoEngineering(材料科学与纳米工程系)

专题命中 代码评测 :coding agent(abstract);分类 cs.AI、cs.LG

AI总结 提出一个自主LLM研究循环,在MatBench带隙基准上构建了无需外部预训练的最准确模型,超越了所有17个专家设计模型,通过实现元素对特征和空间群嵌入等已知方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16497 2026-08-26 cs.LG cs.AI 版本更新 62%

msData: A Millisecond-Resolution Network Dataset for Advancing Time Series Foundation Models

弥合高频数据缺口:一种毫秒级分辨率的网络数据集以推进时间序列基础模型

Subina Khanal, Seshu Tirupathi, Merim Dzaferagic, Marco Ruffini, Torben Bach Pedersen

机构 * Department of Computer Science, Aalborg University, Aalborg, Denmark(奥尔堡大学计算机科学系) IBM Research Europe, Dublin, Ireland(IBM欧洲研究院) Trinity College Dublin, The University of Dublin, Dublin, Ireland(都柏林大学三一学院)

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个毫秒级分辨率的数据集,用于提升时间序列基础模型对高频数据的处理能力,并展示传统模型在该数据集上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16520 2026-08-26 cs.CV cs.AI cs.CL 版本更新 62%

TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning

TangramPuzzle: 通过组合空间推理评估多模态大语言模型

Daixian Liu, Jiayi Kuang, Yinghui Li, Yangning Li, Di Yin, Haoyu Cao, Xing Sun, Ying Shen, Hai-Tao Zheng, Liang Lin, Philip S. Yu

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙逸人大学) Tencent Youtu Lab(腾讯优图实验室) University of Illinois Chicago(伊利诺伊大学香槟分校)

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

AI总结 TangramPuzzle通过几何基准测试评估多模态大语言模型的组合空间推理能力,发现模型在匹配轮廓时忽视几何约束,导致碎片变形。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 仓库级理解 3 篇

2607.12634 2026-08-26 cs.AI 版本更新 57%

Atomic Units of X: The Compression Layer of Intelligence

X的原子单位:智能的压缩层

Sachin Dev Duggal, Pradyumna Swarnalatha Ramanna, Alexandros Vassiliades

机构 * SeKondBrain AI Labs(第二大脑人工智能实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 该论文提出将智能视为原子压缩与组合复用过程的理论框架,借助多学科证据阐述原子单位概念,给出压缩演算等核心方法,为设计自进化知识系统奠基,为智能相关多方面提供统一视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17723 2026-08-26 cs.CV 版本更新 50%

Implicit Neural Representation-Based Continuous Single Image Super-Resolution: An Empirical Benchmark

基于隐式神经表示的连续单图像超分辨率:一项实证研究

Tayyab Nasir, Daochang Liu, Ajmal Mian

机构 * The University of Western Australia(西澳大学)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文通过实证研究探讨了隐式神经表示在连续单图像超分辨率中的有效性,揭示了训练配置对性能的关键影响,并提出了一种增强纹理保真的新损失函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16855 2026-08-26 cs.CV 版本更新 50%

Stack Transformer Based Spatial-Temporal Attention Model for Dynamic Sign Language and Fingerspelling Recognition

基于堆叠Transformer的动态手语与手指拼写识别时空注意力模型

Koki Hirooka, Abu Saleh Musa Miah, Tatsuya Murakami, Md. Al Mehedi Hasan, Yong Seok Hwang, Jungpil Shin

机构 * School of Computer Science and Engineering, The University of Aizu(计算机科学与工程学院,秋田大学) Research Institute for Electronic Science (RIES), Hokkaido University(电子科学研究所(RIES),北海道大学) Department of Electronics Engineering, Kwangwoon University(电子工程系,高阳大学)

专题命中 仓库级理解 :repository(abstract)

AI总结 本文提出序列时空注意力网络(SSTAN),在WLASL、JSL、KSL数据集上验证其性能,该模型无需预定义图结构,在手指拼写类别及仅骨骼数据的WLASL任务中达到SOTA,数据效率高。

Comments This paper has been published in the IEEE Open Journal of the Computer Society. DOI: https://doi.org/10.1109/OJCS.2026.3682330

详情

展开后加载摘要…

URL PDF HTML 收藏