arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 12194 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 1744 篇

2404.14851 2025-03-05 cs.IR cs.AI cs.CL 62%

From Matching to Generation: A Survey on Generative Information Retrieval

Xiaoxi Li, Jiajie Jin, Yujia Zhou, Yuyao Zhang, Peitian Zhang, Yutao Zhu, Zhicheng Dou

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15770 2025-03-04 cs.SE cs.AI 62%

Performance Review on LLM for solving leetcode problems

Lun Wang, Chuanqi Shi, Shaoshui Du, Yiyi Tao, Yixian Shen, Hang Zheng, Yanxin Shen, Xinyu Qiu

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11432 2025-03-04 cs.AI cs.CL 62%

A Survey on Large Language Model based Autonomous Agents

Lei Wang, Chen Ma, Xueyang Feng, Zeyu Zhang, Hao Yang, Jingsen Zhang, Zhiyuan Chen, Jiakai Tang, Xu Chen, Yankai Lin, Wayne Xin Zhao, Zhewei Wei, Ji-Rong Wen

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments Correcting several typos, 35 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20806 2025-03-03 cs.SE cs.AI 62%

Multimodal Learning for Just-In-Time Software Defect Prediction in Autonomous Driving Systems

Faisal Mohammad, Duksan Ryu

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.AI

Comments 9

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14543 2025-03-03 cs.AI cs.LG 62%

Towards consistency of rule-based explainer and black box model -- fusion of rule induction and XAI-based feature importance

Michał Kozielski, Marek Sikora, Łukasz Wawrowski

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11068 2025-03-03 cs.AI cs.CL 62%

Show, Don't Tell: Evaluating Large Language Models Beyond Textual Understanding with ChildPlay

Gonçalo Hora de Carvalho, Oscar Knap, Robert Pollice

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20175 2025-02-28 cs.AI cs.CL 62%

An Extensive Evaluation of PDDL Capabilities in off-the-shelf LLMs

Kaustubh Vyas, Damien Graux, Sébastien Montella, Pavlos Vougiouklis, Ruofei Lai, Keshuang Li, Yang Ren, Jeff Z. Pan

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19149 2025-02-27 cs.SE cs.CL 62%

Isolating Language-Coding from Problem-Solving: Benchmarking LLMs with PseudoEval

Jiarong Wu, Songqiang Chen, Jialun Cao, Hau Ching Lo, Shing-Chi Cheung

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16704 2025-02-25 cs.CL cs.AI 62%

Code Summarization Beyond Function Level

Vladimir Makharev, Vladimir Ivanov

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments Accepted to LLM4Code @ ICSE'25; 8 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14752 2025-02-21 cs.CL cs.LG 62%

TritonBench: Benchmarking Large Language Model Capabilities for Generating Triton Operators

Jianling Li, Shangzhan Li, Zhenye Gao, Qi Shi, Yuxuan Li, Zefan Wang, Jiacheng Huang, Haojie Wang, Jianrong Wang, Xu Han, Zhiyuan Liu, Maosong Sun

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07835 2025-02-13 cs.SE cs.AI 62%

Bridging LLM-Generated Code and Requirements: Reverse Generation technique and SBC Metric for Developer Insights

Ahilan Ayyachamy Nadar Ponnusamy

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03166 2025-02-11 cs.CL cs.LG 62%

Semantic Captioning: Benchmark Dataset and Graph-Aware Few-Shot In-Context Learning for SQL2Text

Ali Al-Lawati, Jason Lucas, Prasenjit Mitra

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.LG

Journal ref COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08068 2025-02-11 cs.LG cs.AI 62%

WildGraph: Realistic Graph-based Trajectory Generation for Wildlife

Ali Al-Lawati, Elsayed Eshra, Prasenjit Mitra

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 7 figures, SIGSPATIAL '24

Journal ref SIGSPATIAL 2024: Proceedings of the 32nd ACM International Conference on Advances in Geographic Information System

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19012 2025-02-03 cs.LG cs.CL cs.CR 62%

Importing Phantoms: Measuring LLM Package Hallucination Vulnerabilities

Arjun Krishna, Erick Galinkin, Leon Derczynski, Jeffrey Martin

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18243 2025-01-31 stat.AP cs.CL cs.LG 62%

Statistical multi-metric evaluation and visualization of LLM system predictive performance

Samuel Ackerman, Eitan Farchi, Orna Raz, Assaf Toledo

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10483 2025-01-23 cs.CL cs.AI 62%

ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature

Aarush Sinha, Viraj Virk, Dipshikha Chakraborty, P. S. Sreeja

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18989 2025-01-22 cs.SE cs.AI 62%

How Propense Are Large Language Models at Producing Code Smells? A Benchmarking Study

Alejandro Velasco, Daniel Rodriguez-Cardenas, Luftar Rahman Alif, David N. Palacio, Denys Poshyvanyk

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02901 2025-01-07 cs.SE cs.PL 62%

DeCon: Detecting Incorrect Assertions via Postconditions Generated by a Large Language Model

Hao Yu, Tianyu Chen, Jiaming Huang, Zongyang Li, Dezhi Ran, Xinyu Wang, Ying Li, Assaf Marron, David Harel, Yuan Xie, Tao Xie

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.PL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02573 2025-01-07 cs.LG cs.CL cs.MS 62%

LeetDecoding: A PyTorch Library for Exponentially Decaying Causal Linear Attention with CUDA Implementations

Jiaping Wang, Simiao Zhang, Qiao-Chu He, Yifan Chen

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.LG

Comments The source code of LeetDecoding is hosted at https://github.com/Computational-Machine-Intelligence/LeetDecoding

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15204 2025-01-06 cs.CL cs.AI 62%

LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks

Yushi Bai, Shangqing Tu, Jiajie Zhang, Hao Peng, Xiaozhi Wang, Xin Lv, Shulin Cao, Jiazheng Xu, Lei Hou, Yuxiao Dong, Jie Tang, Juanzi Li

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments 26 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21151 2024-12-31 cs.LG cs.AI 62%

PyG-SSL: A Graph Self-Supervised Learning Toolkit

Lecheng Zheng, Baoyu Jing, Zihao Li, Zhichen Zeng, Tianxin Wei, Mengting Ai, Xinrui He, Lihui Liu, Dongqi Fu, Jiaxuan You, Hanghang Tong, Jingrui He

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14764 2024-12-20 cs.SE cs.AI 62%

CodeRepoQA: A Large-scale Benchmark for Software Engineering Question Answering

Ruida Hu, Chao Peng, Jingyi Ren, Bo Jiang, Xiangxin Meng, Qinyun Wu, Pengfei Gao, Xinchen Wang, Cuiyun Gao

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12649 2024-12-18 cs.CL cs.AI 62%

ClustEm4Ano: Clustering Text Embeddings of Nominal Textual Attributes for Microdata Anonymization

Robert Aufschläger, Sebastian Wilhelm, Michael Heigl, Martin Schramm

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 5 figures, accepted for presentation at IDEAS: 2024 28th International Symposium on Database Engineered Applications, Bayonne, France, August 26-29, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06807 2024-12-18 cs.CL cs.SE 62%

Execution-Based Evaluation of Natural Language to Bash and PowerShell for Incident Remediation

Ngoc Phuoc An Vo, Brent Paulovicks, Vadim Sheinin

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07000 2024-12-12 cs.LG cs.AI 62%

Extreme AutoML: Analysis of Classification, Regression, and NLP Performance

Edward Ratner, Elliot Farmer, Brandon Warner, Christopher Douglas, Amaury Lendasse

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13611 2024-12-11 cs.SE cs.AI 62%

DSTC: Direct Preference Learning with Only Self-Generated Tests and Code to Improve Code LMs

Zhihan Liu, Shenao Zhang, Yongfei Liu, Boyi Liu, Yingxiang Yang, Zhaoran Wang

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00800 2024-12-10 cs.LG cs.AI 62%

A Comprehensive Guide to Explainable AI: From Classical Models to LLMs

Weiche Hsieh, Ziqian Bi, Chuanqi Jiang, Junyu Liu, Benji Peng, Sen Zhang, Xuanhe Pan, Jiawei Xu, Jinlang Wang, Keyu Chen, Pohsun Feng, Yizhu Wen, Xinyuan Song, Tianyang Wang, Ming Liu, Junjie Yang, Ming Li, Bowen Jing, Jintao Ren, Junhao Song, Hong-Ming Tseng, Yichao Zhang, Lawrence K. Q. Yan, Qian Niu, Silin Chen, Yunze Wang, Chia Xin Liang

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18932 2024-12-02 cs.CL cs.AI cs.CV 62%

ScratchEval: Are GPT-4o Smarter than My Child? Evaluating Large Multimodal Models with Visual Programming Challenges

Rao Fu, Ziyang Luo, Hongzhan Lin, Zhen Ye, Jing Ma

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10310 2024-11-26 cs.CL cs.AI 62%

TEG-DB: A Comprehensive Dataset and Benchmark of Textual-Edge Graphs

Zhuofeng Li, Zixing Gou, Xiangnan Zhang, Zhongyuan Liu, Sirui Li, Yuntong Hu, Chen Ling, Zheng Zhang, Liang Zhao

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12990 2024-11-21 cs.AI cs.LG 62%

BetterBench: Assessing AI Benchmarks, Uncovering Issues, and Establishing Best Practices

Anka Reuel, Amelia Hardy, Chandler Smith, Max Lamparth, Malcolm Hardy, Mykel J. Kochenderfer

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments Accepted as a Spotlight Poster to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏