arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 1740 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 1740 篇

2312.15223 2024-09-10 cs.SE 57%

A Survey on Large Language Models for Software Engineering

Quanjun Zhang, Chunrong Fang, Yang Xie, Yaxin Zhang, Yun Yang, Weisong Sun, Shengcheng Yu, Zhenyu Chen

专题命中 代码评测 :repository(abstract);分类 cs.SE

Comments updating 1009 papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03759 2024-09-09 cs.IR cs.AI 57%

VERA: Validation and Evaluation of Retrieval-Augmented Systems

Tianyu Ding, Adi Banerjee, Laurent Mombaerts, Yunhong Li, Tarik Borogovac, Juan Pablo De la Cruz Weinstein

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments Accepted in Workshop on Evaluation and Trustworthiness of Generative AI Models, KDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06732 2024-09-06 cs.SE 57%

Mining for sustainability in cloud architecture among the discussions of software practitioners: building a dataset

Sahar Ahmadisakha, Vasilios Andrikopoulos

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01374 2024-09-04 cs.AI 57%

H-ARC: A Robust Estimate of Human Performance on the Abstraction and Reasoning Corpus Benchmark

Solim LeGris, Wai Keen Vong, Brenden M. Lake, Todd M. Gureckis

专题命中 代码评测 :program synthesis(abstract);分类 cs.AI

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16535 2024-08-30 cs.LG 57%

TinyTNAS: GPU-Free, Time-Bound, Hardware-Aware Neural Architecture Search for TinyML Time Series Classification

Bidyut Saha, Riya Samanta, Soumya K. Ghosh, Ram Babu Roy

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12960 2024-08-26 cs.SE 57%

Measuring Code Efficiency Optimization Capabilities with ACEOB

Yue Pan, Xiuting Shao, Chen Lyu

专题命中 代码评测 :code model(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00109 2024-08-23 cs.LG cs.DC cs.DL 57%

FedAIoT: A Federated Learning Benchmark for Artificial Intelligence of Things

Samiul Alam, Tuo Zhang, Tiantian Feng, Hui Shen, Zhichao Cao, Dong Zhao, JeongGil Ko, Kiran Somasundaram, Shrikanth S. Narayanan, Salman Avestimehr, Mi Zhang

专题命中 代码评测 :repository(abstract);分类 cs.LG

Comments Camera-ready version of the Journal of Data-centric Machine Learning Research (DMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04764 2024-08-12 cs.CR cs.SE 57%

AddressWatcher: Sanitizer-Based Localization of Memory Leak Fixes

Aniruddhan Murali, Mahmoud Alfadel, Meiyappan Nagappan, Meng Xu, Chengnian Sun

专题命中 代码评测 :repository(abstract);分类 cs.SE

Comments Accepted in Transactions in Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18968 2024-07-30 cs.AI 57%

Intelligence Analysis of Language Models

Liane Galanti, Ethan Baron

专题命中 代码评测 :repository(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03724 2024-07-30 cs.LG cs.SI 57%

GraphSL: An Open-Source Library for Graph Source Localization Approaches and Benchmark Datasets

Junxiang Wang, Liang Zhao

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09424 2024-07-15 eess.SP cs.AI 57%

TelecomGPT: A Framework to Build Telecom-Specfic Large Language Models

Hang Zou, Qiyang Zhao, Yu Tian, Lina Bariah, Faouzi Bader, Thierry Lestable, Merouane Debbah

专题命中 代码评测 :code generation(abstract);分类 cs.AI

Comments arXiv admin note: text overlap with arXiv:1303.2654 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04796 2024-07-15 cs.CL 57%

Toucan: Many-to-Many Translation for 150 African Language Pairs

AbdelRahim Elmadany, Ife Adebara, Muhammad Abdul-Mageed

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14027 2024-07-11 cs.CR cs.AI 57%

(Security) Assertions by Large Language Models

Rahul Kande, Hammond Pearce, Benjamin Tan, Brendan Dolan-Gavitt, Shailja Thakur, Ramesh Karri, Jeyavijayan Rajendran

专题命中 代码评测 :code generation(abstract);分类 cs.AI

Comments This article has been accepted for publication in IEEE Transactions on Information Forensics and Security. This is the author's version. See https://ieeexplore.ieee.org/document/10458667 for the published version of the paper. Citation information: DOI 10.1109/TIFS.2024.3372809. See https://www.ieee.org/publications/rights/index.html for information on publication rights

Journal ref IEEE Transactions on Information Forensics and Security. 2024 Mar 4

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17008 2024-07-03 cs.LG stat.ML 57%

Meta-learning and Data Augmentation for Stress Testing Forecasting Models

Ricardo Inácio, Vitor Cerqueira, Marília Barandas, Carlos Soares

专题命中 代码评测 :repository(abstract);分类 cs.LG

Comments 16 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03672 2024-07-02 cs.CR cs.LG 57%

Cutting through buggy adversarial example defenses: fixing 1 line of code breaks Sabre

Nicholas Carlini

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13737 2024-06-25 cs.CL 57%

EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation

Atnafu Lambebo Tonja, Israel Abebe Azime, Tadesse Destaw Belay, Mesay Gemeda Yigezu, Moges Ahmed Mehamed, Abinew Ali Ayele, Ebrahim Chekol Jibril, Michael Melese Woldeyohannis, Olga Kolesnikova, Philipp Slusallek, Dietrich Klakow, Shengwu Xiong, Seid Muhie Yimam

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments Accepted at LREC-Coling 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15019 2024-06-24 cs.CL 57%

MedOdyssey: A Medical Domain Benchmark for Long Context Evaluation Up to 200K Tokens

Yongqi Fan, Hongli Sun, Kui Xue, Xiaofan Zhang, Shaoting Zhang, Tong Ruan

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14712 2024-06-24 quant-ph cs.AI 57%

Qiskit HumanEval: An Evaluation Benchmark For Quantum Code Generative Models

Sanjay Vishwakarma, Francis Harkins, Siddharth Golecha, Vishal Sharathchandra Bajpe, Nicolas Dupuis, Luca Buratti, David Kremer, Ismael Faro, Ruchir Puri, Juan Cruz-Benito

专题命中 代码评测 :code generation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11731 2024-06-18 cs.SE 57%

PerfCurator: Curating a large-scale dataset of performance bug-related commits from public repositories

Md Abul Kalam Azad, Manoj Alexender, Matthew Alexender, Syed Salauddin Mohammad Tariq, Foyzul Hassan, Probir Roy

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15692 2024-06-18 cs.AI 57%

Instruction Fusion: Advancing Prompt Evolution through Hybridization

Weidong Guo, Jiuding Yang, Kaitong Yang, Xiangyang Li, Zhuwei Rao, Yu Xu, Di Niu

专题命中 代码评测 :code generation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09967 2024-06-17 cs.CL 57%

Bag of Lies: Robustness in Continuous Pre-training BERT

Ine Gevers, Walter Daelemans

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.08486 2024-06-14 cs.AI 57%

Neural Class Expression Synthesis

N'Dah Jean Kouagou, Stefan Heindorf, Caglar Demir, Axel-Cyrille Ngonga Ngomo

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments 18 pages, 2 figures, ESWC 2023--Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06902 2024-06-12 cs.SE 57%

CodeScore-R: An Automated Robustness Metric for Assessing the FunctionalCorrectness of Code Synthesis

Guang Yang, Yu Zhou, Xiang Chen, Xiangyu Zhang

专题命中 代码评测 :code generation(abstract);分类 cs.SE

Comments in Chinese language, Journal of Computer Research and Development

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05109 2024-06-05 cs.LG 57%

Yet Another ICU Benchmark: A Flexible Multi-Center Framework for Clinical ML

Robin van de Water, Hendrik Schmidt, Paul Elbers, Patrick Thoral, Bert Arnrich, Patrick Rockenschaub

专题命中 代码评测 :repository(abstract);分类 cs.LG

Comments Main benchmark: https://github.com/rvandewater/YAIB, Cohort generation: https://github.com/rvandewater/YAIB-cohorts, Models: https://github.com/rvandewater/YAIB-models. To be published in ICLR 2024 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08636 2024-06-05 cs.DC cs.AI 57%

MLCommons Cloud Masking Benchmark with Early Stopping

Varshitha Chennamsetti, Gregor von Laszewski, Ruochen Gu, Laiba Mehnaz, Juri Papay, Samuel Jackson, Jeyan Thiyagalingam, Sergey V. Samsonau, Geoffrey C. Fox

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments NYU did not approve the publication of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05634 2024-05-24 cs.CL 57%

Towards Verifiable Generation: A Benchmark for Knowledge-aware Language Model Attribution

Xinze Li, Yixin Cao, Liangming Pan, Yubo Ma, Aixin Sun

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments acl findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10251 2024-05-17 cs.CL 57%

A Systematic Evaluation of Large Language Models for Natural Language Generation Tasks

Xuanfan Ni, Piji Li

专题命中 代码评测 :code generation(abstract);分类 cs.CL

Comments CCL2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04600 2024-05-16 cs.SE 57%

Contextual API Completion for Unseen Repositories Using LLMs

Noor Nashid, Taha Shabani, Parsa Alian, Ali Mesbah

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07456 2024-05-14 cs.LG 57%

Boosting House Price Estimations with Multi-Head Gated Attention

Zakaria Abdellah Sellam, Cosimo Distante, Abdelmalik Taleb-Ahmed, Pier Luigi Mazzeo

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06057 2024-05-13 cs.CV cs.LG 57%

UnSegGNet: Unsupervised Image Segmentation using Graph Neural Networks

Kovvuri Sai Gopal Reddy, Bodduluri Saran, A. Mudit Adityaja, Saurabh J. Shigwan, Nitin Kumar

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏