arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 1740 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 1740 篇

2405.07778 2024-05-14 cs.CL cs.AI 62%

A Comprehensive Analysis of Static Word Embeddings for Turkish

Karahan Sarıtaş, Cahid Arda Öz, Tunga Güngör

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Journal ref Expert Systems with Applications Volume 252, Part A, 15 October 2024, 124123

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06645 2024-05-14 q-bio.BM cs.AI cs.LG 62%

On Recovering Higher-order Interactions from Protein Language Models

Darin Tsui, Amirali Aghazadeh

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19604 2024-05-09 cs.AI cs.IR cs.LG 62%

DKINet: Medication Recommendation via Domain Knowledge Informed Deep Learning

Sicen Liu, Xiaolong Wang, Xianbing Zhao, Hao Chen

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13555 2024-05-01 cs.CV cs.AI cs.LG 62%

Benchmarking the Fairness of Image Upsampling Methods

Mike Laszkiewicz, Imant Daunhawer, Julia E. Vogt, Asja Fischer, Johannes Lederer

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments This is the author's version of the work. It is posted here for your personal use. Not for redistribution. The definitive Version of Record was published at the 2024 ACM Conference on Fairness, Accountability, and Transparency (FAccT '24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18864 2024-04-30 cs.DC cs.AI cs.SE 62%

Performance-Aligned LLMs for Generating Fast Code

Daniel Nichols, Pranav Polasam, Harshitha Menon, Aniruddha Marathe, Todd Gamblin, Abhinav Bhatele

专题命中 代码评测 :code model(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03996 2024-04-08 cs.NE cs.AI cs.LG 62%

Fast Genetic Algorithm for feature selection -- A qualitative approximation approach

Mohammed Ghaith Altarabichi, Sławomir Nowaczyk, Sepideh Pashami, Peyman Sheikholharam Mashhadi

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Journal ref Expert Systems with Applications, 211, p.118528 (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.13464 2024-04-08 cs.LG cs.AI cs.IT math.IT 62%

From MIM-Based GAN to Anomaly Detection:Event Probability Influence on Generative Adversarial Networks

Rui She, Pingyi Fan

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08429 2024-03-14 cs.SE cs.AI 62%

Software Vulnerability and Functionality Assessment using LLMs

Rasmus Ingemann Tuffveson Jensen, Vali Tawosi, Salwa Alamir

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

Comments 4 pages, accepted to NLBSE'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08299 2024-03-14 cs.SE cs.AI 62%

AutoDev: Automated AI-Driven Development

Michele Tufano, Anisha Agarwal, Jinu Jang, Roshanak Zilouchian Moghaddam, Neel Sundaresan

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06382 2024-03-12 cs.CV cs.AI cs.LG 62%

Pre-Trained Model Recommendation for Downstream Fine-tuning

Jiameng Bai, Sai Wu, Jie Song, Junbo Zhao, Gang Chen

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01940 2024-03-12 cs.CL cs.AI 62%

CodeApex: A Bilingual Programming Evaluation Benchmark for Large Language Models

Lingyue Fu, Huacan Chai, Shuang Luo, Kounianhua Du, Weiming Zhang, Longteng Fan, Jiayi Lei, Renting Rui, Jianghao Lin, Yuchen Fang, Yifan Liu, Jingkuan Wang, Siyuan Qi, Kangning Zhang, Weinan Zhang, Yong Yu

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments 33pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05873 2024-03-12 cs.SE cs.IR cs.LG 62%

LEGION: Harnessing Pre-trained Language Models for GitHub Topic Recommendations with Distribution-Balance Loss

Yen-Trang Dang, Thanh-Le Cong, Phuc-Thanh Nguyen, Anh M. T. Bui, Phuong T. Nguyen, Bach Le, Quyet-Thang Huynh

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.LG

Comments Accepted to EASE'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01784 2024-03-05 cs.AI cs.PL 62%

CatCode: A Comprehensive Evaluation Framework for LLMs On the Mixture of Code and Text

Zhenru Lin, Yiqun Yao, Yang Yuan

专题命中 代码评测 :code generation(abstract);分类 cs.AI、cs.PL

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09910 2024-03-05 cs.LG cs.AI cs.CV 62%

LabelBench: A Comprehensive Framework for Benchmarking Adaptive Label-Efficient Learning

Jifan Zhang, Yifang Chen, Gregory Canal, Stephen Mussmann, Arnav M. Das, Gantavya Bhatt, Yinglun Zhu, Jeffrey Bilmes, Simon Shaolei Du, Kevin Jamieson, Robert D Nowak

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12351 2024-02-27 cs.CL cs.LG 62%

Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey

Yunpeng Huang, Jingwei Xu, Junyu Lai, Zixu Jiang, Taolue Chen, Zenan Li, Yuan Yao, Xiaoxing Ma, Lijuan Yang, Hao Chen, Shupeng Li, Penghao Zhao

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.LG

Comments 40 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14261 2024-02-23 cs.SE cs.AI 62%

Copilot Evaluation Harness: Evaluating LLM-Guided Software Programming

Anisha Agarwal, Aaron Chan, Shubham Chandel, Jinu Jang, Shaun Miller, Roshanak Zilouchian Moghaddam, Yevhen Mohylevskyy, Neel Sundaresan, Michele Tufano

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11565 2024-02-20 cs.LG cs.AI 62%

Continual Learning on Graphs: Challenges, Solutions, and Opportunities

Xikun Zhang, Dongjin Song, Dacheng Tao

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09136 2024-02-15 cs.CL cs.AI 62%

DolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction Tuning

Yejie Wang, Keqing He, Guanting Dong, Pei Wang, Weihao Zeng, Muxi Diao, Yutao Mou, Mengdi Zhang, Jingang Wang, Xunliang Cai, Weiran Xu

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15810 2024-01-30 cs.SE cs.AI 62%

Green Runner: A tool for efficient deep learning component selection

Jai Kannan

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05940 2024-01-12 cs.SE cs.AI 62%

Mutation-based Consistency Testing for Evaluating the Code Understanding Capability of LLMs

Ziyu Li, Donghwan Shin

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

Comments This is an author-preprint. The published version will be included in the proceedings of CAIN 2024 (co-located with ICSE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15685 2023-12-21 cs.CL cs.AI 62%

RewriteLM: An Instruction-Tuned Large Language Model for Text Rewriting

Lei Shu, Liangchen Luo, Jayakumar Hoskere, Yun Zhu, Yinxiao Liu, Simon Tong, Jindong Chen, Lei Meng

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Journal ref AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.04023 2023-11-29 cs.CL cs.AI 62%

A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity

Yejin Bang, Samuel Cahyawijaya, Nayeon Lee, Wenliang Dai, Dan Su, Bryan Wilie, Holy Lovenia, Ziwei Ji, Tiezheng Yu, Willy Chung, Quyet V. Do, Yan Xu, Pascale Fung

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments 45 pages, AACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14139 2023-11-27 cs.LG cs.AI 62%

Machine Learning For An Explainable Cost Prediction of Medical Insurance

Ugochukwu Orji, Elochukwu Ukwandu

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments 42 pages, 16 figures and 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10548 2023-11-27 cs.SD cs.AI cs.LG eess.AS 62%

MARBLE: Music Audio Representation Benchmark for Universal Evaluation

Ruibin Yuan, Yinghao Ma, Yizhi Li, Ge Zhang, Xingran Chen, Hanzhi Yin, Le Zhuo, Yiqi Liu, Jiawen Huang, Zeyue Tian, Binyue Deng, Ningzhi Wang, Chenghua Lin, Emmanouil Benetos, Anton Ragni, Norbert Gyenge, Roger Dannenberg, Wenhu Chen, Gus Xia, Wei Xue, Si Liu, Shi Wang, Ruibo Liu, Yike Guo, Jie Fu

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments camera-ready version for NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09707 2023-11-17 cs.CL cs.PL 62%

GenCodeSearchNet: A Benchmark Test Suite for Evaluating Generalization in Programming Language Understanding

Andor Diera, Abdelhalim Dahou, Lukas Galke, Fabian Karl, Florian Sihler, Ansgar Scherp

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.PL

Comments accepted at GenBench workshop, EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11986 2023-11-02 cs.AI cs.CL cs.CY 62%

Sociotechnical Safety Evaluation of Generative AI Systems

Laura Weidinger, Maribeth Rauh, Nahema Marchal, Arianna Manzini, Lisa Anne Hendricks, Juan Mateos-Garcia, Stevie Bergman, Jackie Kay, Conor Griffin, Ben Bariach, Iason Gabriel, Verena Rieser, William Isaac

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments main paper p.1-29, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.00521 2023-09-26 cs.LG cs.AI cs.MA 62%

Off-the-Grid MARL: Datasets with Baselines for Offline Multi-Agent Reinforcement Learning

Claude Formanek, Asad Jeewa, Jonathan Shock, Arnu Pretorius

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments Extended Abstract at Autonomous Agents and Multi-Agent Systems Conference 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04369 2023-09-11 cs.CL cs.AI 62%

Beyond Static Datasets: A Deep Interaction Approach to LLM Evaluation

Jiatong Li, Rui Li, Qi Liu

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12415 2023-08-25 cs.SE cs.AI 62%

Benchmarking Causal Study to Interpret Large Language Models for Source Code

Daniel Rodriguez-Cardenas, David N. Palacio, Dipin Khati, Henry Burke, Denys Poshyvanyk

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

Comments 6 pages, 4 tables, 3 figures, accepted to ICSME 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15850 2023-08-01 stat.ML cs.AI cs.LG 62%

Comprehensive Algorithm Portfolio Evaluation using Item Response Theory

Sevvandi Kandanaarachchi, Kate Smith-Miles

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏