arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12251 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12251 篇

2512.05666 2025-12-08 cs.LG cs.AI cs.SE 73%

Feasibility of AI-Assisted Programming for End-User Development

面向终用户开发的AI辅助编程可行性

Irene Weber

机构 * University of Applied Sciences Kempten Faculty of Mechanical Engineering(应用科学大学克雷滕学院机械工程系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了AI辅助编程在终用户开发中的可行性,通过案例研究发现非程序员能通过AI助手快速开发应用程序,可能替代传统低代码平台。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04121 2025-12-05 cs.CY cs.AI cs.CL 73%

Can machines perform a qualitative data analysis? Reading the debate with Alan Turing

机器能否进行定性数据分析?通过阿兰·图灵阅读辩论

Stefano De Paoli

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文通过图灵的思想重新审视LLMs在定性分析中的应用,强调应关注LLMs生成分析结果与人类分析师的可比性,而非单纯探讨机器能否进行定性分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03195 2025-12-04 cs.CL cs.LG 73%

Enhancing Job Matching: Occupation, Skill and Qualification Linking with the ESCO and EQF taxonomies

增强岗位匹配:利用ESCO和EQF分类法链接职业、技能和资格

Stylianos Saroglou, Konstantinos Diamantaras, Francesco Preta, Marina Delianidi, Apostolos Benisis, Christian Johannes Meyer

机构 * International Hellenic University(国际希伯利安大学) University of Oxford(牛津大学) Tabiya(塔比亚)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出利用ESCO和EQF分类法提升岗位匹配,通过两种方法和新数据集改进劳动力市场信息分类。

Comments 14 pages, 1 figure, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05295 2025-11-10 cs.DS cs.CL cs.DM cs.LG 73%

Language Generation and Identification From Partial Enumeration: Tight Density Bounds and Topological Characterizations

Jon Kleinberg, Fan Wei

机构 * Department of Computer Science and Information Science, Cornell University(计算机科学与信息科学系,康奈尔大学) Department of Mathemaics, Duke University(数学系,杜克大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10594 2025-11-06 cs.LG cs.AI cs.CR 73%

SME-TEAM: Leveraging Trust and Ethics for Secure and Responsible Use of AI and LLMs in SMEs

Iqbal H. Sarker, Helge Janicke, Ahmad Mohsin, Leandros Maglaras

机构 * Centre for Securing Digital Futures, Edith Cowan University(数字未来安全研究中心,爱迪生·科温大学) School of Computing, De Montfort University(计算学院,德蒙福特大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02752 2025-11-05 cs.CL cs.AI cs.CY 73%

AI Diffusion in Low Resource Language Countries

Amit Misra, Syed Waqas Zamir, Wassim Hamidouche, Inbal Becker-Reshef, Juan Lavista Ferres

机构 * Microsoft AI for Good Research Lab(微软人工智能为善研究实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 4 tables. Also available at https://aka.ms/AI_Diffusion_Low_Resource_Language_Countries

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00532 2025-11-04 cs.LG cs.AI cs.CY stat.AP 73%

Air Pollution Forecasting in Bucharest

Dragoş-Andrei Şerban, Răzvan-Alexandru Smădu, Dumitru-Clementin Cercel

机构 * National University of Science and Technology POLITEHNICA Bucharest(波兰技术大学布加勒斯特国立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 14 pages 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10584 2025-11-04 cs.AI cs.LG cs.MA 73%

STACKFEED: Structured Textual Actor-Critic Knowledge Base Editing with FeedBack

Shashank Kirtania, Naman Gupta, Priyanshu Gupta, Krishna Kariya, Sumit Gulwani, Arun Iyer, Suresh Parthasarathy, Arjun Radhakrishna, Sriram K. Rajamani, Gustavo Soares

机构 * Microsoft(微软) Microsoft Research India(微软印度研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing: Industry Track 2588-2606

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22095 2025-10-28 cs.AI cs.CL 73%

Embracing Trustworthy Brain-Agent Collaboration as Paradigm Extension for Intelligent Assistive Technologies

Yankai Chen, Xinni Zhang, Yifei Zhang, Yangning Li, Henry Peng Zou, Chunyu Miao, Weizhi Zhang, Xue Liu, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) MBZUAI(马克斯·普朗克人工智能研究所) McGill University(麦吉尔大学) The Chinese University of Hong Kong(香港中文大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS'25 Position Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21575 2025-10-27 cs.CL cs.AI 73%

From Polyester Girlfriends to Blind Mice: Creating the First Pragmatics Understanding Benchmarks for Slovene

Mojca Brglez, Špela Vintar

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20287 2025-10-24 cs.CV cs.AI cs.LG 73%

Breakdance Video classification in the age of Generative AI

Sauptik Dhar, Naveen Ramakrishnan, Michelle Munson

机构 * Eluvio AI Labs(Eluvio AI实验室)

专题命中 其他LLM :language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14278 2025-10-17 cs.CL cs.AI cs.IR 73%

PRISM: Agentic Retrieval with LLMs for Multi-Hop Question Answering

Md Mahadi Hasan Nahid, Davood Rafiei

机构 * Department of Computing Science University of Alberta(计算科学系阿尔伯塔大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14106 2025-10-17 cs.AI cs.CL cs.GT 73%

Generating Fair Consensus Statements with Social Choice on Token-Level MDPs

Carter Blair, Kate Larson

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20490 2025-10-14 cs.CL cs.AI 73%

Who Speaks Matters: Analysing the Influence of the Speaker's Ethnicity on Hate Classification

Ananya Malik, Kartik Sharma, Shaily Bhatt, Lynnette Hui Xian Ng

机构 * Northeastern University(东北大学) Georgia Institute of Technology(佐治亚理工学院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 3 figures, 3 tables. To appear in EMNLP 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07822 2025-10-10 cs.LG cs.AI 73%

SIMU: Selective Influence Machine Unlearning

Anu Agarwal, Mihir Pamnani, Dilek Hakkani-Tur

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS 2025 Workshop: Constrained Optimization for Machine Learning (COML)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06828 2025-10-09 cs.LG cs.AI 73%

Recurrence-Complete Frame-based Action Models

Michael Keiblinger

机构 * Prime Intellect

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03384 2025-10-07 cs.CL cs.AI 73%

Implicit Values Embedded in How Humans and LLMs Complete Subjective Everyday Tasks

Arjun Arunasalam, Madison Pickering, Z. Berkay Celik, Blase Ur

机构 * Florida International University(佛罗里达国际大学) University of Chicago(芝加哥大学) Purdue University(普渡大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02354 2025-10-06 cs.CL cs.LG 73%

Modeling the language cortex with form-independent and enriched representations of sentence meaning reveals remarkable semantic abstractness

Shreya Saha, Shurui Li, Greta Tuckute, Yuanning Li, Ru-Yuan Zhang, Leila Wehbe, Evelina Fedorenko, Meenakshi Khosla

机构 * University of California San Diego(加州大学圣地亚哥分校) ShanghaiTech University(上海科技大学) Kempner Institute, Harvard University(哈佛大学凯普勒研究所) Shanghai Jiao Tong University(上海交通大学) Carnegie Mellon University(卡内基梅隆大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02319 2025-10-06 cs.CR cs.AI cs.CL 73%

Modeling the Attack: Detecting AI-Generated Text by Quantifying Adversarial Perturbations

Lekkala Sai Teja, Annepaka Yadagiri, Sangam Sai Anish, Siva Gopala Krishna Nuthakki, Partha Pakray

机构 * Computer Science \& Engineering National Institute of Technology Silchar, India lekkalad\ ug\ Computer Science \& Engineering National Institute of Technology Silchar, India annepaka22\ Computer Science \& Engineering National Institute of Technology Silchar, India sangams\ ug\ Computer Science \& Engineering BML Munjal University Haryana, India Computer Science \& Engineering National Institute of Technology Silchar, India

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11089 2025-10-06 eess.AS cs.AI cs.CL 73%

Better Pseudo-labeling with Multi-ASR Fusion and Error Correction by SpeechLLM

Jeena Prakash, Blessingh Kumar, Kadri Hacioglu, Bidisha Sharma, Sindhuja Gopalan, Malolan Chetlur, Shankar Venkatesan, Andreas Stolcke

机构 * Uniphore Systems India & USA(Uniphore系统印度与美国)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref Proc. Interspeech 2025, pp. 579-583

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24024 2025-09-30 cs.FL cs.CL cs.LG cs.LO 73%

The Role of Logic and Automata in Understanding Transformers

Anthony W. Lin, Pablo Barcelo

机构 * Max-Planck Institute for Software Systems, Kaiserslautern, Germany University of Kaiserslautern-Landau, Kaiserslautern, Germany Institute for Mathematical

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Preprint of invited paper for RP'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17881 2025-09-30 cs.CL cs.AI 73%

GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication

Hua Tang, Lingyong Yan, Yukun Zhao, Shuaiqiang Wang, Jizhou Huang, Dawei Yin

机构 * The Chinese University of Hong Kong, Shenzhen (CUHK-Shenzhen)(香港中文大学(深圳)) Baidu Inc.(百度公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01752 2025-09-30 cs.AI cs.CL 73%

A Neurosymbolic Fast and Slow Architecture for Graph Coloring

Vedant Khandelwal, Vishal Pallagani, Biplav Srivastava, Francesca Rossi

机构 * University of South Carolina(南卡罗来纳大学) IBM Research(IBM研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 31 Pages, 18 Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17144 2025-09-30 cs.CV cs.AI cs.LG 73%

Do We Need Large VLMs for Spotting Soccer Actions?

Ritabrata Chakraborty, Rajatsubhra Chakraborty, Avijit Dasgupta, Sandeep Chaurasia

机构 * Manipal University Jaipur(贾浦尔曼普尔大学) UNC–Charlotte(北卡罗来纳州立大学夏洛特分校) IIIT Hyderabad(海得拉巴印度理工学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17550 2025-09-29 cs.LG cs.AI stat.ML 73%

In-Context Algorithm Emulation in Fixed-Weight Transformers

Jerry Yao-Chieh Hu, Hude Liu, Jennifer Yuntong Zhang, Han Liu

专题命中 其他LLM :foundation model(abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments Code is available at https://github.com/MAGICS-LAB/algo_emu

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15561 2025-09-26 cs.LG cs.CL 73%

Small LLMs with Expert Blocks Are Good Enough for Hyperparamter Tuning

Om Naphade, Saksham Bansal, Parikshit Pareek

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02682 2025-09-26 cs.AI cs.LG cs.SY eess.SY math.DS math.OC 73%

The Asymptotic Behavior of Attention in Transformers

Álvaro Rodríguez Abella, João Pedro Silvestre, Paulo Tabuada

机构 * Department of Applied Mathematics, ICAI School of Engineering, Comillas Pontifical University(应用数学系,ICAI工程学院,科利斯大学) Department of Electrical and Computer Engineering, University of California, Los Angeles(电气与计算机工程系,加州大学洛杉矶分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00016 2025-09-23 q-fin.CP cs.AI cs.CL 73%

Alpha-GPT: Human-AI Interactive Alpha Mining for Quantitative Investment

Saizhuo Wang, Hang Yuan, Leon Zhou, Lionel M. Ni, Heung-Yeung Shum, Jian Guo

机构 * HKUST(香港科技大学) IDEA Research(IDEA研究所) Columbia University(哥伦比亚大学) HKUST-GZ(香港科技大学-广州)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 System Demonstration Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16060 2025-09-22 cs.LG cs.CL 73%

SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection

Maithili Joshi, Palash Nandi, Tanmoy Chakraborty

机构 * Indian Institute of Technology Delhi(印度理工学院德里)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted in EMNLP'25 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15641 2025-09-22 cs.LG cs.AI stat.ML 73%

Information Geometry of Variational Bayes

Mohammad Emtiyaz Khan

机构 * RIKEN Center for AI Project(日本理化学研究所人工智能项目中心)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏