arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138999 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12403 篇

2510.22694 2025-10-28 cs.CV cs.CL cs.IR 77%

Windsock is Dancing: Adaptive Multimodal Retrieval-Augmented Generation

Shu Zhao, Tianyi Shen, Nilesh Ahuja, Omesh Tickoo, Vijaykrishnan Narayanan

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) Intel(英特尔)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments Accepted at NeurIPS 2025 UniReps Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22099 2025-10-28 cs.CL 77%

Generalization or Memorization: Dynamic Decoding for Mode Steering

Xuanming Zhang

机构 * Stanford University, Palo Alto, USA(斯坦福大学) Department of Computer Science, University of Wisconsin-Madison, Madison, USA(计算机科学系,威斯康星大学麦迪逊分校)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21867 2025-10-28 cs.CV cs.AI 77%

Addressing Corner Cases in Autonomous Driving: A World Model-based Approach with Mixture of Experts and LLMs

Haicheng Liao, Bonan Wang, Junxian Yang, Chengyue Wang, Zhengbin He, Guohui Zhang, Chengzhong Xu, Zhenning Li

机构 * State Key Laboratory of Internet of Things for Smart City, University of Macau(物联网智能城市国家重点实验室,澳门大学) Department of Computer and Information Science, University of Macau(计算机与信息科学系,澳门大学) Department of Civil and Environmental Engineering, University of Macau(土木与环境工程系,澳门大学) Senseable City Lab, Massachusetts Institute of Technology(可感知城市实验室,麻省理工学院) Department of Civil and Environmental Engineering, University of Hawaii(土木与环境工程系,夏威夷大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21836 2025-10-28 cs.LG 77%

COLA: Continual Learning via Autoencoder Retrieval of Adapters

Jaya Krishna Mandivarapu

机构 * Microsoft(微软)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20083 2025-10-27 cs.CL 77%

Universal Cross-Tokenizer Distillation via Approximate Likelihood Matching

Benjamin Minixhofer, Ivan Vulić, Edoardo Maria Ponti

机构 * University of Cambridge(剑桥大学) University of Edinburgh(爱丁堡大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19806 2025-10-23 cs.CL 77%

The Art of Asking: Multilingual Prompt Optimization for Synthetic Data

David Mora, Viraat Aryabumi, Wei-Yin Ko, Sara Hooker, Julia Kreutzer, Marzieh Fadaee

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17995 2025-10-22 cs.AI 77%

FABRIC: Framework for Agent-Based Realistic Intelligence Creation

Abhigya Verma, Seganrasan Subramanian, Nandhakumar Kandasamy, Naman Gupta

机构 * ServiceNow

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 51 Pages, 38 Listings, 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04039 2025-10-22 cs.CR cs.AI 77%

BlockScan: Detecting Anomalies in Blockchain Transactions

Jiahao Yu, Xian Wu, Hao Liu, Wenbo Guo, Xinyu Xing

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) Meta AI New York University(纽约大学) sec3 Northwestern University(西北大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17185 2025-10-21 cs.LG 77%

Robustness in Text-Attributed Graph Learning: Insights, Trade-offs, and New Defenses

Runlin Lei, Lu Yi, Mingguo He, Pengyu Qiu, Zhewei Wei, Yongchao Liu, Chuntao Hong

机构 * Renmin University of China(中国人民大学) National University of Singapore(新加坡国立大学) Ant Group(蚂蚁集团)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13859 2025-10-17 cs.SE cs.AI 77%

Benchmarking Correctness and Security in Multi-Turn Code Generation

Ruchit Rawal, Jeffrey Yang Fan Chiang, Chihao Shen, Jeffery Siyuan Tian, Aastha Mahajan, Tom Goldstein, Yizheng Chen

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12899 2025-10-16 cs.CL 77%

EduDial: Constructing a Large-scale Multi-turn Teacher-Student Dialogue Corpus

Shouang Wei, Min Zhang, Xin Lin, Bo Jiang, Zhongxiang Dai, Kun Kuang

机构 * East China Normal University(华东师范大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12246 2025-10-15 cs.AI 77%

PromptFlow: Training Prompts Like Neural Networks

Jingyi Wang, Hongyuan Zhu, Ye Niu, Yunhui Deng

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Comments: 18 pages, 14 figures, conference submission, appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12218 2025-10-15 cs.AI 77%

GOAT: A Training Framework for Goal-Oriented Agent with Tools

Hyunji Min, Sangwon Jung, Junyoung Sung, Dosung Lee, Leekyeung Han, Paul Hongsuck Seo

机构 * Korea University(韩国大学) Trillion Labs(万亿实验室)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 32 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04064 2025-10-14 cs.AI 77%

Decoding Emotion in the Deep: A Systematic Study of How LLMs Represent, Retain, and Express Emotion

Jingxiang Zhang, Lujia Zhong

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments 10 pages, 7 figures, 4 tables. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22776 2025-10-14 cs.SE cs.AI 77%

Post-Incorporating Code Structural Knowledge into Pretrained Models via ICL for Code Translation

Yali Du, Hui Sun, Ming Li

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家实验室,南京大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments IEEE Transactions on Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09553 2025-10-13 cs.CL 77%

Hierarchical Indexing with Knowledge Enrichment for Multilingual Video Corpus Retrieval

Yu Wang, Tianhao Tan, Yifei Wang

机构 * School of Computing and Information, University of Pittsburgh, PA, USA(计算与信息学院,匹兹堡大学) Wuhan University of Technology(武汉理工大学) Hunan University(湖南大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to NLPCC 2025 (Springer), to appear November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08850 2025-10-13 cs.SE cs.AI 77%

Repository-Aware File Path Retrieval via Fine-Tuned LLMs

Vasudha Yanuganti, Ishaan Puri, Swapnil Chhatre, Mantinder Singh, Ashok Jallepalli, Hritvik Shrivastava, Pradeep Kumar Sharma

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08238 2025-10-10 cs.AI 77%

Chain-of-Trigger: An Agentic Backdoor that Paradoxically Enhances Agentic Robustness

Jiyang Qiu, Xinbei Ma, Yunqing Xu, Zhuosheng Zhang, Hai Zhao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07192 2025-10-09 cs.LG 77%

Poisoning Attacks on LLMs Require a Near-constant Number of Poison Samples

Alexandra Souly, Javier Rando, Ed Chapman, Xander Davies, Burak Hasircioglu, Ezzeldin Shereen, Carlos Mougan, Vasilios Mavroudis, Erik Jones, Chris Hicks, Nicholas Carlini, Yarin Gal, Robert Kirk

机构 * UK AI Security Institute(英国人工智能安全研究所) Anthropic Alan Turing Institute(艾伦·图灵研究所) OATML, University of Oxford(OATML,牛津大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06232 2025-10-09 q-bio.TO cs.LG 77%

Neu-RadBERT for Enhanced Diagnosis of Brain Injuries and Conditions

Manpreet Singh, Sean Macrae, Pierre-Marc Williams, Nicole Hung, Sabrina Araujo de Franca, Laurent Letourneau-Guillon, François-Martin Carrier, Bang Liu, Yiorgos Alexandros Cavayas

专题命中 预训练与数据 :LLM(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

Comments Both Manpreet Singh and Sean Macrae contributed equally and should be considered co-first authors. Corresponding author: Yiorgos Alexandros Cavayas

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17601 2025-10-07 cs.CL 77%

Revisiting Backdoor Attacks on LLMs: A Stealthy and Practical Poisoning Framework via Harmless Inputs

Jiawei Kong, Hao Fang, Xiaochen Yang, Kuofeng Gao, Bin Chen, Shu-Tao Xia, Ke Xu, Han Qiu

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Department of Software Engineering, Harbin Institute of Technology(哈尔滨工业大学软件工程系) School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区计算机科学与技术学院) Institute for Network Sciences and Cyberspace, Tsinghua University(清华大学网络科学与空间研究院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12310 2025-10-02 cs.CL 77%

Second Language (Arabic) Acquisition of LLMs via Progressive Vocabulary Expansion

Jianqing Zhu, Huang Huang, Zhihang Lin, Juhao Liang, Zhengyang Tang, Khalid Almubarak, Abdulmohsen Alharthik, Bang An, Juncai He, Xiangbo Wu, Fei Yu, Junying Chen, Zhuoheng Ma, Yuhao Du, He Zhang, Emad A. Alghamdi, Lian Zhang, Ruoyu Sun, Haizhou Li, Benyou Wang, Jinchao Xu

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹大学科学与技术大学) Shenzhen International Center for Industrial and Applied Mathematics, Shenzhen Research Institute of Big Data(深圳国际工业与应用数学中心,深圳大数据研究院) Shenzhen Research Institute of Big Data(深圳大数据研究院) The Chinese University of Hong Kong(香港中文大学) King Abdulaziz University(国王阿卜杜勒阿齐兹大学) Prince Sattam bin Abdulaziz University(普林斯萨塔姆·本·阿卜杜勒阿齐兹大学) University of Bisha(比沙大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19128 2025-09-30 cs.LG 77%

PipelineRL: Faster On-policy Reinforcement Learning for Long Sequence Generation

Alexandre Piché, Ehsan Kamalloo, Rafael Pardinas, Xiaoyin Chen, Dzmitry Bahdanau

机构 * ServiceNow AI Research(ServiceNow人工智能研究)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20277 2025-09-25 cs.CR cs.AI 77%

Investigating Security Implications of Automatically Generated Code on the Software Supply Chain

Xiaofan Li, Xing Gao

机构 * Xiaofan Li Xing Gao

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18383 2025-09-24 cs.CL 77%

NileChat: Towards Linguistically Diverse and Culturally Aware LLMs for Local Communities

Abdellah El Mekki, Houdaifa Atou, Omer Nacar, Shady Shehata, Muhammad Abdul-Mageed

机构 * The University of British Columbia(不列颠哥伦比亚大学) Mohammed VI Polytechnic University(穆莱·阿卜杜勒阿齐兹国王理工学院) Tuwaiq Academy(图瓦伊克学院) Invertible AI(可逆人工智能)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 (Main Conference). Camera-ready version. Data & models: https://github.com/UBC-NLP/nilechat

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16543 2025-09-23 cs.CL 77%

ChemOrch: Empowering LLMs with Chemical Intelligence via Synthetic Instructions

Yue Huang, Zhengzhe Jiang, Xiaonan Luo, Kehan Guo, Haomin Zhuang, Yujun Zhou, Zhengqing Yuan, Xiaoqi Sun, Jules Schleinitz, Yanbo Wang, Shuhao Zhang, Mihir Surve, Nitesh V Chawla, Olaf Wiest, Xiangliang Zhang

机构 * Department of Computer Science and Engineering, University of Notre Dame(诺丁汉大学计算机科学与工程系) MIT(麻省理工学院) CalTech(加州理工学院) MBZUAI(穆斯林人工智能研究所) CMU(卡内基梅隆大学) Department of Chemistry & Biochemistry, University of Notre Dame(诺丁汉大学化学与生物化学系)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14814 2025-09-19 cs.CL 77%

ReCoVeR the Target Language: Language Steering without Sacrificing Task Performance

Hannah Sterz, Fabian David Schmidt, Goran Glavaš, Ivan Vulić

机构 * University of Cambridge(剑桥大学) University of Würzburg(弗赖堡大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14608 2025-09-19 cs.CR cs.AI 77%

Enterprise AI Must Enforce Participant-Aware Access Control

Shashank Shreedhar Bhatt, Tanmay Rajore, Khushboo Aggarwal, Ganesh Ananthanarayanan, Ranveer Chandra, Nishanth Chandran, Suyash Choudhury, Divya Gupta, Emre Kiciman, Sumit Kumar Pandey, Srinath Setty, Rahul Sharma, Teijia Zhao

机构 * Microsoft Corporation(微软公司)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14493 2025-09-19 cs.CL 77%

Translate, then Detect: Leveraging Machine Translation for Cross-Lingual Toxicity Classification

Samuel J. Bell, Eduardo Sánchez, David Dale, Pontus Stenetorp, Mikel Artetxe, Marta R. Costa-jussà

机构 * FAIR at Meta(Meta 的 FAIR 研究院) University College London(伦敦大学学院) University of the Basque Country (UPV/EHU)(巴斯克大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12811 2025-09-17 cs.CL 77%

ConvergeWriter: Data-Driven Bottom-Up Article Construction

Binquan Ji, Jiaqi Wang, Ruiting Li, Xingchen Han, Yiyang Qi, Shichao Wang, Yifei Lu, Yuantao Han, Feiliang Ren

机构 * Binquan Ji, Jiaqi Wang, Ruiting Li, Xingchen Han, Yiyang Qi, Shichao Wang, Yifei Lu, Yuantao Han, Feiliang Ren(作者)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏