arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-27 至 2025-10-27 共收录 22 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 22 篇

2502.03325 2025-10-27 cs.CL cs.AI 91%

Electronic Circuit Principles of Large Language Models

Qiguang Chen, Libo Qin, Jinhao Liu, Dengyun Peng, Jiaqi Wang, Mengkang Hu, Zhi Chen, Wanxiang Che, Ting Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Central South University(中南大学) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) ByteDance Seed (China)(字节跳动种子(中国))

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23811 2025-10-27 cs.CL cs.AI cs.LG 90%

LayerIF: Estimating Layer Quality for Large Language Models using Influence Functions

Hadi Askari, Shivanshu Gupta, Fei Wang, Anshuman Chhabra, Muhao Chen

机构 * University of California, Davis(加州大学戴维斯分校) University of California, Irvine(加州大学伊市分校) University of Southern California(南加州大学) University of South Florida(佛罗里达州立大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21585 2025-10-27 cs.LG q-bio.NC 88%

REVE: A Foundation Model for EEG -- Adapting to Any Setup with Large-Scale Pretraining on 25,000 Subjects

Yassine El Ouahidi, Jonathan Lys, Philipp Thölke, Nicolas Farrugia, Bastien Pasdeloup, Vincent Gripon, Karim Jerbi, Giulia Lioi

机构 * IMT Atlantique Lab-STICC UMR CNRS 6285(IMT Atlantique 实验室) Psychology Department Université de Montréal(蒙特利尔大学心理学系) Mila (Quebec AI research institute)(魁北克人工智能研究院) UNIQUE (Quebec Neuro-AI research center)(魁北克神经人工智能研究中心)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(title,abstract);分类 cs.LG

Comments Code available at: https://brain-bzh.github.io/reve/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20860 2025-10-27 eess.AS cs.CL cs.LG 84%

Data-Centric Lessons To Improve Speech-Language Pretraining

Vishaal Udandarao, Zhiyun Lu, Xuankai Chang, Yongqiang Wang, Violet Z. Yao, Albin Madapally Jose, Fartash Faghri, Josh Gardner, Chung-Cheng Chiu

机构 * Apple(苹果公司) University of Cambridge(剑桥大学) University of Tübingen(图宾根大学)

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Tech Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04725 2025-10-27 cs.CL cs.AI cs.IT cs.LG math.IT physics.data-an 82%

L$^2$M: Mutual Information Scaling Law for Long-Context Language Modeling

Zhuo Chen, Oriol Mayné i Comas, Zhuotao Jin, Di Luo, Marin Soljačić

机构 * NSF AI Institute for Artificial Intelligence and Fundamental Interactions(NSF人工智能与基础相互作用研究院) Massachusetts Institute of Technology(麻省理工学院) Polytechnic University of Catalonia(加泰罗尼亚理工大学) Harvard University(哈佛大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 34 pages, 13 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21501 2025-10-27 cs.CV cs.AI 81%

GranViT: A Fine-Grained Vision Model With Autoregressive Perception For MLLMs

Guanghao Zheng, Bowen Shi, Mingxing Xu, Ruoyu Sun, Peisen Zhao, Zhibo Zhang, Wenrui Dai, Junni Zou, Hongkai Xiong, Xiaopeng Zhang, Qi Tian

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei Inc.(华为公司)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21571 2025-10-27 cs.RO cs.AI cs.CV cs.LG 81%

Scalable Vision-Language-Action Model Pretraining for Robotic Manipulation with Real-Life Human Activity Videos

Qixiu Li, Yu Deng, Yaobo Liang, Lin Luo, Lei Zhou, Chengtang Yao, Lingqi Zeng, Zhiyuan Feng, Huizhi Liang, Sicheng Xu, Yizhong Zhang, Xi Chen, Hao Chen, Lily Sun, Dong Chen, Jiaolong Yang, Baining Guo

机构 * Tsinghua University(清华大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

Comments Project page: https://microsoft.github.io/VITRA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07311 2025-10-27 cs.LG cs.AI cs.CV 81%

ViTime: Foundation Model for Time Series Forecasting Powered by Vision Intelligence

Luoxiao Yang, Yun Wang, Xinqi Fan, Israel Cohen, Jingdong Chen, Zijun Zhang

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.AI、cs.LG

Journal ref Transactions on Machine Learning Research,2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21204 2025-10-27 cs.LG 79%

Mitra: Mixed Synthetic Priors for Enhancing Tabular Foundation Models

Xiyuan Zhang, Danielle C. Maddix, Junming Yin, Nick Erickson, Abdul Fatir Ansari, Boran Han, Shuai Zhang, Leman Akoglu, Christos Faloutsos, Michael W. Mahoney, Cuixiong Hu, Huzefa Rangwala, George Karypis, Bernie Wang

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.LG

Comments NeurIPS 2025. We released both classifier (autogluon/mitra-classifier) and regressor (autogluon/mitra-regressor) model weights on HuggingFace

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23041 2025-10-27 cs.CR cs.AI cs.CL 79%

Virus Infection Attack on LLMs: Your Poisoning Can Spread "VIA" Synthetic Data

Zi Liang, Qingqing Ye, Xuan Liu, Yanyun Wang, Jianliang Xu, Haibo Hu

机构 * The Hong Kong Polytechnic University(香港理工大学) University of California, San Diego(加州大学圣地亚哥分校) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Hong Kong Baptist University(香港 Baptist 大学) PolyU Research Centre for Privacy and Security Technologies in Future Smart Systems(PolyU 未来智能系统隐私与安全技术研究中心)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Camera Ready of NeurIPS 2025 Spotlight. Source code: https://github.com/liangzid/VirusInfectionAttack

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20083 2025-10-27 cs.CL 77%

Universal Cross-Tokenizer Distillation via Approximate Likelihood Matching

Benjamin Minixhofer, Ivan Vulić, Edoardo Maria Ponti

机构 * University of Cambridge(剑桥大学) University of Edinburgh(爱丁堡大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21671 2025-10-27 cs.IR 75%

A Data-Centric Approach to Multilingual E-Commerce Product Search: Case Study on Query-Category and Query-Item Relevance

Yabo Yin, Yang Xi, Jialong Wang, Shanqi Wang, Jiateng Hu

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21326 2025-10-27 cs.CL 74%

Typoglycemia under the Hood: Investigating Language Models' Understanding of Scrambled Words

Gianluca Sperduti, Alejandro Moreo

机构 * Institute of Information Science and Technologies National Research Council University of Pisa(信息科学与技术研究所国家研究 council 皮萨大学)

专题命中 预训练与数据 :language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21322 2025-10-27 cs.LG cs.CL 73%

Leverage Unlearning to Sanitize LLMs

Antoine Boutet, Lucas Magnana

机构 * INSA Lyon, Inria, CITI, UR3720(里昂国立应用科学学院、法国国家科学研究中心、CITI、UR3720) Inria, INSA Lyon, CITI, UR3720(法国国家科学研究中心、里昂国立应用科学学院、CITI、UR3720)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21561 2025-10-27 cs.CL 70%

Are the LLMs Capable of Maintaining at Least the Language Genus?

Sandra Mitrović, David Kletz, Ljiljana Dolamic, Fabio Rinaldi

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20002 2025-10-27 cs.CL cs.AI 62%

Forging GEMs: Advancing Greek NLP through Quality-Based Corpus Curation

Alexandra Apostolopoulou, Konstantinos Kanaris, Athanasios Koursaris, Dimitris Tsakalidis, George Domalis, Ioannis E. Livieris

机构 * Novelcore Department of Statistics & Insurance University of Piraeus(统计与保险系 帕里埃斯大学)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments The manuscript is submitted to Applied Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10226 2025-10-27 cs.CV cs.AI cs.LG 62%

ScoreMix: Synthetic Data Generation by Score Composition in Diffusion Models Improves Recognition

Parsa Rahimi, Sebastien Marcel

机构 * EPFL(苏黎世联邦理工学院) Idiap(日内瓦智能感知研究院)

专题命中 预训练与数据 :foundation model(abstract);分类 cs.AI、cs.LG

Comments Extended version of ICMLw25 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01728 2025-10-27 cs.LG cs.AI 62%

Principled Data Augmentation for Learning to Solve Quadratic Programming Problems

Chendi Qian, Christopher Morris

机构 * Department of Computer Science(计算机科学系) RWTH Aachen University(亚琛工业大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2025 as spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21574 2025-10-27 cs.LG 57%

Leveraging Classical Algorithms for Graph Neural Networks

Jason Wu, Petar Veličković

机构 * University of Cambridge(剑桥大学) Google DeepMind(谷歌DeepMind)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11514 2025-10-27 cs.CL 57%

LVLMs are Bad at Overhearing Human Referential Communication

Zhengxiang Wang, Weiling Li, Panagiotis Kaliosis, Owen Rambow, Susan E. Brennan

机构 * Department of Linguistics(语言学系) Institute for Advanced Computational Science(先进计算科学研究所) Department of Psychology(心理学系) Department of Computer Science, Stony Brook University(石溪大学计算机科学系)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL

Comments EMNLP 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05254 2025-10-27 cs.CL 57%

Uniform Information Density and Syntactic Reduction: Revisiting $\textit{that}$-Mentioning in English Complement Clauses

Hailin Hao, Elsi Kaiser

机构 * University of Southern California(南加州大学)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL

Comments To appear in EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21682 2025-10-27 cs.CV cs.GR 50%

WorldGrow: Generating Infinite 3D World

Sikuang Li, Chen Yang, Jiemin Fang, Taoran Yi, Jia Lu, Jiazhong Cen, Lingxi Xie, Wei Shen, Qi Tian

机构 * MoE Key Lab of Artificial Intelligence, School of Computer Science, SJTU(人工智能前沿实验室,计算机科学学院,上海交通大学) Huawei Inc.(华为公司) Huazhong University of Science and Technology(华中科技大学)

专题命中 预训练与数据 :foundation model(abstract)

Comments Project page: https://world-grow.github.io/ Code: https://github.com/world-grow/WorldGrow

详情

展开后加载摘要…

URL PDF HTML 收藏