arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-10 至 2025-10-10 共收录 247 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 14 篇

2509.05258 2025-10-10 cs.DC cs.AI 92%

Scaling Performance of Large Language Model Pretraining

Alexander Interrante-Grant, Carla Varela-Rosa, Suhaas Narayan, Chris Connelly, Albert Reuther

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(title,abstract);分类 cs.AI

Journal ref Proc. IEEE High Performance Extreme Computing Conference (HPEC), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07321 2025-10-10 cs.HC econ.GN q-fin.EC 88%

How human is the machine? Evidence from 66,000 Conversations with Large Language Models

Antonios Stamatogiannakis, Arsham Ghodsinia, Sepehr Etminanrad, Dilney Gonçalves, David Santos

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08245 2025-10-10 cs.CL cs.AI cs.LG 85%

Contrastive Decoding for Synthetic Data Generation in Low-Resource Language Modeling

Jannek Ulm, Kevin Du, Vésteinn Snæbjarnarson

机构 * ETH Zürich(苏黎世联邦理工学院) University of Copenhagen(哥本哈根大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07841 2025-10-10 cs.LG cs.AI cs.CL 85%

Self-Improving LLM Agents at Test-Time

Emre Can Acikgoz, Cheng Qian, Heng Ji, Dilek Hakkani-Tür, Gokhan Tur

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 预训练与数据 :LLM(title);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08572 2025-10-10 cs.RO cs.AI cs.LG 81%

BLAZER: Bootstrapping LLM-based Manipulation Agents with Zero-Shot Data Generation

Rocktim Jyoti Das, Harsh Singh, Diana Turmakhan, Muhammad Abdullah Sohail, Mingfei Han, Preslav Nakov, Fabio Pizzati, Ivan Laptev

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 预训练与数据 :LLM(title,abstract);分类 cs.AI、cs.LG

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08238 2025-10-10 cs.AI 77%

Chain-of-Trigger: An Agentic Backdoor that Paradoxically Enhances Agentic Robustness

Jiyang Qiu, Xinbei Ma, Yunqing Xu, Zhuosheng Zhang, Hai Zhao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07434 2025-10-10 cs.CL 70%

Lemma Dilemma: On Lemma Generation Without Domain- or Language-Specific Training Data

Olia Toporkov, Alan Akbik, Rodrigo Agerri

机构 * HiTZ Center - Ixa, University of the Basque Country UPV/EHU(巴斯克大学希茨中心 - Ixa,巴斯克国家大学UPV/EHU) Humboldt-Universität zu Berlin(柏林洪堡大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 14 pages, 2 figures, 5 tables. Accepted to EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08485 2025-10-10 cs.CV 67%

InstructX: Towards Unified Visual Editing with MLLM Guidance

Chong Mou, Qichao Sun, Yanze Wu, Pengze Zhang, Xinghui Li, Fulong Ye, Songtao Zhao, Qian He

机构 * Intelligent Creation Team, ByteDance(字节跳动智能创作团队)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08404 2025-10-10 cs.CL cs.AI cs.LG 67%

Single layer tiny Co$^4$ outpaces GPT-2 and GPT-BERT

Noor Ul Zain, Mohsin Raza, Ahsan Adeel

机构 * CMI-Lab University of Stirling(CMI实验室斯特林大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00885 2025-10-10 cs.CL cs.LG 62%

Scaling Laws Are Unreliable for Downstream Tasks: A Reality Check

Nicholas Lourie, Michael Y. Hu, Kyunghyun Cho

机构 * New York University(纽约大学) Prescient Design CIFAR LMB

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.LG

Comments EMNLP Findings 2025 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08113 2025-10-10 cs.LG cs.AI cs.MA 62%

Bayesian Decision Making around Experts

Daniel Jarne Ornia, Joel Dyer, Nicholas Bishop, Anisoara Calinescu, Michael Wooldridge

机构 * University of Oxford(牛津大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07983 2025-10-10 cs.DB cs.AI 57%

ZeroCard: Cardinality Estimation with Zero Dependence on Target Databases -- No Data, No Query, No Retraining

Xianghong Xu, Rong Kang, Xiao He, Lei Zhang, Jianjun Chen, Tieying Zhang

机构 * ByteDance Beijing China(字节跳动北京) ByteDance Hangzhou China(字节跳动杭州) ByteDance San Jose USA(字节跳动圣何塞)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22021 2025-10-10 cs.CV cs.AI 57%

GL-PGENet: A Parameterized Generation Framework for Robust Document Image Enhancement

Zhihong Tang

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08143 2025-10-10 cs.CV 50%

UniMMVSR: A Unified Multi-Modal Framework for Cascaded Video Super-Resolution

Shian Du, Menghan Xia, Chang Liu, Quande Liu, Xintao Wang, Pengfei Wan, Xiangyang Ji

机构 * Tsinghua University(清华大学) Huazhong University of Science and Technology(华中科技大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队)

专题命中 预训练与数据 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 15 篇

2510.08466 2025-10-10 cs.LG 88%

In-Context Clustering with Large Language Models

Ying Wang, Mengye Ren, Andrew Gordon Wilson

机构 * New York University(纽约大学)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08191 2025-10-10 cs.CL 84%

Training-Free Group Relative Policy Optimization

Yuzheng Cai, Siqi Cai, Yuchen Shi, Zihan Xu, Lichao Chen, Yulei Qin, Xiaoyu Tan, Gang Li, Zongyi Li, Haojia Lin, Yong Mao, Ke Li, Xing Sun

机构 * Tencent(腾讯)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02011 2025-10-10 cs.CV 82%

OASIS: Online Sample Selection for Continual Visual Instruction Tuning

Minjae Lee, Minhyuk Seo, Tingyu Qu, Tinne Tuytelaars, Jonghyun Choi

机构 * Seoul National University(首尔国立大学) KU Leuven(库尔勒文大学)

专题命中 指令微调 :instruction tuning(title,abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19786 2025-10-10 cs.CL 81%

Flora: Effortless Context Construction to Arbitrary Length and Scale

Tianxiang Chen, Zhentao Tan, Xiaofan Bo, Yue Wu, Tao Gong, Qi Chu, Jieping Ye, Nenghai Yu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08149 2025-10-10 cs.CL cs.AI cs.LG 80%

AI Knowledge Assist: An Automated Approach for the Creation of Knowledge Bases for Conversational AI Agents

Md Tahmid Rahman Laskar, Julien Bouvier Tremblay, Xue-Yong Fu, Cheng Chen, Shashi Bhushan TN

机构 * Dialpad Inc.(Dialpad公司)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to the EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07835 2025-10-10 cs.LG cs.AI cs.CL cs.CR 80%

MetaDefense: Defending Finetuning-based Jailbreak Attack Before and During Generation

Weisen Jiang, Sinno Jialin Pan

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted By NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01674 2025-10-10 cs.CV 80%

MotionSight: Boosting Fine-Grained Motion Understanding in Multimodal LLMs

Yipeng Du, Tiehan Fan, Kepan Nan, Rui Xie, Penghao Zhou, Xiang Li, Jian Yang, Zhenheng Yang, Ying Tai

机构 * Nanjing University(南京大学) ByteDance(字节跳动) Nankai University(南开大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22745 2025-10-10 cs.CR cs.AI 77%

Defending MoE LLMs against Harmful Fine-Tuning via Safety Routing Alignment

Jaehan Kim, Minkyoo Song, Seungwon Shin, Sooel Son

机构 * KAIST(韩国科学技术院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19128 2025-10-10 cs.LG 77%

Personalized Federated Fine-Tuning for LLMs via Data-Driven Heterogeneous Model Architectures

Yicheng Zhang, Zhen Qin, Zhaomin Wu, Jian Hou, Shuiguang Deng

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Zhejiang Sci-Tech University(浙江科技学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments On going work. Codes are released at https://github.com/zyc140345/FedAMoLE

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01342 2025-10-10 cs.CR 75%

Fine-Tuning Jailbreaks under Highly Constrained Black-Box Settings: A Three-Pronged Approach

Xiangfang Li, Yu Wang, Bo Li

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02843 2025-10-10 cs.CY cs.AI cs.LG 73%

Thousands of AI Authors on the Future of AI

Katja Grace, Harlan Stewart, Julia Fabienne Sandkühler, Stephen Thomas, Ben Weinstein-Raun, Jan Brauner, Richard C. Korzekwa

机构 * AI Impacts Berkeley, California United States(伯克利加州大学) Department of Psychology University of Bonn(波恩大学心理学系) University of Bonn(波恩大学) Department of Computer Science University of Oxford(牛津大学计算机科学系) University of Oxford(牛津大学) Independent(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments The asterisk indicates the corresponding author. The dagger indicates equal contribution

Journal ref Journal of Artificial Intelligence Research 84:9 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06825 2025-10-10 cs.CL 70%

Adaptive Tool Generation with Models as Tools and Reinforcement Learning

Chenpeng Wang, Xiaojie Cheng, Chunye Wang, Linfeng Yang, Lei Zhang

机构 * Chenpeng Wang(王晨鹏) Xiaojie Cheng(程晓杰) Chunye Wang(王春业) Linfeng Yang(杨林峰) Lei Zhang(张磊)

专题命中 指令微调 :language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05145 2025-10-10 cs.LG cs.AI cs.CL 67%

Understanding In-context Learning of Addition via Activation Subspaces

Xinyan Hu, Kayo Yin, Michael I. Jordan, Jacob Steinhardt, Lijie Chen

机构 * UC Berkeley(伯克利大学) INRIA(法国国家信息与自动化研究所)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07645 2025-10-10 cs.CL cs.AI 62%

Banking Done Right: Redefining Retail Banking with Language-Centric AI

Xin Jie Chua, Jeraelyn Ming Li Tan, Jia Xuan Tan, Soon Chang Poh, Yi Xian Goh, Debbie Hui Tian Choong, Chee Mun Foong, Sze Jue Yang, Chee Seng Chan

机构 * Universiti Malaya(马来大学) YTL AI Labs(YTL人工智能实验室) Ryt Bank(Ryt银行)

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00139 2025-10-10 cs.CV 50%

EFSA: Episodic Few-Shot Adaptation for Text-to-Image Retrieval

Muhammad Huzaifa, Yova Kementchedjhieva

机构 * MBZUAI(马尔堡人工智能研究所)

专题命中 指令微调 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 8 篇

2510.08256 2025-10-10 cs.LG cs.AI cs.CL 89%

Mix- and MoE-DPO: A Variational Inference Approach to Direct Preference Optimization

Jason Bohne, Pawel Polak, David Rosenberg, Brian Bloniarz, Gary Kazantsev

机构 * Department of Applied Mathematics and Statistics(应用数学与统计学系) Stony Brook University(石溪大学) Institute for Advanced Computational Science(先进计算科学研究所) Center of Excellence in Wireless and Information Technology (CEWIT)(无线与信息技术卓越中心) AI Innovation Institute(人工智能创新研究院) Bloomberg(彭博) Toronto, ON M5J 2S1(多伦多,ON M5J 2S1) San Francisco, CA 94105(旧金山,CA 94105) Bloomberg New York, NY 10022(纽约,NY 10022)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏