arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-30 至 2025-10-30 共收录 164 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 10 篇

2510.25273 2025-10-30 cs.CL 86%

Adapting Small Language Models to Low-Resource Domains: A Case Study in Hindi Tourism QA

Sandipan Majhi, Paheli Bhattacharya

机构 * Indian Institute of Technology Kharagpur, India(印度理工学院Kharagpur分校) Bosch Research(博世研究) Technology Centre, Bangalore, India(技术中心,班加罗尔,印度)

专题命中 预训练与数据 :language model(title,abstract);small language model(title);分类 cs.CL

Comments Accepted at the Forum for Information Retrieval Evaluation 2025 (VATIKA Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25771 2025-10-30 cs.CL cs.AI 84%

Gaperon: A Peppered English-French Generative Language Model Suite

Nathan Godey, Wissam Antoun, Rian Touchent, Rachel Bawden, Éric de la Clergerie, Benoît Sagot, Djamé Seddah

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25413 2025-10-30 cs.CL 83%

Seeing, Signing, and Saying: A Vision-Language Model-Assisted Pipeline for Sign Language Data Acquisition and Curation from Social Media

Shakib Yazdani, Yasser Hamidullah, Cristina España-Bonet, Josef van Genabith

机构 * German Research Center for Artificial Intelligence (DFKI GmbH)(德国人工智能研究中心(DFKI GmbH)) Saarland Informatics Campus(萨尔兰州信息技术校区) Barcelona Supercomputing Center (BSC-CNS)(巴塞罗那超级计算中心(BSC-CNS))

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Accepted by RANLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24963 2025-10-30 cs.CL 83%

Language Model Behavioral Phases are Consistent Across Architecture, Training Data, and Scale

James A. Michaelov, Roger P. Levy, Benjamin K. Bergen

机构 * Department of Brain and Cognitive Sciences, MIT(麻省理工学院脑科学与认知科学系) MIT Libraries CREOS(麻省理工学院图书馆 CREOS) Deparmtent of Cognitive Science, UCSD(加州大学圣地亚哥分校认知科学系)

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments To be presented at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25378 2025-10-30 cs.CL cs.AI 82%

Hallucinations in Bibliographic Recommendation: Citation Frequency as a Proxy for Training Data Redundancy

Junichiro Niimi

机构 * Meijo University(名古屋大学) RIKEN AIP(理化学研究所AIP)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25116 2025-10-30 cs.CL 79%

Pretraining Strategies using Monolingual and Parallel Data for Low-Resource Machine Translation

Idriss Nguepi Nguefack, Mara Finkelstein, Toadoum Sari Sakayo

机构 * AIMS Senegal(塞内加尔AIMS)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL

Comments 8 pages, 1. figure

Journal ref ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23252 2025-10-30 cs.CL 79%

Are ASR foundation models generalized enough to capture features of regional dialects for low-resource languages?

Tawsif Tashwar Dipto, Azmol Hossain, Rubayet Sabbir Faruque, Md. Rezuwan Hassan, Kanij Fatema, Tanmoy Shome, Ruwad Naswan, Md. Foriduzzaman Zihad, Mohaymen Ul Anam, Nazia Tasnim, Hasan Mahmud, Md Kamrul Hasan, Md. Mehedi Hasan Shawon, Farig Sadeque, Tahsin Reasat

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.CL

Comments The manuscript has to be withdrawn to address an authorship and intellectual property clarification

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01737 2025-10-30 cs.LG 70%

Enlightenment Period Improving DNN Performance

Tiantian Liu, Meng Wan, Jue Wang, Ningming Nie

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25384 2025-10-30 cs.CL 57%

Roleplaying with Structure: Synthetic Therapist-Client Conversation Generation from Questionnaires

Doan Nam Long Vu, Rui Tan, Lena Moench, Svenja Jule Francke, Daniel Woiwod, Florian Thomas-Odenthal, Sanna Stroth, Tilo Kircher, Christiane Hermann, Udo Dannlowski, Hamidreza Jamalabadi, Shaoxiong Ji

机构 * Technical University of Darmstadt(达姆施塔特技术大学) Philipps-University Marburg(马尔堡菲利普斯大学) Justus Liebig University Giessen(吉森约斯特·利伯格大学) University of Münster(明斯特大学) ELLIS Institute Finland(芬兰ELLIS研究所) University of Turku(图尔库大学)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24927 2025-10-30 cs.LG 57%

WBT-BGRL: A Non-Contrastive Weighted Bipartite Link Prediction Model for Inductive Learning

Joel Frank Huarayo Quispe, Lilian Berton, Didier Vega-Oliveros

机构 * Institute of Science and Technology(科学与技术研究所) Federal University of São Paulo (UNIFESP)(圣保罗联邦大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

Comments 5 pages, submitted to the 12th International Conference on Soft Computing and Machine Intelligence (ISCMI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 6 篇

2504.06426 2025-10-30 cs.CL cs.LG 86%

S'MoRE: Structural Mixture of Residual Experts for Parameter-Efficient LLM Fine-tuning

Hanqing Zeng, Yinglong Xia, Zhuokai Zhao, Chuan Jiang, Qiang Zhang, Jiayi Liu, Qunshu Zhang, Lizhu Zhang, Xiangjun Fan, Benyu Zhang

机构 * Meta AI

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25364 2025-10-30 cs.CL 79%

CLASS-IT: Conversational and Lecture-Aligned Small-Scale Instruction Tuning for BabyLMs

Luca Capone, Alessandro Bondielli, Alessandro Lenci

机构 * CoLing Lab, Department of Philology, Literature and Linguistics, University of Pisa(皮尔切大学哲学、文学与语言学系语言实验室) Department of Computer Science, University of Pisa(皮尔切大学计算机科学系)

专题命中 指令微调 :instruction tuning(title,abstract);分类 cs.CL

Comments Paper accepted for oral presentation at the BabyLM Challange 2025 (EMNLP2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22149 2025-10-30 cs.AI cs.LG 79%

When Truthful Representations Flip Under Deceptive Instructions?

Xianxuan Long, Yao Fu, Runchao Li, Mu Sheng, Haotian Yu, Xiaotian Han, Pan Li

机构 * Case Western Reserve University(凯斯西储大学) Hangzhou Dianzi University(杭州电子科技大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25528 2025-10-30 cs.AI 70%

Zero Reinforcement Learning Towards General Domains

Yuyuan Zeng, Yufei Huang, Can Xu, Qingfeng Sun, Jianfeng Yan, Guanghui Xu, Tao Yang, Fengzong Lian

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23722 2025-10-30 cs.CL 70%

LLMs are Better Than You Think: Label-Guided In-Context Learning for Named Entity Recognition

Fan Bai, Hamid Hassanzadeh, Ardavan Saeedi, Mark Dredze

机构 * Johns Hopkins University(约翰霍普金斯大学) Optum(奥普姆)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25616 2025-10-30 cs.LG cs.AI cs.RO 62%

Don't Blind Your VLA: Aligning Visual Representations for OOD Generalization

Nikita Kachaev, Mikhail Kolosov, Daniil Zelezetsky, Alexey K. Kovalev, Aleksandr I. Panov

机构 * Cognitive AI Lab(认知人工智能实验室) Cognitive AI Lab, IAI MIPT(认知人工智能实验室,IAI MIPT)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 6 篇

2506.01183 2025-10-30 cs.LG cs.AI stat.ML 91%

Doubly Robust Alignment for Large Language Models

Erhan Xu, Kai Ye, Hongyi Zhou, Luhan Zhu, Francesco Quinzan, Chengchun Shi

机构 * Department of Statistics(统计系) LSE London, UK(伦敦大学学院) Department of Mathematics(数学系) Tsinghua University(清华大学) School of Design LCC, UAL London, UK(伦敦艺术大学设计学院) Department of Engineering Science(工程科学系) University of Oxford(牛津大学)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);RLHF(abstract);preference optimization(abstract)

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05158 2025-10-30 cs.CL 90%

Steering Information Utility in Key-Value Memory for Language Model Post-Training

Chunyuan Deng, Ruidi Chang, Hanjie Chen

机构 * Dept. of Computer Science Rice University(计算机科学系 瑞士大学)

专题命中 后训练与偏好优化 :language model(title,abstract);post-training(title,abstract);pretraining(abstract);SFT(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01308 2025-10-30 cs.AI cs.CL cs.DB 88%

GradeSQL: Test-Time Inference with Outcome Reward Models for Text-to-SQL Generation from Large Language Models

Mattia Tritto, Giuseppe Farano, Dario Di Palma, Gaetano Rossiello, Fedelucio Narducci, Dharmashankar Subramanian, Tommaso Di Noia

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03690 2025-10-30 cs.CL 85%

Robust Preference Optimization via Dynamic Target Margins

Jie Sun, Junkang Wu, Jiancan Wu, Zhibo Zhu, Xingyu Lu, Jun Zhou, Lintao Ma, Xiang Wang

专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 18 pages, 6 figures, accepted to Findings of the 63rd Annual Meeting of the Association for Computational Linguistics (ACL 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23965 2025-10-30 cs.AI cs.LG stat.ML 84%

The Sign Estimator: LLM Alignment in the Face of Choice Heterogeneity

Ali Aouad, Aymane El Gadarri, Vivek F. Farias

机构 * MIT(麻省理工学院)

专题命中 后训练与偏好优化 :LLM(title,abstract);RLHF(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14755 2025-10-30 cs.DC cs.AI 83%

Data-Juicer 2.0: Cloud-Scale Adaptive Data Processing for and with Foundation Models

Daoyuan Chen, Yilun Huang, Xuchen Pan, Nana Jiang, Haibin Wang, Yilei Zhang, Ce Ge, Yushuo Chen, Wenhao Zhang, Zhijian Ma, Jun Huang, Wei Lin, Yaliang Li, Bolin Ding, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 后训练与偏好优化 :foundation model(title,abstract);post-training(abstract);分类 cs.AI

Comments Accepted by NeurIPS 2025 (Spotlight). 43 pages, 16 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 2 篇

2510.24726 2025-10-30 eess.SP cs.CY stat.AP 82%

Modelling Real-Life Cycling Decisions in Real Urban Settings Through Psychophysiology and LLM-Derived Contextual Data

Maximiliano Rosadio Z., Angel Jimenez-Molina, Bastián Henríquez, Paulina Leiva, Ricardo Hurtubia, Ricardo De La Paz Guala, Leandro Gayozo, C. Angelo Guevara

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract)

Comments 31 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25668 2025-10-30 cs.AI cs.MM 57%

ALDEN: Reinforcement Learning for Active Navigation and Evidence Gathering in Long Documents

Tianyu Yang, Terry Ruas, Yijun Tian, Jan Philip Wahle, Daniel Kurzawe, Bela Gipp

机构 * University of Göttingen(戈丁根大学) University of Notre Dame(诺特大学) State and University Library of Göttingen(戈丁根州立大学图书馆)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 推理与问题求解 37 篇

2510.25206 2025-10-30 cs.AI cs.CL cs.LG 90%

RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models

Tianqianjin Lin, Xi Zhao, Xingyao Zhang, Rujiao Long, Yi Xu, Zhuoren Jiang, Wenbo Su, Bo Zheng

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 17 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24811 2025-10-30 cs.CL cs.AI cs.LG 90%

ProofSketch: Efficient Verified Reasoning for Large Language Models

Disha Sheshanarayana, Tanishka Magar

机构 * Manipal University Jaipur(马普尔大学斋普尔)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025, ER Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12571 2025-10-30 cs.CE cs.AI cs.CL 90%

Large Language Models for Combinatorial Optimization of Design Structure Matrix

Shuo Jiang, Min Xie, Jianxi Luo

机构 * City University of Hong Kong(香港城市大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Journal ref Proc. Des. Soc. 5 (2025) 2201-2210

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13002 2025-10-30 cs.HC cs.AI cs.CL 90%

AutoTRIZ: Automating Engineering Innovation with TRIZ and Large Language Models

Shuo Jiang, Weifeng Li, Yuping Qian, Yangjun Zhang, Jianxi Luo

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 28 pages, 12 figures

Journal ref Advanced Engineering Informatics 65 (2025): 103312

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23822 2025-10-30 cs.AI 89%

ReCAP: Recursive Context-Aware Reasoning and Planning for Large Language Model Agents

Zhenyu Zhang, Tianyi Chen, Weiran Xu, Alex Pentland, Jiaxin Pei

机构 * Department of Computer Science, Stanford University(斯坦福大学计算机科学系) Stanford Institute for Human-Centered AI(斯坦福大学人本人工智能研究所) MIT Media Lab(麻省理工学院媒体实验室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24155 2025-10-30 cs.CL 89%

Blind Spot Navigation in Large Language Model Reasoning with Thought Space Explorer

Jinghan Zhang, Fengran Mo, Tharindu Cyril Weerasooriya, Xinyue Ye, Dongjie Wang, Yanjie Fu, Kunpeng Liu

机构 * Clemson University(克莱姆森大学) Université de Montréal(蒙特利尔大学) Center for Advanced AI, Accenture(Accenture高级人工智能中心) The University of Alabama(阿拉巴马大学) University of Kansas(堪萨斯大学) Arizona State University(亚利桑那州立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏