arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-08 至 2025-09-08 共收录 150 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 13 篇

2509.04781 2025-09-08 cs.CY cs.AI cs.LG 89%

The LLM Has Left The Chat: Evidence of Bail Preferences in Large Language Models

Danielle Ensign, Henry Sleight, Kyle Fish

专题命中 预训练与数据 :LLM(title);large language model(title);language model(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21509 2025-09-08 cs.CL cs.LG 84%

Persona Vectors: Monitoring and Controlling Character Traits in Language Models

Runjin Chen, Andy Arditi, Henry Sleight, Owain Evans, Jack Lindsey

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02046 2025-09-08 cs.LG cs.AI stat.ML 84%

Fantastic Pretraining Optimizers and Where to Find Them

Kaiyue Wen, David Hall, Tengyu Ma, Percy Liang

机构 * Stanford University(斯坦福大学)

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 108 pages, 8 figures, reproducible runs available at https://wandb.ai/marin-community/optimizer-scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15164 2025-09-08 cs.NE cs.AI cs.LG 82%

From Frege to chatGPT: Compositionality in language, cognition, and deep neural networks

Jacob Russin, Sam Whitman McGrath, Danielle J. Williams

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 19 pages (28 pages including references), 2 figures. Forthcoming in an edited volume on neuroscience and philosophy

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03643 2025-09-08 cs.LG cs.AI 81%

CEHR-XGPT: A Scalable Multi-Task Foundation Model for Electronic Health Records

Chao Pang, Jiheum Park, Xinzhuo Jiang, Nishanth Parameshwar Pavinkurve, Krishna S. Kalluri, Shalmali Joshi, Noémie Elhadad, Karthik Natarajan

机构 * Columbia University Irving Medical Center(哥伦比亚大学伊万格琳医疗中心) Observational Health Data Sciences and Informatics(观察性健康数据科学与信息学) Department of Biomedical Informatics(生物医学信息学系) Columbia University(哥伦比亚大学) NewYork-Presbyterian Hospital(纽约- Presbyterian医院) Department of Computer Science(计算机科学系)

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11813 2025-09-08 cs.CV 80%

SEA: Supervised Embedding Alignment for Token-Level Visual-Textual Integration in MLLMs

Yuanyang Yin, Yaqi Zhao, Yajie Zhang, Yuanxing Zhang, Ke Lin, Jiahao Wang, Xin Tao, Pengfei Wan, Wentao Zhang, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Kuaishou Technology(快手科技)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04871 2025-09-08 cs.AI cs.LG 73%

Cloning a Conversational Voice AI Agent from Call\,Recording Datasets for Telesales

Krittanon Kaewtawee, Wachiravit Modecrua, Krittin Pachtrachai, Touchapon Kraisingkorn

机构 * Amity AI Research and Application Center(阿米蒂AI研究与应用中心)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04515 2025-09-08 cs.CL cs.AI 73%

Mitigation of Gender and Ethnicity Bias in AI-Generated Stories through Model Explanations

Martha O. Dimgba, Sharon Oba, Ameeta Agrawal, Philippe J. Giabbanelli

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04485 2025-09-08 cs.CL cs.AI 73%

ASCENDgpt: A Phenotype-Aware Transformer Model for Cardiovascular Risk Prediction from Electronic Health Records

Chris Sainsbury, Andreas Karwath

机构 * NHS Greater Glasgow and Clyde(英国格拉斯哥和克莱德国家健康服务署) University of Birmingham(伯明翰大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04465 2025-09-08 cs.CL cs.AI 62%

Emotionally-Aware Agents for Dispute Resolution

Sushrita Rakshit, James Hale, Kushal Chawla, Jeanne M. Brett, Jonathan Gratch

机构 * University of Michigan(密歇根大学) University of Southern California(南加州大学) Northwestern University(西北大学)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04921 2025-09-08 cs.LG 57%

Scaling Law for Large-Scale Pre-Training Using Chaotic Time Series and Predictability in Financial Time Series

Yuki Takemoto

机构 * HAY Co., Ltd.(HAY公司)

专题命中 预训练与数据 :foundation model(abstract);分类 cs.LG

Comments Patent pending

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04894 2025-09-08 cs.CV cs.LG 57%

SynGen-Vision: Synthetic Data Generation for training industrial vision models

Alpana Dubey, Suma Mani Kuriakose, Nitish Bhardwaj

机构 * Accenture Labs(埃森哲实验室)

专题命中 预训练与数据 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03959 2025-09-08 cs.SD 50%

WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation

Longhao Li, Zhao Guo, Hongjie Chen, Yuhang Dai, Ziyu Zhang, Hongfei Xue, Tianlun Zuo, Chengyou Wang, Shuiyuan Wang, Jie Li, Jian Kang, Xin Xu, Hui Bu, Binbin Zhang, Ruibin Yuan, Ziya Zhou, Wei Xue, Lei Xie

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) Beijing AISHELL Technology Co., Ltd.(北京AISHELL科技有限公司) WeNet Open Source Community(WeNet开源社区) Hong Kong University of Science and Technology(香港理工大学)

专题命中 预训练与数据 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 15 篇

2509.04753 2025-09-08 cs.CL cs.AI 92%

A Study of Large Language Models for Patient Information Extraction: Model Architecture, Fine-Tuning Strategy, and Multi-task Instruction Tuning

Cheng Peng, Xinyu Dong, Mengxian Lyu, Daniel Paredes, Yaoyun Zhang, Yonghui Wu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04488 2025-09-08 cs.CL cs.AI cs.SD eess.AS 92%

Serialized Output Prompting for Large Language Model-based Multi-Talker Speech Recognition

Hao Shi, Yusuke Fujita, Tomoya Mizumoto, Lianbo Liu, Atsushi Kojima, Yui Sudo

机构 * SB Intuitions

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);prompting(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04512 2025-09-08 cs.CL cs.LG 90%

Scaling behavior of large language models in emotional safety classification across sizes and tasks

Edoardo Pinzuti, Oliver Tüscher, André Ferreira Castro

机构 * Leibniz Institute for Resilience Research(莱比锡韧性研究所) University Medical Center Halle(哈雷医学院) German Center for Mental Health (DZPG)(德国心理健康中心(DZPG)) University Medical Center of the Johannes Gutenberg-University Mainz(美因茨约瑟夫·冯·拉贝大学医学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19920 2025-09-08 cs.LG 89%

Reinforcement Learning for Aligning Large Language Models Agents with Interactive Environments: Quantifying and Mitigating Prompt Overfitting

Mohamed Salim Aissi, Clement Romac, Thomas Carta, Sylvain Lamprier, Pierre-Yves Oudeyer, Olivier Sigaud, Laure Soulier, Nicolas Thome

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04480 2025-09-08 cs.CL cs.LG 88%

Discrete Prompt Tuning via Recursive Utilization of Black-box Multimodal Large Language Model for Personalized Visual Emotion Recognition

Ryo Takahashi, Naoki Saito, Keisuke Maeda, Takahiro Ogawa, Miki Haseyama

机构 * Graduate School of Information Science(信息科学研究生学校) Technology, Hokkaido University, Sapporo 060-0814, Japan(技术,北海道大学,札幌060-0814,日本) Office of Institutional Research, Hokkaido University, Sapporo 060-0808, Japan(机构研究办公室,北海道大学,札幌060-0808,日本) Faculty of Information Science(信息科学学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09600 2025-09-08 cs.AI cs.CR 88%

Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning

Tiansheng Huang, Gautam Bhattacharya, Pratik Joshi, Josh Kimball, Ling Liu

机构 * Georgia Institute of Technology(佐治亚理工学院) Dolby Laboratories(杜比实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Rejected by AAAI25-AIA. Accepted by ICML25. Authors are thankful to the anonymous reviewers from both AAAI25-AIA and ICML25

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03730 2025-09-08 cs.AI cs.CL cs.CY cs.LG stat.ML 88%

The Personality Illusion: Revealing Dissociation Between Self-Reports & Behavior in LLMs

Pengrui Han, Rafal Kocielnik, Peiyang Song, Ramit Debnath, Dean Mobbs, Anima Anandkumar, R. Michael Alvarez

机构 * Caltech(加州理工学院) UIUC(伊利诺伊大学) University of Cambridge(剑桥大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments We make public all code and source data at https://github.com/psychology-of-AI/Personality-Illusion for full reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04884 2025-09-08 cs.CL cs.PF 81%

L1RA: Dynamic Rank Assignment in LoRA Fine-Tuning

Raul Singh, Nicolo Brunello, Vincenzo Scotti, Mark James Carman

机构 * DEIB, Politecnico di Milano(米兰Politecnico大学DEIB系) KASTEL, Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院(KIT)KASTEL)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Work published at ICNLSP 2025, waiting for publication link

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04473 2025-09-08 cs.CL cs.AI 81%

SpeechLLM: Unified Speech and Language Model for Enhanced Multi-Task Understanding in Low Resource Settings

Jaekwon Yoo, Kunal Chandiramani, Divya Tadimeti, Abenezer Girma, Chandra Dhir

机构 * JPMorganChaseUSA(摩根大通公司) Columbia UniversityUSA(哥伦比亚大学)

专题命中 指令微调 :language model(title);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04926 2025-09-08 cs.AI cs.CL cs.LG 80%

Towards Ontology-Based Descriptions of Conversations with Qualitatively-Defined Concepts

Barbara Gendron, Gaël Guibon, Mathieu D'aquin

机构 * Loria, CNRS, Université de Lorraine, Nancy, France(Loria研究所、法国国家科学研究中心、洛林大学、南希分校) Université Sorbonne Paris Nord, CNRS, Laboratoire d'Informatique de Paris Nord, LIPN, F-93430 Villetaneuse, France(巴黎北大学、法国国家科学研究中心、巴黎北信息技术实验室、LIPN、法国)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at TOTh 2025 (Terminology \& Ontology: Theories and applications)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04615 2025-09-08 cs.CL cs.CR cs.LG 73%

Breaking to Build: A Threat Model of Prompt-Based Attacks for Securing LLMs

Brennen Hill, Surendra Parla, Venkata Abhijeeth Balabhadruni, Atharv Prajod Padmalayam, Sujay Chandra Shekara Sharma

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20309 2025-09-08 cs.CV 67%

Instruction-Oriented Preference Alignment for Enhancing Multi-Modal Comprehension Capability of MLLMs

Zitian Wang, Yue Liao, Kang Rong, Fengyun Rao, Yibo Yang, Si Liu

机构 * Beihang University(北航大学) National University of Singapore(国立新加坡大学) King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04642 2025-09-08 cs.AI cs.CL cs.LG cs.SE 67%

Maestro: Joint Graph & Config Optimization for Reliable AI Agents

Wenxiao Wang, Priyatham Kattakinda, Soheil Feizi

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Technical Report by RELAI.ai

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04549 2025-09-08 cs.CL cs.AI 62%

Manipulating Transformer-Based Models: Controllability, Steerability, and Robust Interventions

Faruk Alpay, Taylan Alpay

机构 * Lightcap Department of Future(未来系) Turkish Aeronautical Association(土耳其航空航天协会)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02640 2025-09-08 eess.IV cs.AI cs.CV 57%

Adaptive Learning Strategies for Mitotic Figure Classification in MIDOG2025 Challenge

Biwen Meng, Xi Long, Jingxin Liu

机构 * School of AI and Advanced Computing, Xi’an Jiaotong-Liverpool University(人工智能与先进计算学院,西安交通大学利物浦大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 1 篇

2504.05946 2025-09-08 eess.SY cs.SY 87%

InstructMPC: A Human-LLM-in-the-Loop Framework for Context-Aware Control

Ruixiang Wu, Jiahao Ai, Tongxin Li

专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 2 篇

2509.04523 2025-09-08 cs.CL cs.CY 77%

Using LLMs to create analytical datasets: A case study of reconstructing the historical memory of Colombia

David Anderson, Galia Benitez, Margret Bjarnadottir, Shriyan Reyya

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏