arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-10 至 2025-09-10 共收录 152 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 7 篇

2509.07909 2025-09-10 cs.LG cs.AI cs.CL 89%

Uncovering Scaling Laws for Large Language Models via Inverse Problems

Arun Verma, Zhaoxuan Wu, Zijian Zhou, Xiaoqiang Lin, Zhiliang Chen, Rachael Hwee Ling Sim, Rui Qiao, Jingtan Wang, Nhung Bui, Xinyuan Niu, Wenyang Hu, Gregory Kang Ruey Lau, Zi-Yu Khoo, Zitong Zhao, Xinyi Xu, Apivich Hemachandra, See-Kiong Ng, Bryan Kian Hsiang Low

机构 * Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工联盟研究技术中心) Dept. of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) Agency for Science, Technology and Research(科技研究局) Institute of Data Science, National University of Singapore(新加坡国立大学数据科学研究院) SAP(SAP公司) AI Singapore(AI新加坡)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13362 2025-09-10 cs.IR cs.LG 85%

Lusifer: LLM-based User SImulated Feedback Environment for online Recommender systems

Danial Ebrat, Eli Paradalis, Luis Rueda

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06990 2025-09-10 cs.CV cs.LG 83%

DIET-CP: Lightweight and Data Efficient Self Supervised Continued Pretraining

Bryan Rodas, Natalie Montesino, Jakob Ambsdorf, David Klindt, Randall Balestriero

专题命中 预训练与数据 :pretraining(title,abstract);foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07311 2025-09-10 cs.CL cs.AI 82%

Does This Look Familiar to You? Knowledge Analysis via Model Internal Representations

Sihyun Park

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07923 2025-09-10 cs.CV cs.AI 79%

Multimodal Contrastive Pretraining of CBCT and IOS for Enhanced Tooth Segmentation

Moo Hyun Son, Juyoung Bae, Zelin Qiu, Jiale Peng, Kai Xin Li, Yifan Lin, Hao Chen

机构 * Department of Computer Science and Engineering(计算机科学与工程系) The Hong Kong University of Science and Technology(香港科学与技术大学) Division of Paediatric Dentistry and Orthodontics, Faculty of Dentistry(牙科学院儿童牙科与正畸科) The University of Hong Kong(香港大学) Delun Dental Hospital(德尔伦牙科医院) Department of Chemical and Biological Engineering(化学与生物工程系) Division of Life Science(生命科学系) HKUST Shenzhen-Hong Kong Collaborative Innovation Research Institute(香港科技大学深圳-香港协同创新研究院) State Key Laboratory of Nervous System Disorders(神经系统紊乱国家重点实验室)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14406 2025-09-10 cs.CL 70%

Pierce the Mists, Greet the Sky: Decipher Knowledge Overshadowing via Knowledge Circuit Analysis

Haoming Huang, Yibo Yan, Jiahao Huo, Xin Zou, Xinfeng Li, Kun Wang, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by 2025 EMNLP Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15551 2025-09-10 cs.LG cs.CR stat.ML 57%

On the Benefits of Public Representations for Private Transfer Learning under Distribution Shift

Pratiksha Thaker, Amrith Setlur, Zhiwei Steven Wu, Virginia Smith

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

Comments Published in NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 15 篇

2310.16582 2025-09-10 cs.CL 89%

UPLex: Fine-Grained Personality Control in Large Language Models via Unsupervised Lexical Modulation

Tianlong Li, Wenhao Liu, Muling Wu, Shihan Dou, Zhenghua Wang, Changze Lv, Xiaohua Wang, Xiaoqing Zheng, Xuanjing Huang

机构 * School of Computer Science, Fudan University(复旦大学计算机学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20454 2025-09-10 cs.LG cs.CL 88%

CoMMIT: Coordinated Multimodal Instruction Tuning

Xintong Li, Junda Wu, Tong Yu, Yu Wang, Xiang Chen, Jiuxiang Gu, Lina Yao, Julian McAuley, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校) Adobe Research(Adobe研究) The University of New South Wales(新南威尔士大学) CSIRO’s Data61(澳大利亚联邦科学与工业研究组织的数据61)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04795 2025-09-10 cs.CL cs.AI cs.SD eess.AS 86%

Enhancing Dialogue Annotation with Speaker Characteristics Leveraging a Frozen LLM

Thomas Thebaud, Yen-Ju Lu, Matthew Wiesner, Peter Viechnicki, Najim Dehak

机构 * Electrical and Computer Engineering Department, Johns Hopkins University, Baltimore, MD, USA(约翰霍普金斯大学电气与计算机工程系) Human Language Technology Center of Excellence, Johns Hopkins University, Baltimore, MD, USA(约翰霍普金斯大学人机语言技术卓越中心)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Accepted in the 2025 IEEE Automatic Speech Recognition and Understanding Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07488 2025-09-10 cs.CV cs.AI 79%

Fine-Tuning Vision-Language Models for Visual Navigation Assistance

Xiao Li, Bharat Gandhi, Ming Zhan, Mohit Nehra, Zhicheng Zhang, Yuchen Sun, Meijia Song, Naisheng Zhang, Xi Wang

机构 * University of Florida, Gainesville, FL, USA(佛罗里达大学) University of Minnesota, Minneapolis, MN, USA(明尼苏达大学) New York University, New York, NY, USA(纽约大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23903 2025-09-10 cs.CV cs.AI 79%

Grounding DINO-US-SAM: Text-Prompted Multi-Organ Segmentation in Ultrasound with LoRA-Tuned Vision-Language Models

Hamza Rasaee, Taha Koleilat, Hassan Rivaz

机构 * Department of Electrical and Computer Engineering, Concordia University(电气与计算机工程系,康科迪亚大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

Comments 11 pages, 3 figures, 7 tables

Journal ref IEEE Transactions on Ultrasonics, Ferroelectrics, and Frequency Control, Sept. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06992 2025-09-10 cs.CV 78%

FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models

Kun Zhai, Siheng Chen, Xingjun Ma, Yu-Gang Jiang

机构 * Fudan University, Shanghai, China(复旦大学) Shanghai Jiao Tong University, Shanghai, China(上海交通大学)

专题命中 指令微调 :language model(title,abstract)

Comments ACM MM25

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17450 2025-09-10 cs.CL cs.CY 77%

Persuasion Dynamics in LLMs: Investigating Robustness and Adaptability in Knowledge and Safety with DuET-PD

Bryan Chen Zhengyu Tan, Daniel Wai Kit Chin, Zhengyuan Liu, Nancy F. Chen, Roy Ka-Wei Lee

机构 * Singapore University of Technology and Design (SUTD)(新加坡科技设计大学) Institute for Infocomm Research (I2R), A*STAR, Singapore(信息通信研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments To appear at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07768 2025-09-10 cs.CL cs.AI 73%

Are LLMs Enough for Hyperpartisan, Fake, Polarized and Harmful Content Detection? Evaluating In-Context Learning vs. Fine-Tuning

Michele Joshua Maggini, Dhia Merzougui, Rabiraj Bandyopadhyay, Gaël Dias, Fabrice Maurel, Pablo Gamallo

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12791 2025-09-10 cs.CL cs.AI 73%

CTourLLM: Enhancing LLMs with Chinese Tourism Knowledge

Qikai Wei, Mingzhi Yang, Jinqiang Wang, Wenwei Mao, Jiabo Xu, Huansheng Ning

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07824 2025-09-10 cs.AI 70%

Addition in Four Movements: Mapping Layer-wise Information Trajectories in LLMs

Yao Yan

机构 * Chongqing Normal University(重庆师范大学) College of Computer and Information Science(计算机与信息科学学院) Chongqing Key Lab of Cognitive Intelligence and Intelligent Finance(重庆认知智能与智能金融重点实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 12 pages, including appendix, 7 figures. EMNLP 2025 submission (ARR May 2025 cycle, reviews pending)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04378 2025-09-10 cs.CV 67%

Aesthetic Image Captioning with Saliency Enhanced MLLMs

Yilin Tao, Jiashui Huang, Huaze Xu, Ling Shao

专题命中 指令微调 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11505 2025-09-10 cs.CV 67%

MSCPT: Few-shot Whole Slide Image Classification with Multi-scale and Context-focused Prompt Tuning

Minghao Han, Linhao Qu, Dingkang Yang, Xukun Zhang, Xiaoying Wang, Lihua Zhang

机构 * Academy for Engineering and Technology, Fudan University(工程与技术学院,复旦大学) Fudan University(复旦大学) Zhongshan Hospital, Fudan University(复旦大学中山医院)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments This work has been submitted to the IEEE TMI for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05209 2025-09-10 cs.CL 57%

Hunyuan-MT Technical Report

Mao Zheng, Zheng Li, Bingxin Qu, Mingyang Song, Yang Du, Mingrui Sun, Di Wang

机构 * Tencent Hunyuan Team(腾讯文心团队)

专题命中 指令微调 :SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10548 2025-09-10 cs.LG q-bio.BM 57%

BioNeMo Framework: a modular, high-performance library for AI model development in drug discovery

Peter St. John, Dejun Lin, Polina Binder, Malcolm Greaves, Vega Shah, John St. John, Adrian Lange, Patrick Hsu, Rajesh Illango, Arvind Ramanathan, Anima Anandkumar, David H Brookes, Akosua Busia, Abhishaike Mahajan, Stephen Malina, Neha Prasad, Sam Sinai, Lindsay Edwards, Thomas Gaudelet, Cristian Regep, Martin Steinegger, Burkhard Rost, Alexander Brace, Kyle Hippe, Luca Naef, Keisuke Kamata, George Armstrong, Kevin Boyd, Zhonglin Cao, Han-Yi Chou, Simon Chu, Allan dos Santos Costa, Sajad Darabi, Eric Dawson, Kieran Didi, Cong Fu, Mario Geiger, Michelle Gill, Darren J Hsu, Gagan Kaushik, Maria Korshunova, Steven Kothen-Hill, Youhan Lee, Meng Liu, Micha Livne, Zachary McClure, Jonathan Mitchell, Alireza Moradzadeh, Ohad Mosafi, Youssef Nashed, Saee Paliwal, Yuxing Peng, Sara Rabhi, Farhad Ramezanghorbani, Danny Reidenbach, Camir Ricketts, Brian C Roland, Kushal Shah, Tyler Shimko, Hassan Sirelkhatim, Savitha Srinivasan, Abraham C Stern, Dorota Toczydlowska, Srimukh Prasad Veccham, Niccolò Alberto Elia Venanzi, Anton Vorontsov, Jared Wilber, Isabel Wilkinson, Wei Jing Wong, Eva Xue, Cory Ye, Xin Yu, Yang Zhang, Guoqing Zhou, Becca Zandstein, Alejandro Chacon, Prashant Sohani, Maximilian Stadler, Christian Hundt, Feiwen Zhu, Christian Dallago, Bruno Trentini, Emine Kucukbenli, Saee Paliwal, Timur Rvachov, Eddie Calleja, Johnny Israeli, Harry Clifford, Risto Haukioja, Nicholas Haemel, Kyle Tretina, Neha Tadimeti, Anthony B Costa

专题命中 指令微调 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09788 2025-09-10 cs.SD eess.AS 50%

HingeNet: A Harmonic-Aware Fine-Tuning Approach for Beat Tracking

Ganghui Ru, Jieying Wang, Jiahao Zhao, Yulun Wu, Yi Yu, Nannan Jiang, Wei Wang, Wei Li

机构 * School of Computer Science, Fudan University, Shanghai, China(复旦大学计算机科学学院) Naval Medical Center, PLA, China(中国人民解放军海军医疗中心) Graduate School of Informatics, Kyoto University, Kyoto, Japan(京都大学信息科学研究生院) Graduate School of Advanced Science and Engineering, Hiroshima University, Hiroshima, Japan(广岛大学先进科学与工程研究生院) Shanghai Key Laboratory of Intelligent Information Processing, Fudan University, Shanghai, China(上海智能信息处理重点实验室)

专题命中 指令微调 :foundation model(abstract)

Comments Early draft for discussion only. Undergoing active revision, conclusions subject to change. Do not cite. Formal peer-reviewed version in preparation

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 4 篇

2509.06980 2025-09-10 cs.LG cs.AI 90%

RLFactory: A Plug-and-Play Reinforcement Learning Post-Training Framework for LLM Multi-Turn Tool-Use

Jiajun Chai, Guojun Yin, Zekun Xu, Chuhuai Yue, Yi Jia, Siyu Xia, Xiaohan Wang, Jiwen Jiang, Xiaoguang Li, Chengqi Dong, Hang He, Wei Lin

机构 * RLFactory Team(RLFactory团队)

专题命中 后训练与偏好优化 :post-training(title,abstract);LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18463 2025-09-10 cs.CV 78%

DIP: Unsupervised Dense In-Context Post-training of Visual Representations

Sophia Sirko-Galouchenko, Spyros Gidaris, Antonin Vobecky, Andrei Bursuc, Nicolas Thome

机构 * Sorbonne Université, CNRS, ISIR(索邦大学、国家科学研究中心、ISIR) FEE CTU(捷克技术大学电子工程系) CIIRC CTU Prague(捷克技术大学普拉格研究所) Institut universitaire de France (IUF)(法国国家科学院)

专题命中 后训练与偏好优化 :post-training(title,abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07006 2025-09-10 cs.CY cs.AI cs.CL cs.LG 75%

ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code

Kapil Madan

机构 * Principled Evolution(原则进化)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 53 pages, 7 figures, 8 tables. Open-source implementation available at: https://github.com/Principled-Evolution/argen-demo. Work explores the integration of policy-as-code for AI alignment, with a case study in culturally-nuanced, ethical AI using Dharmic principles

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07108 2025-09-10 stat.ML cs.LG 57%

ADHAM: Additive Deep Hazard Analysis Mixtures for Interpretable Survival Regression

Mert Ketenci, Vincent Jeanselme, Harry Reyes Nieva, Shalmali Joshi, Noémie Elhadad

机构 * Columbia University(哥伦比亚大学)

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 2 篇

2509.07555 2025-09-10 cs.CL cs.AI 73%

Avoiding Knowledge Edit Skipping in Multi-hop Question Answering with Guided Decomposition

Yi Liu, Xiangrong Zhu, Xiangyu Liu, Wei Wei, Wei Hu

机构 * State Key Laboratory for Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室,南京大学,中国) National Institute of Healthcare Data Science, Nanjing University, China(医疗数据科学国家研究院,南京大学,中国)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted in EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06401 2025-09-10 cs.DL cs.AI cs.CL cs.IR 62%

A Systematic Literature Review of Retrieval-Augmented Generation: Techniques, Metrics, and Challenges

Andrew Brown, Muhammad Roman, Barry Devereux

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI

Comments 58 page

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 推理与问题求解 27 篇

2509.07399 2025-09-10 cs.CL 90%

The Role of Exploration Modules in Small Language Models for Knowledge Graph Question Answering

Yi-Jie Cheng, Oscar Chew, Yun-Nung Chen

机构 * ASUS National Taiwan University(国立台湾大学)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

Comments Extended from ACL 2025 SRW

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15552 2025-09-10 cs.CR cs.CL 85%

Personalized Attacks of Social Engineering in Multi-turn Conversations: LLM Agents for Simulation and Detection

Tharindu Kumarage, Cameron Johnson, Jadie Adams, Lin Ai, Matthias Kirchner, Anthony Hoogs, Joshua Garland, Julia Hirschberg, Arslan Basharat, Huan Liu

机构 * Arizona State University(亚利桑那州立大学) Kitware, Inc(Kitware公司) Columbia University(哥伦比亚大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted as a paper at COLM 2025 Workshop on AI Agents: Capabilities and Safety

详情

展开后加载摘要…

URL PDF HTML 收藏