arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-20 至 2025-11-20 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 7 篇

2508.17184 2025-11-20 cs.CL 92%

Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models

Xudong Han, Junjie Yang, Tianyang Wang, Ziqian Bi, Xinyuan Song, Junfeng Hao, Junhao Song

机构 * Department of Informatics, University of Sussex(信息学院,苏塞克斯大学) Pingtan Research Institute, Xiamen University(平潭研究院,厦门大学) Department of Computer Science, University of Liverpool(计算机科学系,利物浦大学) Department of Computer Science, Purdue University(计算机科学系,普渡大学) Department of Computer Science, Emory University(计算机科学系,埃默里大学) AI Agent Lab, Vokram Group(AI代理实验室,Vokram集团) Department of Computing, Imperial College London(计算系,帝国理工学院伦敦分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.CL

Comments 24 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05981 2025-11-20 cs.SE 89%

Multi-Agent Debate Strategies to Enhance Requirements Engineering with Large Language Models

Marc Oriol, Quim Motger, Jordi Marco, Xavier Franch

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13625 2025-11-20 cs.LG cs.CL cs.CR 88%

Privacy Preserving In-Context-Learning Framework for Large Language Models

Bishnu Bhusal, Manoj Acharya, Ramneet Kaur, Colin Samplawski, Anirban Roy, Adam D. Cobb, Rohit Chadha, Susmit Jha

机构 * SRI

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Git repo: https://github.com/bhusalb/privacy-preserving-icl

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03527 2025-11-20 cs.CL cs.LG 87%

FANAL -- Financial Activity News Alerting Language Modeling Framework

Urjitkumar Patel, Fang-Chun Yeh, Chinmay Gondhalekar, Hari Nalluri

专题命中 指令微调 :language model(title,abstract);large language model(abstract,comments);preference optimization(abstract);分类 cs.CL、cs.LG

Comments Accepted for the IEEE International Workshop on Large Language Models for Finance, 2024. This is a preprint version

Journal ref 2024 IEEE International Conference on Big Data, Dec 15-18, 2024, Electronic ISBN: 979-8-3503-6248-0, Electronic ISSN: 2573-2978

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15404 2025-11-20 cs.IT math.IT 78%

Communication-Pipelined Split Federated Learning for Foundation Model Fine-Tuning in UAV Networks

Zizhen Zhou, Ying-Chang Liang, Yanyu Cheng, Wei Yang Bryan Lim

专题命中 指令微调 :foundation model(title,abstract)

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10694 2025-11-20 cs.CL 74%

Where does an LLM begin computing an instruction?

Aditya Pola, Vineeth N. Balasubramanian

机构 * Indian Institute of Technology, Hyderabad(印度海得拉巴印度理工学院)

专题命中 指令微调 :LLM(title);分类 cs.CL

Comments Extended Abstract accepted at UniReps '25 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15379 2025-11-20 cs.CV 67%

Zero-Shot Open-Vocabulary Human Motion Grounding with Test-Time Training

零样本开放词汇人体运动接地与测试时训练

Yunjiao Zhou, Xinyan Chen, Junlang Qian, Lihua Xie, Jianfei Yang

专题命中 指令微调 :large language model(abstract);language model(abstract)

AI总结 本文提出ZOMG框架,通过语言语义分区和软掩码优化,在无需标注或微调的情况下实现零样本开放词汇的人体运动接地,提升了运动理解的性能和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏