arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11667 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11667 篇

2403.07300 2025-04-09 cs.LG cs.CL 79%

CALF: Aligning LLMs for Time Series Forecasting via Cross-modal Fine-Tuning

Peiyuan Liu, Hang Guo, Tao Dai, Naiqi Li, Jigang Bao, Xudong Ren, Yong Jiang, Shu-Tao Xia

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03713 2025-04-08 cs.LG cs.AI cs.CE 79%

RLDBF: Enhancing LLMs Via Reinforcement Learning With DataBase FeedBack

Weichen Dai, Zijie Dai, Zhijie Huang, Yixuan Pan, Xinhe Li, Xi Li, Yi Zhou, Ji Qi, Wu Jiang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20228 2025-03-27 cs.LG cs.CL 79%

TeleLoRA: Teleporting Model-Specific Alignment Across LLMs

Xiao Lin, Manoj Acharya, Anirban Roy, Susmit Jha

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15190 2025-03-27 cs.AI cs.CL cs.CV cs.RO 79%

Socratic Planner: Self-QA-Based Zero-Shot Planning for Embodied Instruction Following

Suyeon Shin, Sujin jeon, Junghyun Kim, Gi-Cheon Kang, Byoung-Tak Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 6 figures, published to ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03235 2025-03-26 cs.CL cs.AI 79%

Does Safety Training of LLMs Generalize to Semantically Related Natural Prompts?

Sravanti Addepalli, Yerram Varun, Arun Suggala, Karthikeyan Shanmugam, Prateek Jain

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted in ICLR 2025

Journal ref Addepalli, S., Varun, Y., Suggala, A., Shanmugam, K., & Jain, P. (2025). Does safety training of LLMs generalize to semantically related natural prompts? In The Thirteenth International Conference on Learning Representations 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17882 2025-03-25 cs.CL cs.AI 79%

Think Before Refusal : Triggering Safety Reflection in LLMs to Mitigate False Refusal Behavior

Shengyun Si, Xinpeng Wang, Guangyao Zhai, Nassir Navab, Barbara Plank

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 18 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16516 2025-03-24 cs.CL cs.AI 79%

Using LLMs for Automated Privacy Policy Analysis: Prompt Engineering, Fine-Tuning and Explainability

Yuxin Chen, Peng Tang, Weidong Qiu, Shujun Li

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13149 2025-03-18 cs.AI cs.CL cs.CY 79%

Are LLMs (Really) Ideological? An IRT-based Analysis and Alignment Tool for Perceived Socio-Economic Bias in LLMs

Jasmin Wachter, Michael Radloff, Maja Smolej, Katharina Kinder-Kurlanda

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11346 2025-03-17 cs.CL cs.AI 79%

AIstorian lets AI be a historian: A KG-powered multi-agent system for accurate biography generation

Fengyu Li, Yilin Li, Junhao Zhu, Lu Chen, Yanfei Zhang, Jia Zhou, Hui Zu, Jingwen Zhao, Yunjun Gao

专题命中 指令微调 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10649 2025-03-17 cs.CY cs.AI cs.CL 79%

Measuring Political Preferences in AI Systems: An Integrative Approach

David Rozado

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Measuring Political Preferences in AI Systems. Report. Available: https://manhattan.institute/article/measuring-political-preferences-in-ai-systems-an-integrative-approach/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04787 2025-03-10 cs.CL cs.AI 79%

Towards Anthropomorphic Conversational AI Part I: A Practical Framework

Fei Wei, Yaliang Li, Bolin Ding

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17204 2025-03-04 cs.CL cs.AI 79%

Order Matters: Investigate the Position Bias in Multi-constraint Instruction Following

Jie Zeng, Qianyu He, Qingyu Ren, Jiaqing Liang, Yanghua Xiao, Weikang Zhou, Zeye Sun, Fei Yu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08964 2025-02-27 cs.CL cs.AI 79%

Language Imbalance Driven Rewarding for Multilingual Self-improving

Wen Yang, Junhong Wu, Chen Wang, Chengqing Zong, Jiajun Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Camera ready version for ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14913 2025-02-24 cs.CL cs.AI cs.IR 79%

OpenSearch-SQL: Enhancing Text-to-SQL with Dynamic Few-shot and Consistency Alignment

Xiangjin Xie, Guangwei Xu, Lingyan Zhao, Ruijie Guo

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18649 2025-02-17 cs.CL cs.AI cs.SE 79%

LeDex: Training LLMs to Better Self-Debug and Explain Code

Nan Jiang, Xiaopeng Li, Shiqi Wang, Qiang Zhou, Soneya Binta Hossain, Baishakhi Ray, Varun Kumar, Xiaofei Ma, Anoop Deoras

专题命中 指令微调 :LLM(abstract);SFT(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments This paper is accepted by The Thirty-eighth Annual Conference on Neural Information Processing Systems (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06533 2025-02-11 cs.CL cs.LG 79%

Ignore the KL Penalty! Boosting Exploration on Critical Tokens to Enhance RL Fine-Tuning

Jean Vassoyan, Nathanaël Beau, Roman Plaud

专题命中 指令微调 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.CL、cs.LG

Comments 11 pages, 6 figures, 5 tables. Accepted for publication in the Findings of the North American Chapter of the Association for Computational Linguistics (NAACL) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03994 2025-02-10 cs.CL cs.AI 79%

Unlocking the Potential of Model Merging for Low-Resource Languages

Mingxu Tao, Chen Zhang, Quzhe Huang, Tianyao Ma, Songfang Huang, Dongyan Zhao, Yansong Feng

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

Comments To appear in EMNLP2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03954 2025-02-07 cs.CL cs.AI 79%

MAQInstruct: Instruction-based Unified Event Relation Extraction

Jun Xu, Mengshu Sun, Zhiqiang Zhang, Jun Zhou

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

Comments Accepted by WWW 2025 short

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02249 2025-02-05 cs.CL cs.AI 79%

Conversation AI Dialog for Medicare powered by Finetuning and Retrieval Augmented Generation

Atharva Mangeshkumar Agrawal, Rutika Pandurang Shinde, Vasanth Kumar Bhukya, Ashmita Chakraborty, Sagar Bharat Shah, Tanmay Shukla, Sree Pradeep Kumar Relangi, Nilesh Mutyam

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 12 pages

Journal ref ResMilitaris 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01922 2025-02-05 cs.LG cs.AI 79%

LAST SToP For Modeling Asynchronous Time Series

Shubham Gupta, Thibaut Durand, Graham Taylor, Lilian W. Białokozowicz

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17767 2025-01-30 cs.CL cs.AI 79%

Hybrid Graphs for Table-and-Text based Question Answering using LLMs

Ankush Agarwal, Ganesh S, Chaitanya Devaguptapu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at NAACL 2025 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04436 2025-01-09 cs.LG cs.AI 79%

Federated Fine-Tuning of LLMs: Framework Comparison and Research Directions

Na Yan, Yang Su, Yansha Deng, Robert Schober

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17740 2025-01-08 cs.CL cs.AI 79%

Bridging the Language Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs

Somnath Kumar, Vaibhav Balloli, Mercy Ranjit, Kabir Ahuja, Sunayana Sitaram, Kalika Bali, Tanuja Ganu, Akshay Nambi

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01588 2025-01-06 cs.CL cs.AI 79%

(WhyPHI) Fine-Tuning PHI-3 for Multiple-Choice Question Answering: Methodology, Results, and Challenges

Mohamed Hisham Abdellatif

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18690 2024-12-30 cs.CL cs.LG 79%

AgreeMate: Teaching LLMs to Haggle

Ainesh Chatterjee, Samuel Miller, Nithin Parepally

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments 15 pages, 22 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13337 2024-12-19 cs.LG cs.AI stat.ML 79%

Unveiling the Secret Recipe: A Guide For Supervised Fine-Tuning Small LLMs

Aldo Pareja, Nikhil Shivakumar Nayak, Hao Wang, Krishnateja Killamsetty, Shivchander Sudalairaj, Wenlong Zhao, Seungwook Han, Abhishek Bhandwaldar, Guangxuan Xu, Kai Xu, Ligong Han, Luke Inglis, Akash Srivastava

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 33 pages, 19 figures. Appendix included in submission. Submitted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11768 2024-12-18 cs.LG cs.AI 79%

No More Adam: Learning Rate Scaling at Initialization is All You Need

Minghao Xu, Lichuan Xiang, Xu Cai, Hongkai Wen

专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11618 2024-12-17 cs.LG cs.AI 79%

EvoLlama: Enhancing LLMs' Understanding of Proteins via Multimodal Structure and Sequence Representations

Nuowei Liu, Changzhi Sun, Tao Ji, Junfeng Tian, Jianxin Tang, Yuanbin Wu, Man Lan

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05700 2024-12-17 cs.CL cs.AI cs.SE 79%

InverseCoder: Self-improving Instruction-Tuned Code LLMs with Inverse-Instruct

Yutong Wu, Di Huang, Wenxuan Shi, Wei Wang, Lingzhe Gao, Shihao Liu, Ziyuan Nan, Kaizhao Yuan, Rui Zhang, Xishan Zhang, Zidong Du, Qi Guo, Yewen Pu, Dawei Yin, Xing Hu, Yunji Chen

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication at AAAI 2025. Extended version with full appendix, 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09335 2024-12-10 cs.CL cs.AI 79%

Rethinking Data Selection at Scale: Random Selection is Almost All You Need

Tingyu Xia, Bowen Yu, Kai Dang, An Yang, Yuan Wu, Yuan Tian, Yi Chang, Junyang Lin

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏