arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11789 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11789 篇

2407.07858 2024-07-11 cs.LG cs.CL 73%

FACTS About Building Retrieval Augmented Generation-based Chatbots

Rama Akkiraju, Anbang Xu, Deepak Bora, Tan Yu, Lu An, Vishal Seth, Aaditya Shukla, Pritam Gundecha, Hridhay Mehta, Ashwin Jha, Prithvi Raj, Abhinav Balasubramanian, Murali Maram, Guru Muthusamy, Shivakesh Reddy Annepally, Sidney Knowles, Min Du, Nick Burnett, Sean Javiya, Ashok Marannan, Mamta Kumari, Surbhi Jha, Ethan Dereszenski, Anupam Chakraborty, Subhash Ranjan, Amina Terfai, Anoop Surya, Tracey Mercer, Vinodh Kumar Thanigachalam, Tamar Bar, Sanjana Krishnan, Samy Kilaru, Jasmine Jaksic, Nave Algarici, Jacob Liberman, Joey Conway, Sonu Nayyar, Justin Boitano

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 8 pages, 6 figures, 2 tables, Preprint submission to ACM CIKM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06411 2024-07-10 cs.LG cs.CL cs.CR 73%

If You Don't Understand It, Don't Use It: Eliminating Trojans with Filters Between Layers

Adriano Hernandez

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02147 2024-07-10 cs.CL cs.AI 73%

GemmAr: Enhancing LLMs Through Arabic Instruction-Tuning

Hasna Chouikhi, Manel Aloui, Cyrine Ben Hammou, Ghaith Chaabane, Haithem Kchaou, Chehir Dhaouadi

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13213 2024-07-08 cs.LG cs.CL cs.CY 73%

From Representational Harms to Quality-of-Service Harms: A Case Study on Llama 2 Safety Safeguards

Khaoula Chehbouni, Megha Roshan, Emmanuel Ma, Futian Andrew Wei, Afaf Taik, Jackie CK Cheung, Golnoosh Farnadi

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 9 pages, 4 figures. Accepted to Findings of the Association for Computational Linguistics: ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02742 2024-07-04 cs.SE cs.AI cs.CL 73%

A Comparative Study of DSL Code Generation: Fine-Tuning vs. Optimized Retrieval Augmentation

Nastaran Bassamzadeh, Chhaya Methani

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11925 2024-07-04 cs.SE cs.AI cs.CL 73%

DocCGen: Document-based Controlled Code Generation

Sameer Pimparkhede, Mehant Kammakomati, Srikanth Tamilselvam, Prince Kumar, Ashok Pon Kumar, Pushpak Bhattacharyya

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18954 2024-06-28 cs.LG cs.AI 73%

Alignment For Performance Improvement in Conversation Bots

Raghav Garg, Kapil Sharma, Shrey Singla

专题命中 指令微调 :instruction tuning(abstract);preference optimization(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16797 2024-06-26 cs.CL cs.AI 73%

Lottery Ticket Adaptation: Mitigating Destructive Interference in LLMs

Ashwinee Panda, Berivan Isik, Xiangyu Qi, Sanmi Koyejo, Tsachy Weissman, Prateek Mittal

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15883 2024-06-25 cs.CL cs.AI 73%

SimSMoE: Solving Representational Collapse via Similarity Measure

Giang Do, Hung Le, Truyen Tran

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14956 2024-06-24 cs.LG cs.CL 73%

Unlocking the Global Synergies in Low-Rank Adapters

Zixi Zhang, Cheng Zhang, Xitong Gao, Robert D. Mullins, George A. Constantinides, Yiren Zhao

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at ICML2024 ES-FoMo-II Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00158 2024-06-24 cs.CL cs.AI 73%

MTUncertainty: Assessing the Need for Post-editing of Machine Translation Outputs by Fine-tuning OpenAI LLMs

Serge Gladkoff, Lifeng Han, Gleb Erofeev, Irina Sorokina, Goran Nenadic

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by EAMT2024: The 25th Annual Conference of The European Association for Machine Translation

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13846 2024-06-21 cs.CL cs.LG 73%

Text Serialization and Their Relationship with the Conventional Paradigms of Tabular Machine Learning

Kyoka Ono, Simon A. Lee

专题命中 指令微调 :language model(abstract);SFT(abstract);分类 cs.CL、cs.LG

Comments Accepted into the ICML AI4Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12159 2024-06-19 cs.CL cs.LG 73%

Exploring the Impact of a Transformer's Latent Space Geometry on Downstream Task Performance

Anna C. Marbut, John W. Chandler, Travis J. Wheeler

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11474 2024-06-18 cs.CL cs.AI 73%

How Far Can In-Context Alignment Go? Exploring the State of In-Context Alignment

Heyan Huang, Yinghao Li, Huashan Sun, Yu Bai, Yang Gao

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 22 pages, 6 figures, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10976 2024-06-18 cs.LG cs.CL cs.CR 73%

Promoting Data and Model Privacy in Federated Learning through Quantized LoRA

JianHao Zhu, Changze Lv, Xiaohua Wang, Muling Wu, Wenhao Liu, Tianlong Li, Zixuan Ling, Cenyuan Zhang, Xiaoqing Zheng, Xuanjing Huang

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13671 2024-06-18 cs.CL cs.AI 73%

KInIT at SemEval-2024 Task 8: Fine-tuned LLMs for Multilingual Machine-Generated Text Detection

Michal Spiegel, Dominik Macko

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments SemEval-2024 Task 8

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03518 2024-06-18 cs.CL cs.AI 73%

Black-box Prompt Tuning with Subspace Learning

Yuanhang Zheng, Zhixing Tan, Peng Li, Yang Liu

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref IEEE/ACM Transactions on Audio, Speech, and Language Processing. 32 (2024) 3002-3013

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.01579 2024-06-11 cs.CL cs.AI 73%

Why So Gullible? Enhancing the Robustness of Retrieval-Augmented Models against Counterfactual Noise

Giwon Hong, Jeonghwan Kim, Junmo Kang, Sung-Hyon Myaeng, Joyce Jiyoung Whang

专题命中 指令微调 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments NAACL 2024 (Findings; Long Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04478 2024-06-10 cs.CL cs.LG 73%

PromptFix: Few-shot Backdoor Removal via Adversarial Prompt Tuning

Tianrong Zhang, Zhaohan Xi, Ting Wang, Prasenjit Mitra, Jinghui Chen

专题命中 指令微调 :language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02120 2024-06-10 cs.CL cs.AI cs.SE 73%

Magicoder: Empowering Code Generation with OSS-Instruct

Yuxiang Wei, Zhe Wang, Jiawei Liu, Yifeng Ding, Lingming Zhang

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Published at ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03718 2024-06-07 cs.CR cs.AI cs.CL 73%

Generalization-Enhanced Code Vulnerability Detection via Multi-Task Instruction Fine-Tuning

Xiaohu Du, Ming Wen, Jiahao Zhu, Zifan Xie, Bin Ji, Huijun Liu, Xuanhua Shi, Hai Jin

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12621 2024-06-07 cs.LG cs.CL 73%

Reflect-RL: Two-Player Online RL Fine-Tuning for LMs

Runlong Zhou, Simon S. Du, Beibin Li

专题命中 指令微调 :language model(abstract);SFT(abstract);分类 cs.CL、cs.LG

Comments ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15337 2024-06-06 cs.CL cs.LG 73%

Ranking Entities along Conceptual Space Dimensions with LLMs: An Analysis of Fine-Tuning Strategies

Nitesh Kumar, Usashi Chatterjee, Steven Schockaert

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted in ACL 2024 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02002 2024-06-05 cs.CL cs.AI 73%

Position Debiasing Fine-Tuning for Causal Perception in Long-Term Dialogue

Shixuan Fan, Wei Wei, Wendi Li, Xian-Ling Mao, Wenfeng Xie, Dangyang Chen

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to IJCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08637 2024-06-04 cs.CL cs.AI 73%

TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild

Huayang Li, Siheng Li, Deng Cai, Longyue Wang, Lemao Liu, Taro Watanabe, Yujiu Yang, Shuming Shi

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00509 2024-06-04 cs.LG cs.AI 73%

Empirical influence functions to understand the logic of fine-tuning

Jordan K. Matelsky, Lyle Ungar, Konrad P. Kording

专题命中 指令微调 :LLM(abstract);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20701 2024-06-03 cs.CL cs.AI 73%

Unveiling the Lexical Sensitivity of LLMs: Combinatorial Optimization for Prompt Enhancement

Pengwei Zhan, Zhen Xu, Qian Tan, Jie Song, Ru Xie

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18339 2024-06-03 cs.CL cs.AI 73%

When MOE Meets LLMs: Parameter Efficient Fine-tuning for Multi-task Medical Applications

Qidong Liu, Xian Wu, Xiangyu Zhao, Yuanshao Zhu, Derong Xu, Feng Tian, Yefeng Zheng

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments accepted by SIGIR'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06967 2024-05-31 cs.CL cs.AI 73%

Instruct Once, Chat Consistently in Multiple Rounds: An Efficient Tuning Framework for Dialogue

Jian Wang, Chak Tou Leong, Jiashuo Wang, Dongding Lin, Wenjie Li, Xiao-Yong Wei

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17258 2024-05-28 cs.LG cs.AI 73%

$\textit{Trans-LoRA}$: towards data-free Transferable Parameter Efficient Finetuning

Runqian Wang, Soumya Ghosh, David Cox, Diego Antognini, Aude Oliva, Rogerio Feris, Leonid Karlinsky

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏