arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11714 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11714 篇

2405.03236 2024-05-07 cs.LG stat.ML 77%

Federated Reinforcement Learning with Constraint Heterogeneity

Hao Jin, Liangyu Zhang, Zhihua Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02710 2024-05-07 cs.CL 77%

Enhancing News Summarization with ELearnFit through Efficient In-Context Learning and Efficient Fine-Tuning

Che Guan, Andrew Chin, Puya Vahabi

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments 9 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02556 2024-05-01 cs.CL cs.CV 77%

NOLA: Compressing LoRA using Linear Combination of Random Basis

Soroush Abbasi Koohpayegani, KL Navaneet, Parsa Nooralinejad, Soheil Kolouri, Hamed Pirsiavash

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments ICLR 2024. Our code is available here: https://github.com/UCDvision/NOLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17780 2024-04-30 cs.MA cs.AI 77%

Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning

Dapeng Li, Hang Dong, Lu Wang, Bo Qiao, Si Qin, Qingwei Lin, Dongmei Zhang, Qi Zhang, Zhiwei Xu, Bin Zhang, Guoliang Fan

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13033 2024-04-22 cs.CL 77%

Sample Design Engineering: An Empirical Study of What Makes Good Downstream Fine-Tuning Samples for LLMs

Biyang Guo, He Wang, Wenyilin Xiao, Hong Chen, Zhuxin Lee, Songqiao Han, Hailiang Huang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 23 pages, 12 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10261 2024-04-17 cs.CL 77%

How Good Are LLMs at Out-of-Distribution Detection?

Bo Liu, Liming Zhan, Zexin Lu, Yujie Feng, Lei Xue, Xiao-Ming Wu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02973 2024-04-04 cs.CL cs.SD eess.AS 77%

UniverSLU: Universal Spoken Language Understanding for Diverse Tasks with Natural Language Instructions

Siddhant Arora, Hayato Futami, Jee-weon Jung, Yifan Peng, Roshan Sharma, Yosuke Kashiwagi, Emiru Tsunoo, Karen Livescu, Shinji Watanabe

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments Accepted at NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00950 2024-04-02 cs.CL 77%

AISPACE at SemEval-2024 task 8: A Class-balanced Soft-voting System for Detecting Multi-generator Machine-generated Text

Renhua Gu, Xiangfeng Meng

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 1st place at SemEval-2024 Task 8, Subtask B, to appear in SemEval-2024 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00189 2024-04-02 cs.CL 77%

GPTA: Generative Prompt Tuning Assistant for Synergistic Downstream Neural Network Enhancement with LLMs

Xiao Liu, Jiawei Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18958 2024-03-29 cs.SE cs.AI 77%

A State-of-the-practice Release-readiness Checklist for Generative AI-based Software Products

Harsh Patel, Dominique Boucher, Emad Fallahzadeh, Ahmed E. Hassan, Bram Adams

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06463 2024-03-27 cs.CL 77%

GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher

Youliang Yuan, Wenxiang Jiao, Wenxuan Wang, Jen-tse Huang, Pinjia He, Shuming Shi, Zhaopeng Tu

专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted by ICLR 2024. 21 pages, 3 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16396 2024-03-26 cs.CL 77%

Is There a One-Model-Fits-All Approach to Information Extraction? Revisiting Task Definition Biases

Wenhao Huang, Qianyu He, Zhixu Li, Jiaqing Liang, Yanghua Xiao

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14374 2024-03-22 cs.CL cs.IR 77%

FIT-RAG: Black-Box RAG with Factual Information and Token Reduction

Yuren Mao, Xuemei Dong, Wenyi Xu, Yunjun Gao, Bin Wei, Ying Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.12725 2024-03-21 cs.CL 77%

Generative Multimodal Entity Linking

Senbao Shi, Zhenran Xu, Baotian Hu, Min Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.08876 2024-03-13 stat.ML cs.LG 77%

An alternative approach to train neural networks using monotone variational inequality

Chen Xu, Xiuyuan Cheng, Yao Xie

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06148 2024-03-12 cs.LG 77%

NetGPT: A Native-AI Network Architecture Beyond Provisioning Personalized Generative Services

Yuxuan Chen, Rongpeng Li, Zhifeng Zhao, Chenghui Peng, Jianjun Wu, Ekram Hossain, Honggang Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03668 2024-03-07 cs.CL 77%

GoLLIE: Annotation Guidelines improve Zero-Shot Information-Extraction

Oscar Sainz, Iker García-Ferrero, Rodrigo Agerri, Oier Lopez de Lacalle, German Rigau, Eneko Agirre

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments The Twelfth International Conference on Learning Representations - ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05696 2024-03-01 cs.CL 77%

A Preliminary Study of the Intrinsic Relationship between Complexity and Alignment

Yingxiu Zhao, Bowen Yu, Binyuan Hui, Haiyang Yu, Fei Huang, Yongbin Li, Nevin L. Zhang

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments LREC-Coling 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13016 2024-02-21 cs.CL 77%

Understanding the effects of language-specific class imbalance in multilingual fine-tuning

Vincent Jung, Lonneke van der Plas

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments To be published in: Findings of the Association for Computational Linguistics: EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04588 2024-02-20 cs.CL 77%

UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset

Haoyu Wang, Shuo Wang, Yukun Yan, Xujia Wang, Zhiyu Yang, Yuzhuang Xu, Zhenghao Liu, Liner Yang, Ning Ding, Xu Han, Zhiyuan Liu, Maosong Sun

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08968 2024-02-15 cs.AI 77%

GrounDial: Human-norm Grounded Safe Dialog Response Generation

Siwon Kim, Shuyang Dai, Mohammad Kachuee, Shayan Ray, Tara Taghavi, Sungroh Yoon

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to findings of EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06094 2024-02-12 cs.CL 77%

Rethinking Data Selection for Supervised Fine-Tuning

Ming Shen

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05723 2024-02-09 cs.LG cs.CR 77%

In-Context Learning Can Re-learn Forbidden Tasks

Sophie Xhonneux, David Dobre, Jian Tang, Gauthier Gidel, Dhanya Sridhar

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00152 2024-02-09 cs.CL 77%

Learning to Rewrite Prompts for Personalized Text Generation

Cheng Li, Mingyang Zhang, Qiaozhu Mei, Weize Kong, Michael Bendersky

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments In Proceedings of the ACM Web Conference 2024 (WWW '24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00006 2024-02-07 cs.AI 77%

Building Open-Ended Embodied Agent via Language-Policy Bidirectional Adaptation

Shaopeng Zhai, Jie Wang, Tianyi Zhang, Fuxian Huang, Qi Zhang, Ming Zhou, Jing Hou, Yu Qiao, Yu Liu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13810 2024-01-26 cs.CL cs.SE 77%

Automated Root Causing of Cloud Incidents using In-Context Learning with GPT-4

Xuchao Zhang, Supriyo Ghosh, Chetan Bansal, Rujia Wang, Minghua Ma, Yu Kang, Saravan Rajmohan

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01761 2024-01-05 cs.CL 77%

Cross-target Stance Detection by Exploiting Target Analytical Perspectives

Daijun Ding, Rong Chen, Liwen Jing, Bowen Zhang, Xu Huang, Li Dong, Xiaowen Zhao, Ge Song

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00503 2024-01-02 cs.LG 77%

Viz: A QLoRA-based Copyright Marketplace for Legally Compliant Generative AI

Dipankar Sarkar

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16351 2023-12-29 cs.DB cs.AI 77%

LLMs with User-defined Prompts as Generic Data Operators for Reliable Data Processing

Luyi Ma, Nikhil Thakurdesai, Jiao Chen, Jianpeng Xu, Evren Korpeoglu, Sushant Kumar, Kannan Achan

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 5 pages, 8 figures, 1st IEEE International Workshop on Data Engineering and Modeling for AI (DEMAI), IEEE BigData 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15907 2023-12-27 cs.CL 77%

Align on the Fly: Adapting Chatbot Behavior to Established Norms

Chunpu Xu, Steffi Chern, Ethan Chern, Ge Zhang, Zekun Wang, Ruibo Liu, Jing Li, Jie Fu, Pengfei Liu

专题命中 指令微调 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏