arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11619 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11619 篇

2408.13028 2024-08-26 cs.CL 81%

In-Context Learning with Reinforcement Learning for Incomplete Utterance Rewriting

Haowei Du, Dongyan Zhao

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12726 2024-08-26 cs.CL 81%

Macro-Queries: An Exploration into Guided Chart Generation from High Level Prompts

Christopher J. Lee, Giorgio Tran, Roderick Tabalba, Jason Leigh, Ryan Longman

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02817 2024-08-19 cs.CL 81%

Labeling supervised fine-tuning data with the scaling law

Huanjun Kong

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments 5 pages, 3 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03511 2024-08-08 cs.CV cs.CL 81%

MoExtend: Tuning New Experts for Modality and Task Extension

Shanshan Zhong, Shanghua Gao, Zhongzhan Huang, Wushao Wen, Marinka Zitnik, Pan Zhou

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments ACL 2024 - SRW

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18722 2024-07-29 cs.AI cs.HC 81%

Neurosymbolic AI for Enhancing Instructability in Generative AI

Amit Sheth, Vishal Pallagani, Kaushik Roy

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19112 2024-06-28 cs.LG 81%

A Teacher Is Worth A Million Instructions

Nikhil Kothari, Ravindra Nayak, Shreyas Shetty, Amey Patil, Nikesh Garera

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);post-training(abstract)

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13561 2024-06-27 cs.CL cs.CV 81%

Cognitive Visual-Language Mapper: Advancing Multimodal Comprehension with Enhanced Visual Knowledge Alignment

Yunxin Li, Xinyu Chen, Baotian Hu, Haoyuan Shi, Min Zhang

专题命中 指令微调 :large language model(abstract);language model(abstract);small language model(abstract);instruction tuning(abstract)

Comments 12 pages,4 figures; Accepted by ACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10813 2024-06-18 cs.CL 81%

Self-Evolution Fine-Tuning for Policy Optimization

Ruijun Chen, Jiehao Liang, Shiping Gao, Fanqi Wan, Xiaojun Quan

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10560 2024-06-18 cs.CL 81%

Facts-and-Feelings: Capturing both Objectivity and Subjectivity in Table-to-Text Generation

Tathagata Dey, Pushpak Bhattacharyya

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06623 2024-06-12 cs.LG stat.ML 81%

Spectrum: Targeted Training on Signal to Noise Ratio

Eric Hartford, Lucas Atkins, Fernando Fernandes Neto, David Golchinfar

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00606 2024-06-10 cs.CL 81%

LLMs Could Autonomously Learn Without External Supervision

Ke Ji, Junying Chen, Anningzhe Gao, Wenya Xie, Xiang Wan, Benyou Wang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12174 2024-05-31 cs.CL 81%

BIDER: Bridging Knowledge Inconsistency for Efficient Retrieval-Augmented LLMs via Key Supporting Evidence

Jiajie Jin, Yutao Zhu, Yujia Zhou, Zhicheng Dou

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Accepted by ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03548 2024-05-24 cs.CL 81%

MAmmoTH2: Scaling Instructions from the Web

Xiang Yue, Tuney Zheng, Ge Zhang, Wenhu Chen

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04072 2024-04-16 cs.CL 81%

Beyond Imitation: Leveraging Fine-grained Quality Signals for Alignment

Geyang Guo, Ranchi Zhao, Tianyi Tang, Wayne Xin Zhao, Ji-Rong Wen

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08344 2024-03-28 cs.CV cs.AI cs.RO 81%

FoundationPose: Unified 6D Pose Estimation and Tracking of Novel Objects

Bowen Wen, Wei Yang, Jan Kautz, Stan Birchfield

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17804 2024-03-27 cs.CV cs.CL 81%

Improving Text-to-Image Consistency via Automatic Prompt Optimization

Oscar Mañas, Pietro Astolfi, Melissa Hall, Candace Ross, Jack Urbanek, Adina Williams, Aishwarya Agrawal, Adriana Romero-Soriano, Michal Drozdzal

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14938 2024-03-25 cs.CL 81%

On Zero-Shot Counterspeech Generation by LLMs

Punyajoy Saha, Aalok Agrawal, Abhik Jana, Chris Biemann, Animesh Mukherjee

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 12 pages, 7 tables, accepted at LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07879 2023-12-21 cs.CV cs.AI 81%

CoIE: Chain-of-Instruct Editing for Multi-Attribute Face Manipulation

Zhenduo Zhang, Bo-Wen Zhang, Guang Liu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10702 2023-11-21 cs.CL 81%

Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2

Hamish Ivison, Yizhong Wang, Valentina Pyatkin, Nathan Lambert, Matthew Peters, Pradeep Dasigi, Joel Jang, David Wadden, Noah A. Smith, Iz Beltagy, Hannaneh Hajishirzi

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);preference optimization(abstract)

Comments technical report; fixed zephyr numbers

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10445 2023-10-17 cs.CL cond-mat.mtrl-sci 81%

MechGPT, a language-based strategy for mechanics and materials modeling that connects knowledge across scales, disciplines and modalities

Markus J. Buehler

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01208 2023-10-03 cs.CL 81%

Label Supervised LLaMA Finetuning

Zongxi Li, Xianming Li, Yuzhang Liu, Haoran Xie, Jing Li, Fu-lee Wang, Qing Li, Xiaoqin Zhong

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03907 2023-09-11 q-bio.BM cs.LG 81%

DrugChat: Towards Enabling ChatGPT-Like Capabilities on Drug Molecule Graphs

Youwei Liang, Ruiyi Zhang, Li Zhang, Pengtao Xie

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12261 2023-08-24 cs.CL 81%

Prompt2Model: Generating Deployable Models from Natural Language Instructions

Vijay Viswanathan, Chenyang Zhao, Amanda Bertsch, Tongshuang Wu, Graham Neubig

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13923 2023-08-21 cs.CL 81%

GrammarGPT: Exploring Open-Source LLMs for Native Chinese Grammatical Error Correction with Supervised Fine-Tuning

Yaxin Fan, Feng Jiang, Peifeng Li, Haizhou Li

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17197 2023-05-30 cs.CL 81%

Entailment as Robust Self-Learner

Jiaxin Ge, Hongyin Luo, Yoon Kim, James Glass

专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);prompting(abstract)

Comments Accepted by ACL 2023 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11969 2025-04-21 cs.CL cs.AI cs.LG 81%

Does Refusal Training in LLMs Generalize to the Past Tense?

Maksym Andriushchenko, Nicolas Flammarion

专题命中 指令微调 :LLM(abstract,comments);SFT(abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ICLR 2025. Updates in v2 and v3: added GPT-4o, Claude 3.5 Sonnet, o1-mini, and o1-preview results. Code and jailbreak artifacts: https://github.com/tml-epfl/llm-past-tense

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05588 2024-11-05 cs.CL cs.AI cs.LG 81%

CERET: Cost-Effective Extrinsic Refinement for Text Generation

Jason Cai, Hang Su, Monica Sunkara, Igor Shalyminov, Saab Mansour

专题命中 指令微调 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments The source code and data samples are released at https://github.com/amazon-science/CERET-LLM-refine

Journal ref Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06363 2024-09-27 cs.CR 81%

StruQ: Defending Against Prompt Injection with Structured Queries

Sizhe Chen, Julien Piet, Chawin Sitawarin, David Wagner

专题命中 指令微调 :LLM(abstract,comments);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments To appear at USENIX Security Symposium 2025. Key words: prompt injection defense, LLM security, LLM-integrated applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18171 2026-08-20 cs.AI cs.LG 新提交 81%

Looped Language Models Improve Compositional Tool Calling

循环语言模型可提升组合式工具调用能力

Andrei Cristian Popescu, Haitz Sáez de Ocáriz Borde, Pietro Liò

机构 * University of Cambridge(剑桥大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究在组合式工具调用场景下,通过在多个数据集上对比循环与非循环语言模型,发现循环计算可提升组合式工具使用性能,自适应推理能实现更优计算-性能权衡,为智能体系统提供了有前景的架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07559 2026-08-20 cs.CL cs.AI quant-ph 版本更新 81%

Phantom Transitions in Language Model Fine-Tuning: A Density-Matrix Analysis

语言模型微调中的幻影相变

Vaibhav Prakash, Jayasri Dontabhaktuni

机构 * Mahindra University(马恒达大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文研究语言模型微调时,正确补全被近义词竞争而失败的现象,通过序参量分解信号与背景拖拽,发现两种失败模式,并揭示相变为幻影,源于softmax读出而非几何相变。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏