arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11714 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11714 篇

2501.00233 2025-02-12 cs.CL 77%

Zero-Shot Strategies for Length-Controllable Summarization

Fabian Retkowski, Alexander Waibel

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Carnegie Mellon University(卡内基梅隆大学) KIT Campus Transfer GmbH(KIT校园转让有限公司)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01225 2025-02-04 cs.CR cs.AI 77%

The dark deep side of DeepSeek: Fine-tuning attacks against the safety alignment of CoT-enabled models

Zhiyuan Xu, Joseph Gardiner, Sana Belguith

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments 12 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12423 2025-01-23 cs.SE cs.AI 77%

FREYR: A Framework for Recognizing and Executing Your Requests

Roberto Gallotta, Antonios Liapis, Georgios N. Yannakakis

机构 * Institute of Digital Games(数字游戏研究所) University of Malta(马耳他大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11929 2025-01-22 cs.LG 77%

ALoFTRAG: Automatic Local Fine Tuning for Retrieval Augmented Generation

Peter Devine

机构 * Lightblue KK

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10734 2025-01-22 eess.AS cs.AI cs.SD 77%

GEC-RAG: Improving Generative Error Correction via Retrieval-Augmented Generation for Automatic Speech Recognition Systems

Amin Robatian, Mohammad Hajipour, Mohammad Reza Peyghan, Fatemeh Rajabi, Sajjad Amini, Shahrokh Ghaemmaghami, Iman Gholampour

机构 * Sharif University of Technology(谢里夫理工大学) Amirkabir University of Technology(阿米尔卡比尔理工大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10648 2025-01-22 cs.CL 77%

DNA 1.0 Technical Report

Jungyup Lee, Jemin Kim, Sang Park, SeungJae Lee

专题命中 指令微调 :language model(abstract);SFT(abstract);preference optimization(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03335 2025-01-15 cs.SD cs.CV cs.LG eess.AS 77%

Audio-Agent: Leveraging LLMs For Audio Generation, Editing and Composition

Zixuan Wang, Chi-Keung Tang, Yu-Wing Tai

机构 * HKUST(香港科技大学) Dartmouth College(达特茅斯学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01245 2025-01-03 cs.CV cs.LG 77%

SeFAR: Semi-supervised Fine-grained Action Recognition with Temporal Perturbation and Learning Stabilization

Yongle Huang, Haodong Chen, Zhenbang Xu, Zihan Jia, Haozhou Sun, Dian Shao

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.LG

Comments AAAI 2025; Code: https://github.com/KyleHuang9/SeFAR

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19830 2024-12-31 cs.NI cs.AI 77%

A Unified Framework for Context-Aware IoT Management and State-of-the-Art IoT Traffic Anomaly Detection

Daniel Adu Worae, Athar Sheikh, Spyridon Mastorakis

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19513 2024-12-30 cs.CL 77%

Confidence v.s. Critique: A Decomposition of Self-Correction Capability for LLMs

Zhe Yang, Yichang Zhang, Yudong Wang, Ziyao Xu, Junyang Lin, Zhifang Sui

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03876 2024-12-24 cs.CR cs.CL 77%

Automated Progressive Red Teaming

Bojian Jiang, Yi Jing, Tianhao Shen, Tong Wu, Qing Yang, Deyi Xiong

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15178 2024-12-20 cs.DC cs.LG cs.SE 77%

HPC-Coder-V2: Studying Code LLMs Across Low-Resource Parallel Languages

Aman Chaturvedi, Daniel Nichols, Siddharth Singh, Abhinav Bhatele

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17981 2024-12-20 cs.CV cs.AI 77%

From Training-Free to Adaptive: Empirical Insights into MLLMs' Understanding of Detection Information

Qirui Jiao, Daoyuan Chen, Yilun Huang, Yaliang Li, Ying Shen

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments 32 pages, 22 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10402 2024-12-17 cs.AI cs.RO 77%

TANGO: Training-free Embodied AI Agents for Open-world Tasks

Filippo Ziliotto, Tommaso Campari, Luciano Serafini, Lamberto Ballan

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07097 2024-12-11 cs.CR cs.AI 77%

On Evaluating the Durability of Safeguards for Open-Weight LLMs

Xiangyu Qi, Boyi Wei, Nicholas Carlini, Yangsibo Huang, Tinghao Xie, Luxi He, Matthew Jagielski, Milad Nasr, Prateek Mittal, Peter Henderson

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11811 2024-12-10 cs.CL 77%

FIPO: Free-form Instruction-oriented Prompt Optimization with Preference Dataset and Modular Fine-tuning Schema

Junru Lu, Siyu An, Min Zhang, Yulan He, Di Yin, Xing Sun

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments COLING 2025, Final Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06144 2024-12-10 cs.CL 77%

Hate Speech According to the Law: An Analysis for Effective Detection

Katerina Korre, John Pavlopoulos, Paolo Gajo, Alberto Barrón-Cedeño

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16066 2024-12-10 cs.SE cs.AI 77%

A Prompt Learning Framework for Source Code Summarization

Tingting Xu, Yun Miao, Chunrong Fang, Hanwei Qian, Xia Feng, Zhenpeng Chen, Chong Wang, Jian Zhang, Weisong Sun, Zhenyu Chen, Yang Liu

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13439 2024-11-27 cs.CL 77%

Finding Blind Spots in Evaluator LLMs with Interpretable Checklists

Sumanth Doddapaneni, Mohammed Safi Ur Rahman Khan, Sshubam Verma, Mitesh M. Khapra

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02801 2024-11-26 cs.SD cs.AI eess.AS 77%

Mozart's Touch: A Lightweight Multi-modal Music Generation Framework Based on Pre-Trained Large Models

Jiajun Li, Tianze Xu, Xuesong Chen, Xinrui Yao, Shuchang Liu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 10 pages, 2 figures, submitted to AIGC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20204 2024-11-19 cs.AI 77%

The Future of Combating Rumors? Retrieval, Discrimination, and Generation

Junhao Xu, Longdi Xian, Zening Liu, Mingliang Chen, Qiuyang Yin, Fenghua Song

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09269 2024-11-15 cs.IR cs.AI 77%

Harnessing multiple LLMs for Information Retrieval: A case study on Deep Learning methodologies in Biodiversity publications

Vamsi Krishna Kommineni, Birgitta König-Ries, Sheeba Samuel

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08244 2024-11-14 cs.LG cs.ET 77%

NVCiM-PT: An NVCiM-assisted Prompt Tuning Framework for Edge LLMs

Ruiyang Qin, Pengyu Ren, Zheyu Yan, Liu Liu, Dancheng Liu, Amir Nassereldine, Jinjun Xiong, Kai Ni, Sharon Hu, Yiyu Shi

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by DATE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05214 2024-11-11 cs.CL 77%

STAND-Guard: A Small Task-Adaptive Content Moderation Model

Minjia Wang, Pingping Lin, Siqi Cai, Shengnan An, Shengjie Ma, Zeqi Lin, Congrui Huang, Bixiong Xu

专题命中 指令微调 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.CL

Comments 20 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08825 2024-11-08 cs.RO cs.AI 77%

Inverse Kinematics for Neuro-Robotic Grasping with Humanoid Embodied Agents

Jan-Gerrit Habekost, Connor Gäde, Philipp Allgeuer, Stefan Wermter

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Published at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15179 2024-10-30 cs.CL 77%

VB-LoRA: Extreme Parameter Efficient Fine-Tuning with Vector Banks

Yang Li, Shaobo Han, Shihao Ji

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20147 2024-10-29 cs.LG 77%

GFlowNet Fine-tuning for Diverse Correct Solutions in Mathematical Reasoning Tasks

Ryoichi Takase, Masaya Tsunokake, Yuta Tsuchiya, Shota Inuzuka

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17222 2024-10-23 cs.CL 77%

Context-aware Prompt Tuning: Advancing In-Context Learning with Adversarial Methods

Tsachi Blau, Moshe Kimhi, Yonatan Belinkov, Alexander Bronstein, Chaim Baskin

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15005 2024-10-22 cs.CL 77%

CAP: Data Contamination Detection via Consistency Amplification

Yi Zhao, Jing Li, Linyi Yang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12890 2024-10-18 cs.CL cs.IR 77%

REFINE on Scarce Data: Retrieval Enhancement through Fine-Tuning via Model Fusion of Embedding Models

Ambuje Gupta, Mrinal Rawat, Andreas Stolcke, Roberto Pieraccini

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in AJCAI'24

详情

展开后加载摘要…

URL PDF HTML 收藏