arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-24 至 2025-07-24 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 6 篇

2503.03460 2025-07-24 cs.CL 88%

Visualising Policy-Reward Interplay to Inform Zeroth-Order Preference Optimisation of Large Language Models

Alessio Galatolo, Zhenbang Dai, Katie Winkle, Meriem Beloucif

机构 * Uppsala University(乌普萨拉大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ACL25 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17264 2025-07-24 cs.SE cs.AI cs.HC 81%

Understanding Prompt Programming Tasks and Questions

Jenny T. Liang, Chenyang Yang, Agnia Sergeyuk, Travis D. Breaux, Brad A. Myers

机构 * Carnegie Mellon University(卡内基梅隆大学) JetBrains Research(JetBrains研究)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17147 2025-07-24 cs.CL 77%

CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards

Cheng Liu, Yifei Lu, Fanghua Ye, Jian Li, Xingyu Chen, Feiliang Ren, Zhaopeng Tu, Xiaolong Li

专题命中 指令微调 :large language model(abstract);language model(abstract);language agent(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16847 2025-07-24 cs.SI cs.IR cs.LG 74%

EVOLVE-X: Embedding Fusion and Language Prompting for User Evolution Forecasting on Social Media

Ismail Hossain, Sai Puppala, Md Jahangir Alam, Sajedul Talukder

机构 * Computer Science University of Texas at El Paso(计算机科学德克萨斯大学埃尔帕索分校) School of Computing Southern Illinois University(计算学院南方伊利诺伊大学)

专题命中 指令微调 :prompting(title);分类 cs.LG

Comments We are submitting this paper to ICWSM 2026 conference on September 15th, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17706 2025-07-24 cs.LG 70%

HydraOpt: Navigating the Efficiency-Performance Trade-off of Adapter Merging

Taha Ceritli, Ondrej Bohdal, Mete Ozay, Jijoong Moon, Kyeng-Hun Lee, Hyeonmok Ko, Umberto Michieli

机构 * Samsung R&D Institute UK(三星英国研发院) Samsung Research(三星研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12122 2025-07-24 cs.RO cs.AI 70%

ICCO: Learning an Instruction-conditioned Coordinator for Language-guided Task-aligned Multi-robot Control

Yoshiki Yano, Kazuki Shibata, Maarten Kokshoorn, Takamitsu Matsubara

机构 * Division of Information Science, Graduate School of Science and Technology, Nara Institute of Science and Technology (NAIST)(信息科学系,科学技术研究生学校,科学与技术国立研究所) Department of Cognitive Robotics, Faculty of Mechanical Engineering, Delft University of Technology(认知机器人系,机械工程学院,代尔夫特理工大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 9 figures, to be published in the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems

详情

展开后加载摘要…

URL PDF HTML 收藏