arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-24 至 2025-12-24 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 7 篇

2512.20061 2025-12-24 cs.AI 89%

Scaling Reinforcement Learning for Content Moderation with Large Language Models

利用大语言模型扩展强化学习用于内容审核

Hamed Firooz, Rui Liu, Yuchen Lu, Zhenyu Hou, Fangzhou Xiong, Xiaoyang Zhang, Changshu Jian, Zhicheng Zhu, Jiayuan Ma, Jacob Tao, Chaitali Gupta, Xiaochang Peng, Shike Mei, Hang Cui, Yang Qin, Shuo Tang, Jason Gaedtke, Arpit Mittal

机构 * Meta AI

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用强化学习扩展大语言模型,以提升内容审核的准确性和效率,特别是在标签稀疏和政策复杂的情况下。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19399 2025-12-24 cs.LG cs.AI cs.CL 87%

Brain-Grounded Axes for Reading and Steering LLM States

基于大脑活动的阅读与操控LLM状态的轴

Sandro Andric

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用人类大脑活动作为坐标系,通过ICA提取潜在轴,操控LLM状态,实现可解释和可控的LLM行为。

Comments 10 pages, 4 figures. Code: https://github.com/sandroandric/Brain-Grounded-Axes-for-Reading-and-Steering-LLM-States

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19769 2025-12-24 cs.SE cs.AI cs.PL 79%

A Declarative Language for Building And Orchestrating LLM-Powered Agent Workflows

构建和协调基于大语言模型的智能体工作流的声明式语言

Ivan Daunis

机构 * PayPal

专题命中 指令微调 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出一种声明式语言,用于构建和协调基于大语言模型的智能体工作流,通过统一DSL减少开发时间和部署速度,提升非工程师的使用效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08093 2025-12-24 cs.LG cs.AI 79%

Training LLMs for Honesty via Confessions

通过忏悔训练LLM的诚实性

Manas Joglekar, Jeremy Chen, Gabriel Wu, Jason Yosinski, Jasmine Wang, Boaz Barak, Amelia Glaese

机构 * OpenAI

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过训练LLM生成忏悔来提升其诚实性,验证了在分布外场景中检测和纠正模型不当行为的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20140 2025-12-24 cs.AI 77%

Enhancing Zero-Shot Time Series Forecasting in Off-the-Shelf LLMs via Noise Injection

通过噪声注入增强现成大语言模型在零样本时间序列预测中的性能

Xingyou Yin, Ceyao Zhang, Min Hu, Kai Chen

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过在时间序列数据分词前注入噪声,提升现成大语言模型在零样本时间序列预测中的性能。

Comments 9 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20062 2025-12-24 cs.CR cs.AI 77%

On the Effectiveness of Instruction-Tuning Local LLMs for Identifying Software Vulnerabilities

关于指令微调本地LLM在识别软件漏洞中的有效性

Sangryu Park, Gihyuk Ko, Homook Cho

机构 * KAIST Cyber Security Research Center(韩国科学技术院网络安全研究中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过指令微调本地LLM来提升软件漏洞识别效果,替代依赖API的大型模型,实现更高效、安全的漏洞管理。

Comments The 9th International Conference on Mobile Internet Security (MobiSec 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00477 2025-12-24 cs.CV 50%

LAMIC: Layout-Aware Multi-Image Composition via Scalability of Multimodal Diffusion Transformer

LAMIC:基于多模态扩散变换器可扩展性的布局感知多图像合成

Yuzhuo Chen, Zehua Ma, Jianhua Wang, Kai Kang, Shunyu Yao, Weiming Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Onestory Team(Onestory团队) East China Normal University(华东师范大学)

专题命中 指令微调 :foundation model(abstract)

AI总结 LAMIC通过无训练方式实现多参考图像合成,提升布局控制与背景一致性。

Comments 8 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏