arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-03 至 2025-12-03 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 13 篇

2512.02584 2025-12-03 cs.MM 90%

Stepwise Schema-Guided Prompting Framework with Parameter Efficient Instruction Tuning for Multimedia Event Extraction

分步模式引导提示框架与参数高效指令微调用于多模态事件提取

Xiang Yuan, Xinrong Chen, Haochen Li, Hang Yang, Guanyu Wang, Weiping Li, Tong Mo

专题命中 指令微调 :instruction tuning(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出分步模式引导提示框架与参数高效指令微调方法,用于提升多模态事件提取任务的性能。

Comments Accepted by 2025 IEEE International Conference on Multimedia and Expo

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02069 2025-12-03 cs.CR cs.AI 89%

Large Language Model based Smart Contract Auditing with LLMBugScanner

基于大型语言模型的智能合约审计与LLMBugScanner

Yining Yuan, Yifei Wang, Yichang Xu, Zachary Yahn, Sihao Hu, Ling Liu

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 LLMBugScanner通过结合领域知识适应和集成推理,提升智能合约漏洞检测的鲁棒性和泛化能力,提供了一种高效且可扩展的审计框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21393 2025-12-03 cs.CR cs.AI 88%

VeriLoRA: Fine-Tuning Large Language Models with Verifiable Security via Zero-Knowledge Proofs

VeriLoRA: 通过零知识证明实现通过验证的安全大语言模型微调

Guofu Liao, Taotao Wang, Shengli Zhang, Jiqun Zhang, Shi Long, Dacheng Tao

机构 * Shenzhen University(深圳大学) Nanjing University of Science(南京理工大学) Nanyang Technological University(南洋理工大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 VeriLoRA通过整合零知识证明与LoRA微调,实现了大语言模型在敏感环境中的安全可信部署。

Comments This paper has been accepted for publication at the Network and Distributed System Security Symposium (NDSS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02802 2025-12-03 cs.LG cs.AI 86%

TabTune: A Unified Library for Inference and Fine-Tuning Tabular Foundation Models

TabTune:用于推理和微调表格基础模型的统一库

Aditya Tanna, Pratinav Seth, Mohamed Bouadi, Utsav Avaiya, Vinay Kumar Sankarapu

机构 * Lexsi Labs(Lexsi实验室)

专题命中 指令微调 :foundation model(title,abstract);pretraining(abstract);SFT(abstract);分类 cs.AI、cs.LG

AI总结 TabTune是一个统一库,通过单一接口标准化表格基础模型的完整工作流程,支持多种适应策略并提升评估一致性。

Comments The library is open source and available at https://github.com/Lexsi-Labs/TabTune

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02892 2025-12-03 cs.CL 85%

Fast-Decoding Diffusion Language Models via Progress-Aware Confidence Schedules

通过进度感知置信度调度实现扩散语言模型的快速解码

Amr Mohamed, Yang Zhang, Michalis Vazirgiannis, Guokan Shang

机构 * MBZUAI Ecole Polytechnique(巴黎高等理工学院)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL

AI总结 SchED通过进度感知置信度调度实现扩散语言模型的快速解码,显著提升解码效率并保持高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02682 2025-12-03 cs.MA cs.AI 85%

Beyond Single-Agent Safety: A Taxonomy of Risks in LLM-to-LLM Interactions

超越单体安全:LLM到LLM交互中的风险分类

Piercosma Bisconti, Marcello Galisai, Federico Pierucci, Marcantonio Bracale, Matteo Prandi

机构 * icaro-lab(ICARO实验室)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出从模型级安全向系统级安全的转变,引入ESRH框架,阐述LLM交互中的集体风险并提出InstitutionalAI架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01402 2025-12-03 cs.LG cs.AI cs.CL 82%

Pre-trained Language Models Improve the Few-shot Prompt Ability of Decision Transformer

预训练语言模型提升决策变换器的少样本提示能力

Yu Yang, Pan Xu

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Duke University(杜克大学) Department of Biostatistics and Bioinformatics(生物统计学与生物信息学系) Department of Computer Science(计算机科学系)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 预训练语言模型提升决策变换器的少样本提示能力,通过初始化和提示正则化增强RL任务区分能力。

Comments 2 figures, 10 tables. Published in Transactions on Machine Learning Research (TMLR)

Journal ref Transactions on Machine Learning Research, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09809 2025-12-03 cs.CV cs.AI cs.LG 81%

Test-Time Spectrum-Aware Latent Steering for Zero-Shot Generalization in Vision-Language Models

测试时谱感知的潜在引导用于视觉-语言模型中的零样本泛化

Konstantinos M. Dafnis, Dimitris N. Metaxas

机构 * Rutgers University(罗格斯大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出STP,一种轻量级的测试时适应框架,通过谱感知方法引导潜在表示,提升视觉-语言模型在零样本泛化中的性能,同时保持高效推理速度和低内存消耗。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17636 2025-12-03 cs.CV cs.AI 77%

Aligning Diffusion Models with Noise-Conditioned Perception

对扩散模型进行噪声条件感知对齐

Alexander Gambashidze, Anton Kulikov, Yuriy Sosnin, Ilya Makarov

机构 * Artificial Intelligence Research Institute (AIRI)(人工智能研究 institute(AIRI)) Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究所) HSE University(俄罗斯高等经济学院) Research Center for Trusted Artificial Intelligence, ISP RAS(可信人工智能研究中心,信息与通信技术研究院) ISP RAS(信息与通信技术研究院)

专题命中 指令微调 :language model(abstract);SFT(abstract);preference optimization(abstract);分类 cs.AI

AI总结 本研究提出在扩散模型的U-Net嵌入空间中使用感知目标,以提升人类偏好对齐的效率和质量,并减少计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02358 2025-12-03 cs.AI 77%

Beyond Playtesting: A Generative Multi-Agent Simulation System for Massively Multiplayer Online Games

超越试玩:一种生成式多智能体仿真系统用于大规模多人在线游戏

Ran Zhang, Kun Ouyang, Tiancheng Ma, Yida Yang, Dong Fang

机构 * independent researcher(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 本文提出了一种基于生成式多智能体仿真的系统,利用大型语言模型优化大规模多人在线游戏的数值设计,提升玩家体验并提高优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02870 2025-12-03 cs.CV 67%

Taming Camera-Controlled Video Generation with Verifiable Geometry Reward

驯服受控摄像机视频生成的可验证几何奖励

Zhaoqing Wang, Xiaobo Xia, Zhuolin Bie, Jinlin Liu, Dongdong Yu, Jia-Wang Bian, Changhu Wang

机构 * AIsphere National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 指令微调 :post-training(abstract);SFT(abstract)

AI总结 本文提出了一种在线强化学习框架,通过可验证的几何奖励提升摄像机控制的视频生成精度与一致性。

Comments 11 pages, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12039 2025-12-03 math-ph hep-th math.AT math.MP 50%

On Higher Topological T-duality Functors

关于更高拓扑T对偶函子

Ashwin S. Pande

专题命中 指令微调 :SFT(abstract)

AI总结 本文利用弦场论构建更高拓扑T对偶函子,通过几何化方法定义模空间并讨论其在拓扑T对偶和双重几何中的应用。

Comments New Version, Completely rewritten, 86 pages, latex, uses spectralsequences package

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02423 2025-12-03 cs.CV 50%

GUI Exploration Lab: Enhancing Screen Navigation in Agents via Multi-Turn Reinforcement Learning

GUI探索实验室:通过多轮强化学习提升代理的屏幕导航

Haolong Yan, Yeqing Shen, Xin Huang, Jia Wang, Kaijun Tan, Zhixuan Liang, Hongxin Li, Zheng Ge, Osamu Yoshie, Si Li, Xiangyu Zhang, Daxin Jiang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) StepFun Waseda University(早稻田大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 指令微调 :language model(abstract)

AI总结 GUI探索实验室通过多轮强化学习提升代理屏幕导航能力,结合监督微调和交互式试错,实现更高效和通用的GUI代理训练。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏