arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-09-01 至 2026-09-01 共收录 86 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 86 篇

2608.30910 2026-09-01 cs.LG cs.CL 新提交 94%

S3C-LLM: Skill-Code Guided Agentic Language Models for Spectrum-to-Structure Elucidation

S3C-LLM:用于谱图到结构解析的技能-代码引导型智能体语言模型

Xuanle Zhao, Xinyuan Cai, Xiang Cheng, Bo Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 指令微调 :LLM(title,title_cn);language model(title,abstract);SFT(abstract,abstract_cn);large language model(abstract)

AI总结 S3C-LLM是一种技能-代码引导型智能体LLM,通过检索光谱学技能、执行分析代码整合证据与约束来解析分子结构,性能优于同类模型且训练语料更少。

Comments Accepted by EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13681 2026-09-01 cs.SE cs.AI cs.ET cs.LG 交叉投稿 93%

Fine-Tuning Qwen3-27B for C-to-Rust Code Translation: A Three-Stage Curriculum of Pretraining, Debugging-Aware SFT, and Task-Specific SFT

微调Qwen3-27B实现C到Rust代码翻译:预训练、调试感知监督微调与任务特定监督微调的三阶段课程

Pu Zhao, Changdi Yang, Yixiao Chen, Yi Gao, Yifan Cao, Haochen Zeng, Yanzhi Wang

机构 * Northeastern University(东北大学) EmbodyX Inc(EmbodyX公司) Aibao LLC(Aibao有限责任公司)

专题命中 指令微调 :SFT(title,abstract);pretraining(title,abstract);LLM(summary_cn,abstract_cn);large language model(abstract)

AI总结 本研究针对C到Rust代码翻译任务,对Qwen3-27B采用三阶段微调课程,结合SACTOR框架评估后,其性能优于基线模型及其他LLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29378 2026-09-01 cs.CL cs.AI 新提交 92%

Arabic Safety Alignment as Selective Refusal: An Empirical Study of SFT, DPO, and Guard Calibration

阿拉伯语安全对齐作为选择性拒绝:SFT、DPO与防护校准的实证研究

Mohamad Zbib, Ammar Mohanna

机构 * American University of Beirut(贝鲁特美国大学)

专题命中 指令微调 :SFT(title,title_cn);large language model(abstract);language model(abstract);preference optimization(abstract)

AI总结 该研究针对阿拉伯语大语言模型的安全对齐问题,通过实证对比SFT、DPO等方法,提出需针对特定模型选择操作点以平衡有害提示拒绝与良性提示接受的权衡。

Comments The Fourth Arabic Natural Language Processing Conference(ArabicNLP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18272 2026-09-01 cs.AI cs.CL 版本更新 92%

Retrieval-Augmented LLM Agents: Learning to Learn from Experience

基于检索的LLM代理:学习从经验中学习

Thomas Palmeira Ferraz, Romain Deffayet, Vassilina Nikoulina, Hervé Déjean, Stéphane Clinchant

机构 * NAVER LABS Europe(NAVER实验室欧洲)

专题命中 指令微调 :LLM(title,title_cn);SFT(summary_cn,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出结合微调与经验检索的方法,通过LoRA优化SFT流程,分析经验检索关键设计,提出整合经验检索的训练流程,提升代理对新任务的泛化能力。

Comments Accepted at EMNLP 2026 - Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28958 2026-09-01 cs.CL cs.CV 新提交 92%

CoVA-SFT: A Large-Scale Dataset for Chain of Visual Abstractions

CoVA-SFT:用于视觉抽象链的大规模数据集

Tsung-Han Wu, Heekyung Lee, Anya Ji, Haoming Chen, Trevor Darrell, Joseph E. Gonzalez, David M. Chan

专题命中 指令微调 :SFT(title,title_cn);LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 CoVA-SFT是用于视觉抽象链的大规模数据集,含5.19万样本等,经其微调的模型在CoVA-Bench上性能优于交错式CoT基线2倍以上,凸显相关研究的开放挑战。

Comments Accepted to EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18540 2026-09-01 cs.CL cs.CR cs.LG 版本更新 92%

Learning diverse attacks on large language models for robust red-teaming and safety tuning

针对大语言模型学习多样化攻击以用于鲁棒红队测试与安全调优

Seanie Lee, Minsu Kim, Lynn Cherif, David Dobre, Juho Lee, Sung Ju Hwang, Kenji Kawaguchi, Gauthier Gidel, Yoshua Bengio, Esmeralda S. Whitammer, Moksh Jain

机构 * KAIST(韩国科学技术院) Mila – Québec AI Institute(米拉-魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) National University of Singapore(新加坡国立大学) University of Edinburgh(爱丁堡大学) CIFAR(加拿大高级研究所)

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

AI总结 该研究针对现有红队测试方法存在的模式崩塌或攻击有效性不足问题,提出GFlowNet微调加二次平滑的方法生成多样化攻击提示,其攻击对各类LLM有效且可迁移,用该攻击提示调优的模型对其他攻击方法具有鲁棒性。

Comments ICLR 2025; code: this https URL (https://github.com/GFNOrg/red-teaming)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29137 2026-09-01 cs.CV 新提交 92%

Chat-Edit-3D++: Interactive 3D and 4D Scene Editing via Large Language Models

Chat-Edit-3D++:基于大语言模型的交互式3D与4D场景编辑

Shuangkang Fang, Yufeng Wang, Yi-Hsuan Tsai, Wenrui Ding, Yi Yang, Shuchang Zhou, Ming-Hsuan Yang

机构 * School of Electrical and Information Engineering, Beihang University(北京航空航天大学电子信息工程学院) Institute of Unmanned System, Beihang University(北京航空航天大学无人系统研究院) Atmanity Inc.(Atmanity公司) Megvii Research(旷视研究院) University of California at Merced(加州大学默塞德分校)

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 该研究针对现有3D场景编辑方案的缺陷,提出Hash-Atlas网络及基于LLM的CE3D++方法,实现2D编辑与3D重建解耦,可调度30种视觉工具,支持3D/4D场景交互式文本驱动编辑。

Comments Project Website: this https URL (https://sk-fun.fun/CE3D)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29127 2026-09-01 cs.AI 新提交 92%

Beyond Correctness: Validity-Oriented Evaluation of Biomedical LLM Judges

超越正确性:面向生物医学大语言模型评判者的有效性导向评估

Rodrigo de Oliveira, Federico Pittino, James Gwinnutt, Jay Nanavati

机构 * IQVIA(艾昆纬)

专题命中 指令微调 :LLM(title,summary_cn);SFT(summary_cn,abstract);分类 cs.AI

AI总结 针对生物医学LLM评判者,该研究提出有效性导向的评估流程,评估Llama-3.1-8B-Instruct的四种训练场景,发现SFT→RL场景在多维度表现最优,可匹配或超越前沿模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09347 2026-09-01 cs.CL 版本更新 92%

LLP: LLM-Based Product Pricing in E-commerce

LLP:基于大语言模型的电商产品定价方案

Hairu Wang, Sheng You, Qiheng Zhang, Xike Xie, Shuguang Han, Yuchen Wu, Fei Huang, Jufeng Chen

机构 * University of Science and Technology of China(中国科学技术大学) Xianyu of Alibaba(阿里巴巴闲鱼)

专题命中 指令微调 :LLM(title,summary_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对C2C平台二手卖家定价难题,研究人员提出首个基于LLM的二手产品定价框架LLP,经两阶段优化与置信过滤后,在闲鱼部署的性能显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30622 2026-09-01 cs.SD eess.AS 新提交 90%

Textual Acoustic Grounding for Generalizable LLM-Based Deepfake Voice Detection

面向通用型大语言模型的深度伪造语音检测的文本声学接地

Yassine El Kheir, Xin Wang, Wanqing Ge, Tim Polzehl, Sebastian Moeller, Junichi Yamagishi

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) National Institute of Informatics(情报信息学研究所) Technical University of Berlin(柏林工业大学)

专题命中 指令微调 :LLM(title,summary_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 该研究针对深度伪造语音检测的域泛化问题,提出跨模态提示策略,将openSMILE提取的声学特征作为文本标记注入冻结Qwen LLM,在ITW、MLAAD基准上获16.2%宏观F1绝对提升,性能最优。

Comments 6pages + 1ref, SLT Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18364 2026-09-01 cs.AI cs.GR cs.MA 版本更新 90%

Training and Agentic Inference Strategies for LLM-based Manim Animation Generation

基于LLM的Manim动画生成的训练与代理推理策略

Ravidu Suien Rammuni Silva, Ahmad Lotfi, Isibor Kennedy Ihianle, Golnaz Shahtahmassebi, Jordan J. Bird

机构 * Department of Computer Science, Nottingham Trent University, Nottingham, United Kingdom(计算机科学系,诺丁汉特伦特大学,诺丁汉,英国)

专题命中 指令微调 :LLM(title,title_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出ManimTrainer和ManimAgent,结合监督微调与强化学习,提升文本到代码到视频的转换性能,通过ManimBench评估17种模型,结果显示GRPO和RITL-DOC策略显著提升动画生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04716 2026-09-01 cs.CL 版本更新 89%

Identifying and Mitigating Bottlenecks in Role-Playing Agents: A Systematic Study of Disentangling Character Profile Axes

识别与缓解角色扮演代理中的瓶颈:解耦角色档案轴线的系统研究

Yonghyun Jun, Junhyuk Choi, Jeonghyun Park, Jihyeong Park, Liu Nicole Geumheon, Hwanhee Lee

机构 * Chung-Ang University(Chung-Ang 大学)

专题命中 指令微调 :LLM(summary_cn,abstract);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过解耦角色档案的熟悉度、结构和性格三个轴线,系统诊断LLM角色扮演代理的性能瓶颈,并提出无训练的场感知对比解码(FACD)策略来缓解性格带来的性能下降。

Comments Accepted EMNLP 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02857 2026-09-01 cs.LG cs.AI 版本更新 88%

GRZO: Group-Relative Zeroth-Order Optimization for Large Language Model Fine-Tuning

GRZO:用于大语言模型微调的组相对零阶优化

Liyan Tan, Yequan Zhao, Yifan Yang, Ruijie Zhang, Xinling Yu, Zheng Zhang

机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出GRZO优化器,通过组相对归一化聚合每个样本的损失,在不增加前向成本的情况下将有效梯度方向数从1提升至批量大小,降低方差并改善收敛,在多个模型和任务上优于MeZO。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16013 2026-09-01 cs.CL 版本更新 88%

Political Ideology Shifts in Large Language Models

大语言模型中的政治意识形态转变

Pietro Bernardelle, Stefano Civelli, Leon Fröhling, Riccardo Lunardi, Kevin Roitero, Gianluca Demartini

机构 * The University of Queensland(昆士兰大学) University of Udine(乌迪内大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究以政治指南针测试为探针,发现大语言模型的意识形态可塑性随规模变化,显式启动会引发不同程度的意识形态转变,凸显评估其政治属性时需考虑交互因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26574 2026-09-01 cs.CR 版本更新 88%

GradSentry: Gradient Spectral Entropy for Backdoor Sample Filtering in Large Language Model Fine-Tuning

GradSentry: 大语言模型微调中基于梯度谱熵的后门样本过滤

Haodong Zhao, Tianyi Xu, Tianhang Zhao, Zhuosheng Zhang, Gongshen Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 提出GradSentry方法,利用每个样本梯度的谱熵区分后门样本与干净样本,无需聚类即可在任意投毒比例下有效过滤后门样本。

Comments Accepted as EMNLP 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20766 2026-09-01 cs.CL cs.AI cs.LG 版本更新 88%

Turning the Spell Around: Lightweight Alignment Amplification via Rank-One Safety Injection

反转思路:通过单秩安全注入实现轻量级对齐增强

Harethah Abu Shairah, Hasan Abed Al Kader Hammoud, George Turkiyyah, Bernard Ghanem

机构 * King Abdullah University of Science and Technology (KAUST)(卡布尔大学科学与技术学院)

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出单秩安全注入(ROSI)这一无需微调的白盒方法,通过修改模型权重增强 LLM 安全对齐,可提升安全拒绝率且保留模型效用,还可重新对齐未审查模型,是高效的 LLM 安全改进机制。

Comments EMNLP 2026, Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29352 2026-09-01 cs.AI 新提交 87%

Cross-Relational Preference Learning for Better LLM Instruction Following

用于提升大语言模型指令遵循能力的跨关系偏好学习

Runsheng Li, Kai Sun, Bin Shi, Bo Dong

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Shaanxi Provincial Key Laboratory of Big Data Knowledge Engineering, Xi’an Jiaotong University(西安交通大学陕西省大数据知识工程重点实验室) School of Distance Education, Xi’an Jiaotong University(西安交通大学远程教育学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对LLMs遵循复杂指令时忽略不同指令允许响应空间关系的问题,提出CRPL框架,通过两项关键技术构建高质量偏好数据,在多方法、主干及基准上实现显著改进与强泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30158 2026-09-01 cs.CL cs.AI 新提交 87%

CPR for LLMs: Critical-Point Routing against Catastrophic Forgetting in Domain Adaptation

面向大语言模型的临界路径路由(CPR):应对领域自适应中的灾难性遗忘

Kwangmin Ki, Yunhun Nam, Jongheon Jeong, Jaehyung Kim

机构 * Korea University(高丽大学) Yonsei University(延世大学)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出CPR框架,通过解耦基础模型与SFT专家模型,基于临界token进行路由,在领域自适应中缓解LLMs的灾难性遗忘,实现最优性能且开销极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28648 2026-09-01 cs.AI cs.CL cs.LG 新提交 87%

How Language Models Choose Sides: Internal Representations of Instruction Hierarchy

语言模型如何选择立场:指令层级的内部表征

Enrique Balp-Straffon, Chih-Hao Hsu, Rushiraj Gadhvi, Sunishchal Dev, Callum Stuart McDougall, Anusha Mujumdar

机构 * Amazon(亚马逊) National Taiwan University(国立台湾大学) Plaksha University(普拉卡莎大学) RAND Corporation(兰德公司) Algoverse Google DeepMind(谷歌DeepMind)

专题命中 指令微调 :LLM(summary_cn,abstract_cn);language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究探究指令微调LLM在系统与用户指令冲突中的仲裁机制,构建含41对约束的基准评估8个模型,发现反层级模型Llama-3.1-8B的冲突结果可从残差流激活线性解码,干预效果取决于读出几何结构。

Comments Published at the ICML 2026 Mechanistic Interpretability workshop, 16 pages (including appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29814 2026-09-01 cs.AI 新提交 86%

FRAMEWORKERS: A Dynamic Multi-Agent Framework for AI-Generated Video Production

FRAMEWORKERS:一种用于AI生成视频制作的动态多智能体框架

Zhendong Li, Lei Sun, Letian Shi, Deheng Zhang, Ruibo Ming, Mengshun Hu, Dannong Xu, Jian Wang, Danda Paudel, Luc Van Gool, Jinjin Gu

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 FRAMEWORKERS是一种以任务为中心的动态多智能体视频制作框架,通过Director和Assistant分工优化任务编排,在路由准确性、故障恢复等多方面优于现有方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10577 2026-09-01 cs.CL cs.AI 版本更新 86%

Man Made Language Models? Evaluating LLMs' Perpetuation of Masculine Generics Bias

人造语言模型?评估大型语言模型(LLMs)对阳性通性偏误的延续

Enzo Doyen, Amalia Todirascu

机构 * University of Strasbourg(斯特拉斯堡大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究评估了本地及专有大型语言模型在回应法语通用指令时的阳性通性偏误情况,发现其存在明显偏误且极少使用性别公平语言,凸显了此类偏误的持续性。

Comments Accepted to EMNLP 2026 Main; camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30987 2026-09-01 cs.CL cs.AI cs.LG 新提交 86%

Stick to What You Know: A Study of Knowledge-Aligned Supervised Fine-Tuning

坚持你所知:知识对齐的监督微调研究

Arthur Becker, Jakob Kemmler, David Thulke, Christine Schäfer, Christian Dugast, Hermann Ney

机构 * AppTek GmbH(AppTek有限公司) RWTH Aachen University(亚琛工业大学)

专题命中 指令微调 :SFT(summary_cn,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究提出知识对齐的监督微调方法,引入证据重写、回忆重写两个变体,实验显示其可减少事实幻觉、保留通用能力,回忆重写效果最优且改善弃权行为,证实超知识SFT目标会引发幻觉。

Comments Accepted to EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25292 2026-09-01 cs.AI 版本更新 85%

Instruction-Tuned Language Models Cannot Sample from Distributions They Can Describe

指令微调语言模型无法从它们能描述的分布中进行采样

Chaemin Jang, Dongman Lee, Jihee Kim

机构 * School of Computing, KAIST(韩国科学技术院计算学院) School of Business and Technology Management, KAIST(韩国科学技术院商业与技术管理学院)

专题命中 指令微调 :language model(title,abstract);pretraining(abstract);post-training(abstract);分类 cs.AI

AI总结 研究发现指令微调语言模型无法从其能描述的分布中采样,存在“知道/做”分裂,通过让模型描述分布可减半误差,还提出PPA在无额外成本下降低21%误差。

Comments EMNLP Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17289 2026-09-01 cs.LG 版本更新 85%

REALM: Reliable Expertise-Aware Language Model Fine-Tuning from Noisy Annotations

REALM:从嘈杂标注中可靠地进行语言模型微调

Sajjad Ghiasvand, Mark Beliaev, Mahnoosh Alizadeh, Ramtin Pedarsani

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract_cn);分类 cs.LG

AI总结 REALM通过无监督学习同时学习模型参数和标注者专业能力评分,提升在噪声标注下的微调效果,实验显示其在多种任务和数据集上均优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27790 2026-09-01 cs.LG 版本更新 84%

SYNAPSE: Neuro-Symbolic Visual Thought-to-Text Decoding via Topological Semantic Denoising

SYNAPSE: 通过拓扑语义去噪的神经符号视觉思维到文本解码

Akshaj Murhekar, Abhijit Mishra

机构 * School of Information University of Texas at Austin(信息学院德克萨斯大学奥斯汀分校)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 提出SYNAPSE框架,利用常识图结构和潜在样本进行推理时符号正则化,稳定脑电到文本解码中的语义生成,无需微调大语言模型。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04865 2026-09-01 cs.LG cs.PL 版本更新 84%

Agnostics: Learning to Code in Any Programming Language via Reinforcement with a Universal Learning Environment

Agnostics: 通过通用学习环境的强化学习实现任何编程语言的代码学习

Aleksander Boruch-Gruszecki, Yangtian Zi, Zixuan Wu, Tejas Oberoi, Carolyn Jane Anderson, Joydeep Biswas, Arjun Guha

机构 * Northeastern University(东北大学) University of Texas(德克萨斯大学) Wellesley College(韦尔斯利学院)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 Agnostics通过通用学习环境的强化学习,实现任何编程语言的代码学习,提升低资源语言模型性能并简化训练流程。

Comments 30 pages, 19 figures. Accepted at ICLR 2026. For data, code, artifacts, see this https URL (https://agnostics.abgru.me)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02194 2026-09-01 cs.CL cs.AI 版本更新 84%

Where Does Robustness Live? Neuron-Guided Adaptation for Retrieval-Augmented Language Models

Neuro-RIT: 用于鲁棒检索增强语言模型的神经引导指令微调

Jae O Lee, Jaemin Kim, Sumyeong Ahn, Seo Yeon Park

机构 * Hanyang University(汉阳大学)

专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

AI总结 Neuro-RIT通过神经层面的对齐提升检索增强语言模型的鲁棒性,通过神经属性挖掘分离相关与无关上下文的神经元,并采用两阶段指令微调策略增强噪声鲁棒性。

Comments Accepted to EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09974 2026-09-01 cs.AI cs.CL 版本更新 84%

SPRInG: Continual LLM Personalization via Selective Parametric Adaptation and Retrieval-Interpolated Generation

SPRInG: 通过选择性参数适应和检索插值生成实现连续大语言模型个性化

Seoyeon Kim, Jaehyung Kim

机构 * Yonsei University(延世大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 SPRInG通过选择性参数适应和检索插值生成,实现连续大语言模型个性化,有效应对用户偏好变化带来的挑战。

Comments EMNLP 26 Main, 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30713 2026-09-01 cs.SD 新提交 83%

Closing the Verification Loop: Self-Check Captioning for Long-Paragraph Detailed Audio Captioning

闭合验证循环:用于长段落详细音频字幕的自检查字幕生成

Fengji Ma, Yan Rong, Xu Li, Chen Zhang, Pengfei Wan, Li Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Kuaishou Technology(快手科技)

专题命中 指令微调 :SFT(summary_cn,abstract);language model(abstract)

AI总结 本研究针对长段落详细音频字幕的未解决问题,提出SCC框架,构建LACap-50k语料库与LC-SFT方法,使系统在开源字幕生成器中达最优性能。

Comments EMNLP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00754 2026-09-01 cs.CV 版本更新 83%

Enhancing Self-Supervised Visual Representation Learning via Low-Rank Adapted LLMs

通过低秩适配大语言模型(LLMs)增强自监督视觉表征学习

Selim Kuzucu, Muhammad Ferjad Naeem, Anna Kukleva, Federico Tombari, Bernt Schiele

机构 * Max Planck Institute for Informatics(马克斯·普朗克信息研究所)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 本文提出语言解锁视觉Transformer(LUViT),通过协同预训练策略,结合掩码自编码(MAE)与低秩适配(LoRA),解决LLMs与ViTs的模态不匹配问题,提升下游视觉任务性能。

Comments Published in Transactions on Machine Learning Research (TMLR), 32 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏