Impact of Large Language Models of Code on Fault Localization
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
Comments Accepted in Workshop on Generative AI for Recommender Systems and Personalization, KDD 2024
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
Comments accepted in the short paper track of the 2024 ACM International Conference on Information and Knowledge Management (CIKM 2024)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
Comments ECCV 2024; Project Page: https://github.com/FanScy/BEVInstructor
专题命中 指令微调 :language model(title,abstract);instruction tuning(title,abstract)
Comments To appear at ECCV2024
专题命中 指令微调 :language model(title,abstract);small language model(title);分类 cs.CL、cs.AI、cs.LG
Comments ACL 2024 Camera Ready Version
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
Comments ICML 2024
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
专题命中 指令微调 :large language model(title);language model(title);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to NAACL Findings 2024
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
Comments 9 pages, 6 figures
专题命中 指令微调 :LLM(title,abstract);language model(title,abstract)
Comments 10 pages, 4 figures. Callie Y. Kim and Christine P. Lee contributed equally to the work. To be published in Proceedings of the 2024 ACM/IEEE International Conference on Human-Robot Interaction (HRI '24), March 11--14, 2024, Boulder, CO, USA
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 17 pages, 3 figures
专题命中 指令微调 :language model(title,abstract);prompting(title,abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)
专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI、cs.LG
Comments Draft V2 includes better baselines, experiments on GLUE, and more on adapter latency
专题命中 指令微调 :language model(title,abstract);small language model(title);分类 cs.CL、cs.AI
Comments Workshop on Language Models for Underserved Communities (co-located with NAACL 2025)
LLM 代理何时对表面噪声与语义噪声做出不同处理?一项基于 68 个单元格的测量研究及留出轨迹级验证
机构 * School of Information and Software Engineering, UESTC(信息与软件工程学院,电子科技大学) ; Jacobs School of Engineering, UC San Diego(工程学院,加州大学圣地亚哥分校)
专题命中 指令微调 :LLM(title,title_cn);分类 cs.CL
AI总结 本研究通过 68 个单元格的测量实验,发现大语言模型驱动的思维链和 ReAct 代理对语义扰动(如释义、同义词)比表现扰动(如格式、重排序)更敏感,并基于留出模型和轨迹级机制分析提出了“隐蔽发散”解释。
Agentic ESOpt:以最小GPU资源微调长视野大语言模型智能体
机构 * National University of Singapore(新加坡国立大学)
专题命中 指令微调 :LLM(title,summary_cn);分类 cs.LG
AI总结 本文提出Agentic ESOpt框架,用进化策略微调长视野LLM智能体,仅需最小GPU资源,在WebArena-Lite上使Qwen-3.5-27B性能提升6.69%,提示-参数协同演化在多数设置中优于基准。
VLM2Rec: 解决视觉语言模型嵌入器在多模态序列推荐中的模态崩溃问题
机构 * Pohang University of Science
专题命中 指令微调 :language model(title,abstract);SFT(abstract,abstract_cn);large language model(abstract);分类 cs.AI
AI总结 本文提出VLM2Rec框架,通过弱模态惩罚对比学习和跨模态关系拓扑正则化,解决多模态序列推荐中模态崩溃问题,提升推荐准确性和鲁棒性。
大语言模型作为导师:不可验证强化学习中的策略感知提示适应
机构 * KAIST(韩国科学技术院) ; Upstage ; University of Toronto(多伦多大学) ; Carnegie Mellon University(卡内基梅隆大学) ; NVIDIA(英伟达)
专题命中 指令微调 :LLM(title,summary_cn);分类 cs.AI
AI总结 针对不可验证强化学习中训练提示静态导致的问题,提出LLM-as-a-Tutor框架,让大语言模型从评判扩展为导师,通过对比策略展开检测无挑战性提示并添加约束,提升性能。
基于Tailscale的双节点NVIDIA DGX Spark:用于分布式大语言模型训练和网络威胁情报微调的远程访问测试平台
专题命中 指令微调 :LLM(title,abstract);SFT(abstract,abstract_cn);pretraining(abstract);分类 cs.LG
AI总结 本研究展示了双节点NVIDIA DGX Spark通过Tailscale VPN实现分布式NanoChat预训练,构建网络安全微调数据集并验证其效果,同时该集群可支持研究与教学,证明适度本地基础设施的可行性。
Comments 12 pages, 3 figures, 4 tables. Deployment runbook and code: https://github.com/viyer-research/dual-dgx-spark-tailscale-testbed
超越路由饱和:多模态持续指令调优中专家路由的长程类增量视角
专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 该研究针对多模态持续指令调优中专家路由的任务识别问题,构建含34个任务的FLEX基准,提出MCIL框架,适配CIL方法后使LoRA匹配和MacroScore分别提升最高16.3个百分点、4.6个点
重要的不是你说了什么,而是你怎么说:评估大语言模型对信念表达的回应
机构 * ETH Zürich(苏黎世联邦理工学院) ; University of Zurich(苏黎世大学) ; UC San Diego(加州大学圣地亚哥分校)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 研究用户信念表达形式对大语言模型的影响,引入基于语言维度的类型学,生成可控查询对,评估不同架构、规模和训练阶段的16个LLMs,发现响应行为差异及能显著说服模型的特定信念表达,揭示语言框架对模型情境整合的影响。
Comments Published at ACL 2026
LLM隐藏状态中的代码正确性信号:生成前探测与修复几何
机构 * Independent researcher(独立研究员)
专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 本文通过残差化方法,发现Qwen3-4B-Instruct模型在生成前隐藏状态可线性解码代码正确性(AUC 0.931),但修复成功的方向性信号在控制上下文协变量后消失,揭示了方法学上的正负结果。
Comments 7 pages, 4 tables. Code, data, and analysis scripts available at https://github.com/CarloDiCicco/ReasoningLab
ReLope:KL正则化的LoRA探针用于多模态大语言模型路由
机构 * Pennsylvania State University(宾夕法尼亚州立大学) ; Amazon AGI(亚马逊AGI) ; Google(谷歌)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 针对多模态大语言模型路由中探针性能下降问题,提出Attention Probe和KL正则化的LoRA探针ReLope,通过改进隐藏状态质量提升路由效果。
RAFP:通过稀有区域指纹识别大语言模型谱系
机构 * Department of Computer Science, Columbia University, USA(哥伦比亚大学计算机科学系) ; Meta, USA(Meta公司)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 针对大语言模型所有权验证需求,提出RAFP框架,利用稀有区域指纹识别模型谱系。该方法非侵入性,通过离散梯度优化构建指纹,理论分析表明其在微调下似然变化有界,实验显示在黑盒设置中性能优于基线。
Comments 16 pages