SUMMA: A Multimodal Large Language Model for Advertisement Summarization
专题命中 指令微调 :large language model(title);language model(title)
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 指令微调 :large language model(title);language model(title)
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)
Comments MRL Workshop at EMNLP 2025
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)
机构 * University of Toronto(多伦多大学) ; Vector Institute(向量研究所)
专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);prompting(abstract)
Comments ICLR 2025
机构 * Google(谷歌) ; Columbia University(哥伦比亚大学)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)
Comments ICLR 2025; Code: https://github.com/google-research/google-research/tree/master/learning_to_clarify
机构 * School of Remote Sensing and Information Engineering(遥感与信息工程学院) ; College of Oceanography and Space Informatics(海洋学与空间信息学院) ; School of Surveying and Geoinformation Engineering(测绘与地理信息工程学院)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; Meituan(美团) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)
机构 * Show Lab, National University of Singapore(1 显示实验室,新加坡国立大学) ; ByteDance(2 字节跳动)
专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);post-training(abstract)
机构 * University of California, San Diego(加州大学圣迭戈分校)
专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);prompting(abstract)
Comments 14 pages, 7 figures
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)
Comments Accepted to ICML 2024 Workshop on LLMs & Cognition
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Renmin University of China(中国人民大学)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)
专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)
Comments Technical Report (In Progress); Code released at: https://github.com/TencentARC/SEED-Bench-R1
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)
专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);preference optimization(abstract)
Comments To appear at the Ninth Conference on Machine Translation (WMT24)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments 23 pages, 5 figures
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments 11 pages, 5 figures
专题命中 指令微调 :large language model(title);language model(title)
Comments This work has been submitted to the IEEE Transactions Journal for possible publication
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments EMNLP 2024 Main
专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);SFT(abstract)
Comments Code is available in https://github.com/ByungKwanLee/Phantom
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);RLHF(abstract)
Comments 25 pages, 6 figures
专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);RLHF(abstract)
Comments technical report. arXiv admin note: text overlap with arXiv:2306.16636 by other authors
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)
MoRFI: 基于单调性的稀疏自编码器特征识别
机构 * University of Edinburgh, UK(爱丁堡大学) ; Heriot-Watt University, UK(赫瑞斯泰德大学)
专题命中 指令微调 :language model(abstract,comments);large language model(abstract);post-training(abstract);SFT(abstract)
AI总结 本文通过控制微调实验发现,逐步引入新知识会增加幻觉,提出MoRFI方法利用稀疏自编码器分析残差流激活,识别因果相关的潜在特征。
Comments Accepted to the Conference on Language Modeling (COLM) 2026
专题命中 指令微调 :foundation model(abstract,comments);LLM(abstract);large language model(abstract);language model(abstract)
Comments Short paper, ICLR '23 Workshop on Understanding Foundation Models
SubZero+:基于大学习率的高效零阶大语言模型微调方法
专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 SubZero+是改进的SubZero框架,通过三种互补方式提升零阶优化稳定性,在1.3B至32B参数模型的SuperGLUE任务上,优于现有零阶基线,扩大稳定学习率范围,缩小与一阶方法差距且内存开销极小。
面向异构联邦指令微调的MoE路由器引导聚类
机构 * California State University, Dominguez Hills(加州州立大学多明戈斯山分校) ; University of California, Irvine(加州大学欧文分校) ; Johns Hopkins University(约翰斯·霍普金斯大学) ; Arizona State University(亚利桑那州立大学)
专题命中 指令微调 :instruction tuning(title);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 该研究提出ClientMorpher框架,通过MoE路由特征设计两种聚类策略,在Databricks Dolly-15K数据集上验证其可提升联邦指令微调的个性化性能,且通信成本与传统方法相当。
大语言模型智能体中的后门净化动力学
专题命中 指令微调 :LLM(title,abstract);分类 cs.AI
AI总结 本研究针对大语言模型智能体的后门问题,提出框架研究净化动力学,发现防御性投毒加遗忘可高效擦除多数后门,中间层仍留触发器感知痕迹。
用于跨多个显微镜数据集实现稳健白血病细胞分类的检索增强视觉基础模型
专题命中 指令微调 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG
AI总结 本研究提出基于预训练视觉基础模型的两阶段检索增强框架,经多数据集测试,可实现跨异构数据集的稳健白血病细胞分类,为解决领域偏移问题提供低成本替代方案。
Comments Accepted at SPIE Optics + Photonics 2026 for oral presentation. 23 pages, 12 figures, 9 tables
指令微调如何改变上游状态影响后期读取:一种跨修补诊断
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 指令微调 :post-training(title,abstract);SFT(abstract_cn);分类 cs.LG
AI总结 研究探讨指令微调如何通过后期栈与上游状态交互影响后续token选择,通过跨修补诊断发现指令微调模型的后期栈效果依赖自身训练状态,且稀疏特征在其中起中介作用。
Comments 14 pages, 4 figures. Code and compact artifacts: https://github.com/yifan1207/first-divergence-crosspatching