RE-Adapt: Reverse Engineered Adaptation of Large Language Models
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments ICLR 2024
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments Code, models, dataset, and demo are available at https://github.com/dvlab-research/LongLoRA
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments The current submission is the first draft, published for the sole purpose of sharing an idea and encouraging community effort. A more consolidated version may come later
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract)
Comments 15 pages,version 1
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)
Comments To appear in IEEE Transactions on Robotics ©IEEE2023
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments 7 pages, 1 figure, submitted to the Artificial Intelligence in Medicine Journal
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);prompting(abstract)
Comments NeurIPS 2023
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments 4 pages, 2 tables
专题命中 指令微调 :language model(title,abstract);large language model(title);SFT(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)
Comments Technical Report
DICE:扩散大语言模型在生成CUDA内核方面表现出色
机构 * Westlake University(西湖大学) ; Hong Kong University of Science and Technology(香港科技大学) ; Rochester Institute of Technology(罗切斯特理工学院)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG;LLM(comments)
AI总结 提出CuKe数据集和BiC-RL训练框架,构建DICE系列扩散大语言模型(1.7B/4B/8B),在KernelBench上显著优于同类自回归和扩散模型,实现CUDA内核生成新SOTA。
Comments v2: Expanded with dLLM vs. autoregressive LLM comparisons, ablation studies, and qualitative case studies
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI;foundation model(comments)
Comments ECCV 2024 Workshop on Green Foundation Models
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI;foundation model(comments)
Comments Accepted at NeurIPS 2024 Workshop on Large Foundation Models for Educational Assessment (FM-Assess)
InternBootcamp 技术报告:通过可验证的任务扩展提升大语言模型推理能力
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Fudan University(复旦大学)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)
AI总结 本文提出InternBootcamp框架,通过可验证的任务扩展方法提升大语言模型的推理能力,为基于强化学习的模型优化、合成数据生成和模型评估提供了基础设施。
Comments InternAgentHarness tech report
询问是不够的:LLM 置信度校准中的协议敏感性
机构 * Seoul National University(首尔国立大学)
专题命中 指令微调 :LLM(title,title_cn);分类 cs.AI
AI总结 研究通过改变测量协议(如条件上下文、令牌读取方式)发现,LLM 的令牌概率置信度与口头置信度之间的比较高度敏感,且口头置信度不仅反映正确性还反映答案的合理性和来源。
CHARM:一种用于零样本迁移的具有分层上下文建模的多模态图基础模型
机构 * School of Computer Science and Technology, College of Intelligence and Computing, Tianjin University(天津大学智能与计算学部计算机科学与技术学院) ; Data Science Program, Columbian College of Arts and Sciences, The George Washington University(乔治华盛顿大学文理学院哥伦比亚艺术与科学学院数据科学项目)
专题命中 指令微调 :foundation model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)
AI总结 研究多模态图零样本迁移问题,提出CHARM模型,通过分层上下文建模,用图上下文替换原始节点,减少对目标域监督或适配的依赖,经实验验证该模型在零样本多模态图任务上有改进。
推进前填充:能力差距驱动的场景专用遥感多模态大语言模型的训练后处理
专题命中 指令微调 :post-training(title,abstract);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)
AI总结 针对地球观测应用中遥感多模态大语言模型因高质量数据稀缺和能力覆盖不完整难以实现细粒度场景专业化的问题,提出能力差距驱动的推进前填充(FBA)方法,经实验验证其效果优于其他方法,提升了模型在相关基准上的表现。
嘿,那是我的模型!引入链与哈希,一种大语言模型指纹识别技术
机构 * Microsoft(微软)
专题命中 指令微调 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 提出一种基于链与哈希的LLM指纹识别框架,通过加密绑定提示与响应防止碰撞,并利用随机填充和元提示配置增强鲁棒性,实现可验证的所有权证明。
Comments Published at ICLR 2026
DNA语言模型:面向微调任务的预训练评估
机构 * CNRS(法国国家科学研究中心) ; LORIA(洛林大学)
专题命中 指令微调 :language model(title,abstract);LLM(abstract_cn);large language model(abstract);foundation model(abstract)
AI总结 本研究系统比较了基于Transformer和卷积的DNA语言模型在微调任务上的表现,评估了预训练的实际贡献以及BPE分词对基因组学任务的影响。
Comments 12 pages, 2 figures, 14 tables
超越轨迹模仿:策略引导的策略优化用于大语言模型推理
机构 * School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院) ; Meituan, Inc., China(美团) ; Shenzhen Loop Area Institute, China(深圳环区研究所) ; Meta AI, USA(Meta AI)
专题命中 指令微调 :LLM(title,summary_cn);SFT(abstract,abstract_cn);language model(abstract);分类 cs.AI
AI总结 提出策略引导的策略优化(SGPO),通过可重用策略蒸馏替代实例级轨迹模仿,利用前向KL散度和自适应加权提升LLM推理泛化能力,在数学基准上平均提升2.2分。
HarnessBridge: 用于LLM智能体框架的可学习双向控制器
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract);instruction tuning(abstract)
AI总结 提出HarnessBridge,一种轻量级可学习框架控制器,通过双向投影参数化智能体-环境接口,减少令牌使用和轨迹长度,并泛化到更大模型。