arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12855 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 1064 篇

2608.16156 2026-08-18 cs.AI 新提交 90%

TRCA: Transition-wise Rubric Credit Assignment for Long-horizon LLM Agents

TRCA:面向长 horizon 大语言模型智能体的逐步规则信用分配

Huan Zhang, Mingju Chen, Dongxu Zhou, Can Lv, Heng Chang, Sen Cui, Faguo Wu, Shiji Zhou

专题命中 指令微调 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对长 horizon LLM 智能体稀疏最终结果优化导致的细粒度信用分配难题,提出无需学习评估器或成功锚点的 TRCA,在多基准上取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09189 2026-08-11 cs.CL 新提交 90%

EmoS: A Theory-Grounded Framework for Evaluating and Aligning Emotional Intelligence in Spoken Language Models

EmoS:用于评估和对齐口语语言模型中情商的基于理论的框架

Junyu Wang, Siyuan Zhang, Peiyuan Jiang, Jian Zong, Jingyu Zhang, Tianrui Wang, Yuqin Lin, Zhenghui Chen, Shuqing Xie, Ziyang Ma, Meng Ge, Xiaobao Wang, Longbiao Wang, Jianwu Dang

机构 * Tianjin University(天津大学) Fuzhou University(福州大学) Shanghai Jiaotong University(上海交通大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

专题命中 指令微调 :SFT(summary_cn,abstract);language model(title,abstract);SLM(abstract_cn);分类 cs.CL

AI总结 本研究针对口语语言模型情商评估缺乏理论框架的问题,构建了EmoSBench基准,开发了基于SFT和GRPO优化的EmoS评估模型,其在EmoSBench上准确率达83.8%,接近人类水平。

Comments Accepted at ACM Multimedia 2026 (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09154 2026-08-11 cs.CL 新提交 90%

UNSPECIFIC: General Constraint Synthesis for Breaking Copy-and-Paste Shortcut in LLM Instruction Following

UNSPECIFIC:用于破解大语言模型指令遵循中复制粘贴捷径的通用约束合成方法

Jeet Sharma, Balpreet Kaur, Jeremiah Hong, Hamed Zamani, Haw-Shiuan Chang

机构 * University of Massachusetts, Amherst(马萨诸塞大学阿默斯特分校)

专题命中 指令微调 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究针对LLM指令遵循中复制粘贴的捷径问题,提出UNSPECIFIC框架,通过合成共有的约束、强化易满足约束、在文章及其摘要上评估来破解该问题,构建基准并验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08195 2026-08-11 cs.CR cs.AI 新提交 90%

Targeted Counterfactual Fingerprinting for Black-Box LLM Ownership Verification

面向黑盒大语言模型所有权验证的针对性反事实指纹技术

Yutong Wu, Xiaofan Bai, Shixin Li, Pingyi Hu, Ziqi Zhou, Zilong Wang, Xiaojing Ma, Songfeng Lu, Yuhong Li, Jin Xuan, Yi Wang, Dongmei Zhang, Bin Benjamin Zhu

机构 * Huazhong University of Science and Technology(华中科技大学) Alibaba Group(阿里巴巴集团) Microsoft Corporation(微软公司)

专题命中 指令微调 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对黑盒LLM所有权验证的挑战,提出TCF框架,将开放式生成对比转化为受限答案的反事实迁移,在四个LLM系列上平均AUC达0.9861,优于TRAP等现有方法。

Comments 37 pages, 18 figures, 23 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06069 2026-08-07 cs.CL 新提交 90%

Training-Free Token-Level Steering for LLM Personalized Co-Writing

面向LLM个性化协同写作的无训练令牌级引导

Wenhao Mao, Chengbin Hou, Weixiao Wang, Jialiang Zhu, Min Liu, Yibin Hao, Hairong Lv

专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对LLM个性化协同写作的需求,提出无训练框架SteerWrite,无需梯度更新即可适配专业领域,在多数据集、指标和模型上实现SOTA性能,大幅降低人工编辑工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26173 2026-07-30 cs.LG 新提交 90%

Shared SFT Lessons Across Alignment, Model Organisms, and Toy Models

对齐、模型有机体与玩具模型中的共享SFT经验教训

Anton de la Fuente, Arthur Conmy

专题命中 指令微调 :SFT(title,title_cn);分类 cs.LG

AI总结 本研究探讨对齐训练、模型有机体与玩具模型间SFT经验的三类迁移,发现跨领域迁移SFT经验可推动各领域发展,建议研究者借鉴域外技术。

Comments 31 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24259 2026-07-28 cs.AI 新提交 90%

Generative Artificial Intelligence (GenAI) to convert images of queuing networks into verifiable simulation models: an open-weight LLM workflow approach

生成式人工智能(GenAI)将排队网络图像转换为可验证的仿真模型:一种开放权重的大语言模型工作流方法

Thomas Monks, Alison Harper, Amy Heather, Navonil Mustafee

专题命中 指令微调 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究提出Sketch2DES工作流,利用开放权重LLMs将排队网络图像转换为可验证仿真模型,经多阶段处理,在多图表评估中各阶段可靠性高,相比直接代码生成提升多项性能,证明结构化工作流模型生成对LLM辅助仿真建模的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14371 2026-07-17 cs.LG econ.TH stat.ML 新提交 90%

Supervised Fine-Tuning vs. In-Context Learning: An Equilibrium Analysis of LLM Personalization under Congestion

监督微调与上下文学习:拥塞下大语言模型个性化的均衡分析

Fengzhuo Zhang, Zhuoran Yang, Dirk Bergemann

专题命中 指令微调 :LLM(title,abstract);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究大语言模型个性化中监督微调与上下文学习的选择问题,通过构建框架分析用户面临的统计 - 经济权衡,得出不同方法占优情况、资源消耗特性及平台策略等结论,实验与平台调研验证了相关理论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04235 2026-07-07 cs.CL 新提交 90%

Spinning Straw into Gold: Relabeling LLM Agent Trajectories in Hindsight for Successful Demonstrations

化腐朽为神奇:事后重新标记大语言模型智能体轨迹以实现成功示范

Zichao Li, Gang Wu, Zichao Wang, Ruiyi Zhang, Wanrong Zhu, Ryan A. Rossi, Vlad I Morariu, Jihyung Kil

机构 * Mila, McGill University(米拉,麦吉尔大学) Adobe Research(Adobe研究院)

专题命中 指令微调 :LLM(title,abstract);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对大语言模型智能体监督瓶颈,利用智能体展开中隐含的成功目标,引入事后监督学习(HSL),通过辅助大语言模型重新标记轨迹及目标并微调,提出两种技术减轻数据次优性,实验证明其优势。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23394 2026-06-23 cs.CL 新提交 90%

Do LLM Embedding Spaces Recover Expert Structure?

LLM嵌入空间是否恢复了专家结构?

Yixuan Zhu, Zhenke Duan, Fanghen Li

机构 * Zhongnan University of Economics and Law(中南财经政法大学)

专题命中 指令微调 :LLM(title,title_cn);分类 cs.CL

AI总结 研究LLM嵌入空间能否恢复心理健康领域的专家定义类别结构,通过对比预训练和微调Qwen3嵌入,发现对齐程度依赖于粒度级别且需控制混杂因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22082 2026-06-23 cs.SE cs.AI 新提交 90%

CodeTeam: An LLM-Powered Multi-Agent Framework for Repository-Level Code Generation

CodeTeam: 一个基于LLM的多智能体框架用于仓库级代码生成

Yifei Wang, Ruiyin Li, Peng Liang, Qiong Feng, Zengyang Li, Mojtaba Shahin, Arif Ali Khan

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Nanjing University of Science and Technology(南京理工大学计算机学院) School of Computer Science, Central China Normal University(中央财经大学计算机学院) School of Computing Technologies, RMIT University(皇家墨尔本理工学院计算技术学院) M3S Research Group, SEIS Unit, University of Oulu(奥卢大学M3S研究组,SEIS单元)

专题命中 指令微调 :LLM(title,title_cn);SFT(abstract,abstract_cn);分类 cs.AI

AI总结 提出CodeTeam框架,通过分离规划、决策和实现阶段,结合多智能体协作与依赖感知调度,解决仓库级代码生成中的长程规划与跨文件一致性问题,在SketchEval和NL2Repo-Bench上取得显著提升。

Comments 36 pages, 5 images, 9 tables, Manuscript submitted to a Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18257 2026-06-18 cs.HC cs.AI 新提交 90%

From Memorization to Creation: Evaluating the Cognitive Depth of LLM-Generated Educational Questions

从记忆到创造:评估LLM生成的教育问题的认知深度

Xiaolong Wang, Zhe Zhao, Song Lai, Chaoli Zhang, Zijie Geng, Yu Tong, Ye Wei, Qingsong Wen

机构 * City University of Hong Kong(香港城市大学) Zhejiang Normal University(浙江师范大学) Squirrel Ai Learning University of Science and Technology of China(中国科学技术大学) Wuhan University(武汉大学)

专题命中 指令微调 :LLM(title,title_cn);prompting(abstract);分类 cs.AI

AI总结 通过布鲁姆认知分类学评估六种LLM生成问题的认知层次,提出细粒度提示策略减少重复性并提升高阶认知比例,引入认知转移强度和类别漂移指标,揭示链式思维提示的可解释性。

Comments Accepted by KDD 2026

Journal ref KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17321 2026-06-17 cs.LG cs.CV 新提交 90%

ProCUA-SFT Technical Report

ProCUA-SFT 技术报告

Jaehun Jung, Ximing Lu, Brandon Cui, Muhammad Khalifa, Shaokun Zhang, Hao Zhang, Jin Xu, Amala Sanjay Deshmukh, Karan Sapra, Andrew Tao, Yejin Choi, Jan Kautz, Mingjie Liu, Yi Dong

机构 * NVIDIA(英伟达) University of Washington(华盛顿大学) Allen Institute for AI(艾伦人工智能研究所)

专题命中 指令微调 :SFT(title,title_cn);分类 cs.LG

AI总结 提出 ProCUA-SFT 数据集,通过自动化管道从 2484 个应用组合的合成轨迹中蒸馏出 310 万步级 SFT 样本,微调 UI-TARS 7B 在 OSWorld 上达到 45.0% 的成功率,比基线提升 18.7 个百分点。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19480 2026-06-19 physics.comp-ph astro-ph.CO cond-mat.stat-mech gr-qc 新提交 90%

sft-wick: A formalism and package for Feynman-diagram expansion and evaluation in stochastic field theories

sft-wick: 随机场理论中费曼图展开与评估的形式化与软件包

Zheng Zhang

专题命中 指令微调 :SFT(title,title_cn)

AI总结 提出sft-wick开源Python包,通过路径积分形式化随机场动力学,自动枚举拓扑不同的费曼图并计算代数系数和数值积分,验证与Langevin模拟一致。

Comments 32 pages, 5 figures, 2 tables. Submitted to Computer Physics Communications. The sft-wick package is open source and available at https://github.com/StatFieldTheory/sft-wick

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22188 2026-08-25 cs.LG cs.CL cs.DC 新提交 90%

Unveiling the Depth-Performance Dilemma in Split-Federated Fine-tuning of LLMs

揭示大语言模型的拆分式联邦微调中的深度-性能困境

Hariharan Ramesh, Someshwaran Murugaiyan, Jyotikrishna Dass

机构 * Vellore Institute of Technology(韦洛尔理工学院) University of Arizona(亚利桑那大学)

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract,abstract_cn);language model(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 本研究针对拆分式联邦微调(SFF),识别出深度-性能困境,评估多种联邦适配器聚合方法后发现其无法缓解拆分架构缺陷,归因于Transformer拓扑,为分布式LLM微调提供结构基础。

Comments 24 pages, 10 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15360 2026-08-18 cs.LG cs.AI 新提交 90%

SAPE: Sandwich Adapters for Parameter Efficiency in Large Language Model Fine-Tuning

SAPE:用于大语言模型微调参数效率的三明治适配器

Mohammad Aref Jafari-Raddani, Morteza Mohajjel Kafshdooz

机构 * Qom University of Technology(库姆理工大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI、cs.LG

AI总结 SAPE是一种基于三明治式硬权重共享拓扑的PEFT框架,通过隔离边界变换降低内存与计算开销,在低参数约束下,于RoBERTa-large、LLaMA-3.2等模型的多项任务中取得优于现有方法的性能。

Comments 16 pages, 4 figures, 10 tables, includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10090 2026-08-12 cs.AI cs.LG 新提交 90%

CHORUS: Complementary Experts for High-Coverage Testbench Stimulus Generation

CHORUS:用于高覆盖率测试平台激励生成的互补专家

Hejia Zhang, Sheng Lu, Zhongming Yu, Chia-Tung Ho, Brucek Khailany, Jishen Zhao

专题命中 指令微调 :SFT(summary_cn,abstract);LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 该研究针对芯片设计中高覆盖率测试平台激励生成任务,提出CHORUS后训练框架,整合分阶段SFT与密集奖励RL得到的互补专家,构建4B模型,在CVDP-ECov上的Pass@1指标优于671B参数的DeepSeek-R1。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27912 2026-07-31 cs.AI cs.CL 新提交 90%

IFHierBench: Hierarchical Instruction Following for Large Language Models

IFHierBench:面向大语言模型的分层指令遵循基准

Yuetian Mao, Chunyang Chen

机构 * Technical University of Munich(慕尼黑工业大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出分层指令遵循基准IFHierBench,评估发现现有大语言模型遵循嵌套约束的能力不足,为提升指令遵循能力的训练方法提供了研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20537 2026-07-24 cs.LG cs.AI 新提交 90%

ReliableTableQA:How Much Supervision Does Reliability Annotation Need?

可靠表格问答:可靠性标注需要多少监督?

Huei-Chung Hu, Hsin-Tai Wu, Koyo Kobayashi

机构 * DOCOMO Innovations, Inc.(都科摩创新公司) NTT DOCOMO, Inc.(日本电报电话公司都科摩)

专题命中 指令微调 :LLM(summary_cn,abstract);SFT(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 研究提出ReliableTableQA框架训练LLM标注表格问答结果统计可靠性,贡献分类法、数据管道及监督量研究。发现小的模式分层SFT集效果显著,GRPO在SFT不足时才有用,重新界定可靠性标注为数据效率问题,明确强化微调效果。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16140 2026-06-16 cs.AI cs.CL 新提交 90%

VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in Small Language Models

VibeThinker-3B:探索小型语言模型中可验证推理的前沿

Sen Xu, Shixi Liu, Wei Wang, Jixin Min, Yingwei Dai, Zhibin Yin, Yirong Chen, Xin Zhou, Junlin Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :language model(title);small language model(title);SFT(summary_cn);post-training(abstract)

AI总结 提出3B参数紧凑模型VibeThinker-3B,通过频谱到信号后训练范式(课程SFT、多域强化学习、离线自蒸馏)在可验证推理任务上达到前沿性能,匹配甚至超越大模型,并验证推理增强不损害指令可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18654 2026-08-20 cs.CV 新提交 89%

Clinically Structured Surrogate Rewards for Post-SFT Medical Image Captioning

SFT后医学图像字幕生成的临床结构化替代奖励

Hyun Jun Kim, Heeseung Shin, Changwon Lim

专题命中 指令微调 :SFT(title,title_cn)

AI总结 该研究针对SFT后医学图像字幕生成,提出临床结构化替代奖励框架,结合生物医学语义等,在ImageCLEFmedical Caption测试集及三个主干上,提升了整体、相关性与事实性指标。

Comments 8 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28997 2026-08-03 cs.IR 新提交 89%

Think2Go: Generative Next POI Recommendation with LLM Reasoning

Think2Go:基于大语言模型推理的生成式下一个兴趣点(POI)推荐

Zhuang Zhuang, Shanshan Feng, Hangwei Qian, Mingqi Yang, Heng Qi, Yanming Shen, Baocai Yin

专题命中 指令微调 :SFT(summary_cn,abstract);LLM(title);large language model(abstract);language model(abstract)

AI总结 Think2Go框架统一SFT与RL推理,通过优势加权机制校准策略优化,解决现有POI推荐模型的意图捕捉不足问题,提升推荐性能与稳健性。

Comments Accepted by KDD 2026 Research Track Cycle 1 (Oral presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17456 2026-07-21 cs.CV 新提交 89%

Bio-SFT: Asymmetric Cortical Guidance and Retinal Adaptation for Robust HDR Reconstruction

Bio-SFT:用于稳健 HDR 重建的不对称皮层引导和视网膜适应

Tingyu Cheng, Ting Zhang, Chongyi Li, Zhaoqing Pan, Tiesong Zhao

机构 * College of Physics and Information Engineering, Fuzhou University(福州大学物理与信息工程学院) School of Computer Science, Nankai University(南开大学计算机科学学院) School of Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院)

专题命中 指令微调 :SFT(title,title_cn)

AI总结 研究针对单图像 HDR 重建难题,提出 Bio-SFT 方法,它包含可学习的视网膜适应前端、小细胞 - 大细胞分裂引导及事件驱动的 SNN 硬门控模块,经训练能有效抑制暗区噪声,提高感知质量,减少伪影传播。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27511 2026-06-29 cs.CR 新提交 89%

When the Aggregator Cheats: Data-Free Backdoors in Federated LLM-based QA Systems

当聚合者作弊:联邦LLM问答系统中的无数据后门

Chenqing Zhu, Yanbo Dai, Yulong Tian, Qingming Li, Songze Li

专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 针对联邦学习问答系统中恶意聚合者植入广告后门的问题,提出利用客户端梯度恢复样本并构造中毒数据集的两阶段攻击方法,实现高攻击成功率且几乎不影响正常性能。

Comments Accepted at the 35th USENIX Security Symposium (USENIX Security 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14154 2026-06-15 cs.CR 新提交 89%

SkillMutator: Benchmarking and Defending Language-and-Code Cross-modal Attacks on LLM Agent Skills

SkillMutator: 基准测试与防御针对LLM代理技能的语言与代码跨模态攻击

Youngduk Kim, Minkyoo Song, Seungwon Shin

专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出SkillMutator基准,模拟13类跨模态攻击,并设计四阶段推理轨迹蒸馏框架,将检测率从17.1%提升至88.2%,超越GPT-4o-mini。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15507 2026-08-18 cs.CL cs.LG 新提交 89%

Do Language Models Consistently Encode the Current Year?

语言模型是否一致地编码了当前年份?

Suze van Adrichem, Aditi Bhaskar, Diyi Yang, Christopher Potts, Jing Huang

机构 * Stanford University(斯坦福大学)

专题命中 指令微调 :language model(title,abstract);SFT(abstract,abstract_cn);post-training(abstract);prompting(abstract)

AI总结 该研究探究语言模型对当前年份的编码一致性,设计两项不同任务,发现关联与声明年份的编码机制不同,现有修改方法无法同时调整两者,表明当前年份未被一致编码。

Comments Accepted at the Conference on Language Modeling (COLM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28447 2026-08-31 cs.AI 新提交 89%

Learning to Use Tools: Reinforcement Learning for Tool-Integrated Mathematical Reasoning

学习使用工具:用于工具集成数学推理的强化学习

Minghui Xu, Zi Wang

机构 * Stanford University(斯坦福大学)

专题命中 指令微调 :SFT(summary_cn,abstract);LLM(summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究针对Countdown任务,构建工具使用的SFT数据集并采用多种强化学习方法,结合计算器工具集成提升LLM数学推理,使pass@1达66.0%,显著降低计算与验证错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26188 2026-08-28 cs.AI 新提交 89%

Is Your Neighborhood Safe? Place-based Stigma in Large Language Models' Urban Safety Judgments

你的社区安全吗?大型语言模型城市安全判断中的基于地点的污名

Huy Nguyen, Yue Lin

机构 * Augustana College(奥古斯塔纳学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 该研究探究大型语言模型的城市安全判断是否受社区名称携带的人口刻板印象影响,发现名称会降低边缘化群体占比高的社区的安全评分,移除名称可减少偏见与准确性损失。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15516 2026-08-18 cs.LG 新提交 89%

UniFed-VLM: Federated Instruction Tuning for Vision-Language Models with Multiple Heterogeneity

UniFed-VLM:面向多异质性视觉语言模型的联邦指令调优

Pengyu Wang, Baochen Xiong, Xiaoshan Yang, Yifan Xu, Zhang Qimeng, Haifeng Chen, Changsheng Xu

专题命中 指令微调 :language model(title,abstract);instruction tuning(title,abstract);分类 cs.LG

AI总结 UniFed-VLM是解决任务、模态、模型架构联合异质性的VLM联邦指令调优框架,含FedCSA与TCoD组件,在多基准数据集上优于现有FL方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09122 2026-08-11 cs.CV cs.AI 新提交 89%

Visual Distortion Detection in UGC Images Using Large Multimodal Models

基于大型多模态模型的UGC图像视觉失真检测

Ziheng Jia, Yingji Liang, Jiaying Qian, Xiongkuo Min

专题命中 指令微调 :LLM(summary_cn,abstract);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对现有LMM图像失真检测方法准确率不足及合成失真泛化差距问题,提出VIGIL模型,构建VIGIL-140K数据集,利用LLM解码器多层级特征检测并缓解FG-BG分离问题,在两类任务上性能优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏