arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11667 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11667 篇

2605.24549 2026-05-26 cs.AI 88%

PALoRA: Projection-Adaptive LoRA for Preserving Reasoning in Large Language Models

PALoRA: 投影自适应LoRA以保持大型语言模型的推理能力

Mustafa Hayri Bilgin, Mariam Barry, Albert Bifet, Azzedine Idir Ait Said, Soumya Banerjee

机构 * IT Group, Research, BNP Paribas(BNP巴黎研究院IT部门) LTCI, Télécom Paris, Institut Polytechnique de Paris(巴黎理工大学LTCI研究所) AI Institute, University of Waikato(瓦卡托大学人工智能研究所) Independent Researcher(独立研究员)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出PALoRA框架,通过奇异值微调(SVF)识别推理关键成分,并在正交约束下使用LoRA注入知识,以在保持推理能力的同时高效更新事实知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22185 2026-05-22 cs.CV cs.LG 88%

Enhancing Multimodal Large Language Models for Safety-Critical Driving Video Analysis

增强多模态大语言模型以用于安全关键驾驶视频分析

Tomaso Trinci, Henrique Piñeiro Monteagudo, Leonardo Taccari

机构 * Verizon Connect

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本研究通过融合降采样视频帧与同步高频 telemetry 数据及专用计算机视觉模型的语义信息,提升多模态大语言模型在安全关键驾驶场景中的感知与推理能力,从而更准确地识别和描述现实驾驶中的安全关键事件。

Comments Accepted at the 2026 IEEE International Conference on Intelligent Transportation Systems (ITSC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13162 2026-05-14 cs.LG 88%

Continual Fine-Tuning of Large Language Models via Program Memory

通过程序记忆持续微调大型语言模型

Hung Le, Svetha Venkatesh

机构 * Deakin Applied AI Initiative(德金应用人工智能计划)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出ProCL框架,通过程序记忆结构实现持续学习中的高效微调,提升模型在连续任务中的知识保留与适应能力。

Comments 18 page, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02764 2026-05-14 cs.CL 88%

PEFT-Factory: Unified Parameter-Efficient Fine-Tuning of Autoregressive Large Language Models

PEFT-Factory:统一的参数高效微调自回归大语言模型

Robert Belanec, Ivan Srba, Maria Bielikova

机构 * Faculty of Information Technology, Brno University of Technology(布拉格技术学院,布拉格技术大学) Kempelen Institute of Intelligent Technologies(智能技术研究所)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 PEFT-Factory提供统一框架,整合多种参数高效微调方法和数据集,提升微调方法的可复现性和评估稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11716 2026-05-13 cs.AI 88%

SafeSteer: A Decoding-level Defense Mechanism for Multimodal Large Language Models

SafeSteer: 多模态大语言模型中的解码级防御机制

Xinyi Zeng, Xue Yang, Jingyuan Zhang, Huanqian Yan, Xiang Chen, Kaiwen Wei, Hankun Kang, Yu Tian

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Kuaishou Technology(快手科技) School of Computer Science and Technology, Beihang University(北航计算机科学与技术学院) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Chongqing University(重庆大学) Wuhan University(武汉大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出SafeSteer,通过解码阶段的轻量探针和模态语义对齐向量,提升多模态大语言模型的安全性,实验表明其能提升33.40%的安全性而不需微调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06030 2026-05-08 cs.CL 88%

More Aligned, Less Diverse? Analyzing the Grammar and Lexicon of Two Generations of LLMs

更一致,更不多样?分析两代LLM的语法和词汇

Adrián Gude, Roi Santos-Ríos, Francis Bond, Dan Flickinger, Carlos Gómez-Rodríguez, Olga Zamaraeva

机构 * Universidade da Coruña, CITIC(科鲁纳大学,CITIC) Independent Researcher(独立研究者) Palacký University, Olomouc(帕拉茨基大学,奥洛穆克)

专题命中 指令微调 :LLM(title_cn,summary_cn);instruction tuning(abstract);分类 cs.CL

AI总结 研究比较两代LLM生成的新闻文本与人类写作的语法特性,发现新模型在语法和词汇多样性上有所下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07003 2026-04-27 cs.CL 88%

NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs

NiuTrans.LMT: 向包容性和可扩展的多语言机器翻译迈进 with LLMs

Yingfeng Luo, Ziqiang Xu, Yuxuan Ouyang, Murun Yang, Dingyang Lin, Kaiyan Chang, Tong Zheng, Bei Li, Peinan Feng, Quan Du, Tong Xiao, Jingbo Zhu

机构 * School of Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程学院,中国沈阳) NiuTrans Research, Shenyang, China(牛译研,中国沈阳)

专题命中 指令微调 :prompting(summary_cn,abstract);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出NiuTrans.LMT,通过Strategic Downsampling和Parallel Multilingual Prompting缓解多语言监督微调中的方向退化问题,展示其在60种语言234个方向上的竞争力。

Comments Accepted to ACL 2026 Main Conference. Models are available at: https://github.com/NiuTrans/LMT

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18041 2026-04-21 cs.CL cs.CY 88%

JudgeMeNot: Personalizing Large Language Models to Emulate Judicial Reasoning in Hebrew

JudgeMeNot: 为 Hebrew 语境下的司法推理个性化大型语言模型

Itay Razumenko, Arnon Sturm, Nir Grinberg

机构 * Computer and Information Science Ben-Gurion University of the Negev(计算机与信息科学贝内尔·加隆大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出一种合成有机监督流程,通过将原始司法判决转化为指令微调数据,实现低资源环境下对法官个性化模型的高效微调,并在三个任务中验证了因果语言模型结合合成指令微调的优越性。

Comments To appear in Findings of the ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17214 2026-04-21 cs.AI 88%

Beyond the Basics: Leveraging Large Language Model for Fine-Grained Medical Entity Recognition

超越基础:利用大语言模型进行细粒度医学实体识别

Nwe Ni Win, Jim Basilakis, Steven Thomas, Seyhan Yazar, Laura Pierce, Stephanie Liu, Paul M. Middleton, Nasser Ghadiri, X. Rosalind Wang

机构 * Western Sydney University(西悉尼大学) South Western Emergency Research Institute(西南急救研究所) Garvan Institute of Medical Research(加文医学研究所以) University of New South Wales(新南威尔士大学) Liverpool Hospital(利物浦医院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文研究了大语言模型在细粒度医学实体识别中的应用,通过评估LLaMA3模型在18种临床详细类别中的表现,采用零样本、少样本和LoRA微调等方法,提升了细粒度实体识别的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16943 2026-04-21 cs.CL 88%

MNAFT: modality neuron-aware fine-tuning of multimodal large language models for image translation

MNAFT:多模态大语言模型的模态神经感知微调用于图像翻译

Bo Li, Ningyuan Deng, Tianyu Dong, Shaobo Wang, Shaolin Zhu, Lijie Wen

机构 * School of Computer Science and Technology, Tianjin University, Tianjin, China(天津大学计算机科学与技术学院) School of Software, Tsinghua University, Beijing, China(清华大学软件学院) School of Information Resource Management, Renmin University of China,Beijing, China(中国人民大学信息资源管理学院) School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Baidu Inc., Beijing, China(百度公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出MNAFT,通过识别视觉和语言模块中语言无关和语言特定的神经元,改进多模态大语言模型在图像翻译中的表现,实验表明其优于现有方法。

Comments Accepted by SCIS (SCIENCE CHINA Information Science)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16845 2026-04-21 cs.CL 88%

DART: Mitigating Harm Drift in Difference-Aware LLMs via Distill-Audit-Repair Training

DART:通过蒸馏-审计-修复训练缓解差异意识LLM中的危害漂移

Ziwen Pan, Zihan Liang, Jad Kabbara, Ali Emami

机构 * Emory University(埃默里大学) MIT(麻省理工学院)

专题命中 指令微调 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出DART方法,通过蒸馏、审计和修复训练缓解LLM中因准确性提升导致的危害漂移问题,提升模型在处理差异相关任务时的准确性和安全性。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13715 2026-04-16 cs.SD cs.AI 88%

Towards Fine-grained Temporal Perception: Post-Training Large Audio-Language Models with Audio-Side Time Prompt

迈向细粒度时间感知:通过音频侧时间提示进行后训练的大音频-语言模型

Yanfeng Shi, Pengfei Cai, Jun Liu, Qing Gu, Nan Jiang, Lirong Dai, Ian McLoughlin, Yan Song

机构 * National Engineering Research Center of Speech and Language Information Processing, University of Science and Technology of China, Hefei, China(语音与语言信息处理国家级工程研究中心,中国科学技术大学,合肥,中国) ICT Cluster, Singapore Institute of Technology, Singapore(新加坡理工学院ICT集群,新加坡)

专题命中 指令微调 :language model(title,abstract);post-training(title);SFT(abstract);分类 cs.AI

AI总结 本文提出Audio-Side Time Prompt方法,结合强化学习改进大音频-语言模型的时间感知能力,在音频定位、事件检测等任务中取得显著提升。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13368 2026-04-16 cs.CL 88%

TLoRA+: A Low-Rank Parameter-Efficient Fine-Tuning Method for Large Language Models

TLoRA+: 一种用于大型语言模型的低秩参数高效微调方法

Yarui Cao, Kai Liu

机构 * Department of Computer Science(计算机科学系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出TLoRA+方法,结合TLoRA+优化器提升大型语言模型的微调效率与性能,通过实验验证其在GLUE基准上的有效性与鲁棒性。

Comments 16 pages, 12 figures and 6 tables in total. Submitted to CoLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03234 2026-04-15 cs.LG 88%

TeRA: Vector-based Random Tensor Network for High-Rank Adaptation of Large Language Models

TeRA: 基于向量的随机张量网络用于大语言模型的高秩适应

Yuxuan Gu, Wuyang Zhou, Giorgos Iacovides, Danilo Mandic

机构 * Department of Electrical and Electronic Engineering, Imperial College London(帝国理工学院伦敦分校电子与电气工程系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 TeRA提出一种新型PEFT方法,通过将张量化的权重更新矩阵参数化为Tucker-like张量网络,实现高秩权重更新的同时保持向量方法的参数效率。

Comments Accepted at ACL main conference 2026. Code is available at https://github.com/guyuxuan9/TeRA

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04488 2026-04-07 cs.CV cs.LG 88%

A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models

基于补丁的跨视图正则化框架用于多模态大语言模型中的后门防御

Tianmeng Fang, Yong Wang, Zetai Kong, Zengzhen Su, Jun Wang, Chengjin Yu, Wei Wang

机构 * Singapore Management University(新加坡管理大学) China University of Mining and Technology(中国矿业大学) The University of Melbourne(墨尔本大学) Anhui University(安徽大学) Xi’an Jiaotong University(西安交通大学) Sun Yat-sen University(中山大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出一种基于补丁增强和跨视图正则化的统一后门防御框架,通过约束特征表示和输出分布层面的异常行为,有效降低后门攻击成功率并保持正常生成能力。

Comments 26 pages, 3 figures. Subjects: Machine Learning (cs.LG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03302 2026-04-07 cs.CV cs.AI 88%

Beyond Static Vision: Scene Dynamic Field Unlocks Intuitive Physics Understanding in Multi-modal Large Language Models

超越静态视觉:场景动态场解锁多模态大语言模型中的直观物理理解

Nanxi Li, Xiang Wang, Yuanjie Chen, Haode Zhang, Hong Li, Yong-Lu Li

机构 * Shanghai Jiao Tong University(上海交通大学) Tianjin University(天津大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 研究探讨多模态大语言模型在物理理解上的不足,提出Scene Dynamic Field方法提升对连续物体动态的理解能力,实现20.7%的改进并展现良好的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22869 2026-04-06 cs.AI 88%

Chain-of-Authorization: Embedding authorization into large language models

授权链:将授权嵌入大型语言模型

Yang Li, Yule Liu, Xinlei He, Youjian Zhao, Qi Li, Ke Xu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出授权链框架,通过重新设计输入输出格式和微调合成数据,使LLM在动态推理环境中内化访问边界,提升安全性和拒绝非授权请求的能力。

Comments 23 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17646 2026-03-17 cs.LG 88%

Unveiling the Basin-Like Loss Landscape in Large Language Models

揭示大语言模型中的盆地状损失景观

Huanran Chen, Yinpeng Dong, Zeming Wei, Yao Huang, Yichi Zhang, Hang Su, Jun Zhu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 研究发现大语言模型的损失景观中出现盆地结构,随着模型规模增大,模型对参数空间扰动的鲁棒性增强,但最坏方向的损失景观尖锐且有害,对抗性微调会快速降低模型能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11415 2026-03-13 cs.CL 88%

BLooP: Zero-Shot Abstractive Summarization using Large Language Models with Bigram Lookahead Promotion

BLooP:利用大语言模型的双元前瞻促进进行零样本抽象摘要

Varun Iyer, Cornelia Caragea

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 BLooP通过双元前瞻促进技术,在无需训练的情况下提升大语言模型生成摘要的准确性和忠实度。

Comments LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09865 2026-03-11 cs.LG 88%

GAST: Gradient-aligned Sparse Tuning of Large Language Models with Data-layer Selection

GAST:基于梯度对齐的大型语言模型稀疏调优与数据层选择

Kai Yao, Zhenghan Song, Kaixin Wu, Mingjie Zhong, Danzhao Cheng, Zhaorui Tan, Yixin Ji, Penglei Gao

机构 * Ant Group(蚂蚁集团) Cornell University(康奈尔大学) University of Liverpool(利物浦大学) Soochow University(苏州大学) Cleveland Clinic Lerner Research Institution(克利夫兰诊所勒纳研究机构)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 GAST通过同时进行数据和层维度的选择性微调,解决现有方法忽略数据对不同层贡献差异的问题,提升大型语言模型的微调效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02479 2026-03-04 cs.CR cs.CL 88%

BitBypass: A New Direction in Jailbreaking Aligned Large Language Models with Bitstream Camouflage

BitBypass:一种新的方向:利用位流伪装进行对齐大语言模型的黑盒劫持

Kalyan Nakka, Nitesh Saxena

机构 * SPIES Research Lab, Dept. of CSE, Texas A&M University(SPIES研究实验室,计算机科学与工程系,德克萨斯A&M大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 BitBypass通过位流伪装技术,提出了一种新的黑盒劫持方法,有效绕过对齐大语言模型的安全机制,展现出更高的隐蔽性和攻击成功率。

Comments 27 pages, 27 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00498 2026-03-03 cs.LG 88%

Antibody: Strengthening Defense Against Harmful Fine-Tuning for Large Language Models via Attenuating Harmful Gradient Influence

Antibody: 通过削弱有害梯度影响来加强对抗有害微调的防御

Quoc Minh Nguyen, Trung Le, Jing Wu, Anh Tuan Bui, Mehrtash Harandi

机构 * Department of Electrical and Computer Systems Engineering, Monash University, Australia(莫纳什大学电气与计算机系统工程系) Department of Data Science and AI, Monash University, Australia(莫纳什大学数据科学与人工智能系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 Antibody通过削弱有害梯度影响,提升大型语言模型对有害微调攻击的防御能力,并增强微调性能。

Comments Published at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22475 2026-02-27 cs.CL 88%

Mind the Gap in Cultural Alignment: Task-Aware Culture Management for Large Language Models

注意文化契合差距:面向任务的文化管理用于大语言模型

Binchi Zhang, Xujiang Zhao, Jundong Li, Haifeng Chen, Zhengzhang Chen

机构 * University of Virginia(弗吉尼亚大学) NEC Laboratories America(NEC美洲实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出CultureManager,一种面向任务的文化管理方法,通过任务感知的文化数据对齐和文化路由器管理,提升大语言模型在文化敏感任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03817 2026-02-24 cs.LG stat.ML 88%

TROLL: Trust Regions improve Reinforcement Learning for Large Language Models

TROLL:通过信任区域改进大型语言模型的强化学习

Philipp Becker, Niklas Freymuth, Serge Thilges, Fabian Otto, Gerhard Neumann

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 TROLL通过引入基于信任区域的离散可微投影,改进了大型语言模型的强化学习训练,提升了训练速度、稳定性和最终成功率。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16836 2026-02-20 cs.CL 88%

Claim Automation using Large Language Model

利用大语言模型实现索赔自动化

Zhengda Mo, Zhiyu Quan, Eli O'Donohue, Kaiwen Zhong

机构 * Actuarial and Risk Management Sciences, University of Illinois at Urbana-Champaign(保险与风险管理科学系,伊利诺伊大学厄巴纳-香槟分校) PCMI Corporation(PCMI公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出利用大语言模型进行索赔自动化,通过领域特定微调显著提升保险领域纠正措施建议的准确性。

Comments 46 pages, 12 figures. Code and data processing pipeline described

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07282 2026-02-16 cs.CL 88%

RAISE: Reinforced Adaptive Instruction Selection For Large Language Models

RAISE: 增强适应性指令选择用于大语言模型

Qingsong Lv, Yangning Li, Zihua Lan, Zishan Xu, Jiwei Tang, Tingwei Lu, Yinghui Li, Wenhao Jiang, Hong-Gee Kim, Hai-Tao Zheng, Philip S. Yu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室) University of Illinois Chicago(伊利诺伊大学香槟分校) Seoul National University(首尔国立大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 RAISE通过强化学习动态选择指令,提升大语言模型微调效率与效果。

Comments Accepted by EMNLP 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12419 2026-02-16 cs.AI 88%

Intent-Driven Smart Manufacturing Integrating Knowledge Graphs and Large Language Models

意图驱动的智能制造整合知识图谱和大语言模型

Takoua Jradi, John Violos, Dimitrios Spatharakis, Lydia Mavraidi, Ioannis Dimolitsas, Aris Leivadeas, Symeon Papavassiliou

机构 * 1Department of Software IT Engineering, École de technologie supérieure, Montreal, Canada 2School of Electrical \& Computer Engineering, National Technical University of Athens

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出结合大语言模型和知识图谱的意图驱动智能制造框架,通过微调和语义映射提升制造系统的人机交互性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05228 2026-02-12 cs.AI 88%

Surgery: Mitigating Harmful Fine-Tuning for Large Language Models via Attention Sink

手术:通过注意力sink缓解大型语言模型的有害微调

Guozhi Liu, Weiwei Lin, Tiansheng Huang, Ruichao Mo, Qi Mu, Xiumin Wang, Li Shen

机构 * South China University of Technology(南方科技大学) Pengcheng Laboratory(鹏城实验室) Sun Yat-sen University(中山大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 Surgery通过注意力sink机制在微调阶段抑制有害模式学习,提升模型安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20906 2026-02-11 cs.LG 88%

TwinWeaver: An LLM-Based Foundation Model Framework for Pan-Cancer Digital Twins

TwinWeaver: 一种基于大语言模型的跨癌症数字双胞胎基础模型框架

Nikita Makarov, Maria Bordukova, Lena Voith von Voithenberg, Estrella Pivel-Villanueva, Sabrina Mielke, Jonathan Wickes, Hanchen Wang, Mingyu Derek Ma, Keunwoo Choi, Kyunghyun Cho, Stephen Ra, Raul Rodriguez-Esteban, Fabian Schmich, Michael Menden

机构 * Computational Sciences Center of Excellence, Roche, Penzberg, Germany(罗氏计算科学卓越中心) Computational Health Center, Helmholtz Munich, Munich, Germany(海德堡慕尼黑计算健康中心) Department of Biology, Ludwig Maximilian University of Munich, Munich, Germany(慕尼黑路易斯·马克西米利安大学生物学系) Early Development Oncology, Roche Innovation Center Zurich, Roche, Schlieren, Switzerland(罗氏苏黎世创新中心早期肿瘤学) Computational Sciences Center of Excellence, Genentech, New York City, USA(基因泰克计算科学卓越中心) Computational Sciences Center of Excellence, Genentech, South San Francisco, USA(基因泰克计算科学卓越中心) Center for Data Science, New York University, New York City, USA(纽约大学数据科学中心) Department of Computer Science, Stanford University, Stanford, CA, USA(斯坦福大学计算机科学系) Computational Sciences Center of Excellence, Roche, Basel, Switzerland(罗氏巴塞尔计算科学卓越中心) Department of Biochemistry(生物化学系) Biotechnology Institute, The University of Melbourne, Melbourne, Australia(墨尔本大学生物技术研究所)

专题命中 指令微调 :LLM(title);foundation model(title);large language model(abstract);language model(abstract)

AI总结 TwinWeaver通过基于大语言模型的框架,构建跨癌症数字双胞胎,提升临床事件预测与风险分层精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05694 2026-02-06 cs.CL 88%

Consensus-Aligned Neuron Efficient Fine-Tuning Large Language Models for Multi-Domain Machine Translation

共识对齐的神经高效细调大型语言模型用于多领域机器翻译

Shuting Jiang, Ran Song, Yuxin Huang, Yan Xiang, Yantuan Xian, Shengxiang Gao, Zhengtao Yu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出一种神经高效微调框架,通过识别和更新共识对齐的神经元,提升大型语言模型在多领域机器翻译中的性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏