arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-19 至 2025-12-19 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 18 篇

2504.19565 2025-12-19 cs.CL cs.AI q-bio.QM 90%

Knowledge-Driven Agentic Scientific Corpus Distillation Framework for Biomedical Large Language Models Training

面向生物医学大语言模型训练的知识驱动代理科学语料库精简框架

Meng Xiao, Xunxin Cai, Qingqing Long, Chengrui Wang, Yuanchun Zhou, Hengshu Zhu

机构 * Computer Network Information Center, Chinese Academy of Sciences, Beijing, China(中国科学院计算机网络信息中心) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) Duke-NUS Medical School, National University of Singapore, Singapore(新加坡国立大学杜克-新加坡医学部)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种知识驱动的代理框架,用于生物医学大语言模型训练中的语料库精简,通过多代理协作提升问答任务性能。

Comments Biomedical Large Language Models, Agentic Corpus Distillation, Synthetic Question-Answer Generation, Agentic AI, Knowledge Hierarchy Guidance

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16419 2025-12-19 cs.CY cs.CR 89%

Large Language Models as a (Bad) Security Norm in the Context of Regulation and Compliance

大语言模型作为(不良)安全规范在监管与合规背景下的作用

Kaspar Rosager Ludvigsen

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文探讨了大语言模型在网络安全和合规领域中的潜在风险,指出其固有弱点可能违反安全规范和法律义务,并提出通过替代方案和限制使用来缓解问题。

Comments 20 pages, presented at Information Law and Policy Centre Annual Conference 2024 at the Institute of Advanced Study, University of London

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16883 2025-12-19 cs.CL 88%

AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning

AdaSearch:通过强化学习平衡参数知识与搜索

Tzu-Han Lin, Wei-Lin Chen, Chen-An Li, Hung-yi Lee, Yun-Nung Chen, Yu Meng

机构 * National Taiwan University(台湾大学) Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 AdaSearch通过强化学习框架平衡参数知识与搜索,提高知识边界意识并减少不必要的搜索调用。

Comments Preprint. Code and artifacts will be uploaded to https://github.com/hank0316/AdaSearch

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17201 2025-12-19 physics.med-ph 88%

Root Cause Analysis of Radiation Oncology Incidents Using Large Language Models

利用大语言模型进行放射肿瘤事件的根本原因分析

Yuntao Wang, Mariluz De Ornelas, Matthew T. Studenski, Elizabeth Bossart, Siamak P. Najad-Davarani, Yunze Yang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 利用大语言模型分析放射肿瘤事件的根本原因,评估其在提升患者安全中的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12177 2025-12-19 cs.SI cs.DL 87%

LitFM: A Retrieval Augmented Structure-aware Foundation Model For Citation Graphs

LitFM:一种基于检索增强的结构感知文献基础模型

Jiasheng Zhang, Jialin Chen, Ali Maatouk, Ngoc Bui, Qianqian Xie, Leandros Tassiulas, Jie Shao, Hua Xu, Rex Ying

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 LitFM是一种基于检索增强的结构感知文献基础模型,通过整合引用图结构和知识注入的LLM,提升文献检索和相关性评估的准确性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15108 2025-12-19 cs.CL 83%

Knowledge Hierarchy Guided Biological-Medical Dataset Distillation for Domain LLM Training

基于知识层级的生物医学数据集蒸馏用于领域大语言模型训练

Xunxin Cai, Chengrui Wang, Qingqing Long, Yuanchun Zhou, Meng Xiao

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) University of Chinese Academy of Sciences(中国科学院大学) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于生物医学知识层级的自动数据蒸馏框架,提升领域大语言模型的训练效果,使Llama3-70B在参数量上超越GPT-4。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01310 2025-12-19 cs.CV 82%

Lost in Distortion: Uncovering the Domain Gap Between Computer Vision and Brain Imaging -- A Study on Pretraining for Age Prediction

迷失在失真中:计算机视觉与脑影像之间的领域差距——关于年龄预测预训练的研究

Yanteng Zhang, Songheng Li, Zeyu Shen, Qizhen Lan, Lipei Zhang, Yang Liu, Vince Calhoun

机构 * Center for Translational Research in Neuroimaging and Data Science(转化神经影像与数据科学研究中心) College of Artificial Intelligence, Chengdu University of Information Technology(成都信息科技大学人工智能学院) Department of Applied Mathematics and Statistics(应用数学与统计学系) McWilliams School of Biomedical Informatics(麦卡威廉生物医学信息学学院) Department of Applied Mathematics and Theoretical Physics(应用数学与理论物理系) School of Biomedical Engineering and Imaging Sciences(生物医学工程与影像科学学院)

专题命中 领域大模型 :pretraining(title,abstract);foundation model(abstract)

AI总结 本研究探讨了预训练在脑年龄预测中的应用,揭示了高质量数据与低质量数据在预训练中的不同影响,并强调了领域意识整理在构建可靠基础模型中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00931 2025-12-19 cs.CL cs.AI 79%

Mitigating Hallucinations in Zero-Shot Scientific Summarisation: A Pilot Study

缓解零样本科学摘要中的幻觉:一项初步研究

Imane Jaaouine, Ross D. King

机构 * Department of Chemical Engineering and Biotechnology(化学工程与生物技术系) University of Cambridge(剑桥大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨提示工程方法对缓解零样本科学摘要中的幻觉效果,发现上下文重复和随机添加能显著提升摘要与原文的对齐度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16567 2025-12-19 cs.CV 78%

Causal-Tune: Mining Causal Factors from Vision Foundation Models for Domain Generalized Semantic Segmentation

Causal-Tune: 从视觉基础模型中挖掘因果因素以实现领域通用的语义分割

Yin Zhang, Yongqiang Zhang, Yaoyue Zheng, Bogdan Raducanu, Dan Liu

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 Causal-Tune通过频谱分析和因果因素分离提升领域通用语义分割的鲁棒性

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18951 2025-12-19 cs.CV 78%

Percept, Chat, and then Adapt: Multimodal Knowledge Transfer of Foundation Models for Open-World Video Recognition

感知、对话,然后适应:面向开放世界视频识别的多模态基础模型知识迁移

Boyu Chen, Siran Chen, Kunchang Li, Qinglin Xu, Yu Qiao, Yali Wang

机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) the School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 本文提出PCA框架,通过感知、对话和适应三个阶段,利用多模态知识提升开放世界视频识别的性能。

Comments 35 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16701 2025-12-19 cs.AI 70%

Cyber Humanism in Education: Reclaiming Agency through AI and Learning Sciences

教育中的网络人本主义:通过人工智能与学习科学重新夺回主体性

Giovanni Adorni

机构 * DIBRIS, University of Genoa(热那亚大学DIBRIS)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出教育中的网络人本主义框架,通过反思能力、算法公民身份和对话式设计,重新夺回人类在AI驱动教育中的主体性。

Comments 15 pages, 16 references, Key Note preented at the "WAILS 2025 - The 2nd. Workshop on Artificial Intelligence with and for Learning Sciences", Cagliary, Italy, 10-12 December 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16447 2025-12-19 cs.AI 70%

Towards AI-Supported Research: a Vision of the TIB AIssistant

迈向AI支持的研究:TIB AIssistant的愿景

Sören Auer, Allard Oelen, Mohamad Yaser Jaradeh, Mutahira Khalid, Farhana Keya, Sasi Kiran Gaddipati, Jennifer D'Souza, Lorenz Schlüter, Amirreza Alasti, Gollam Rabby, Azanzi Jiomekong, Oliver Karras

机构 * TIB – Leibniz Information Centre for Science(TIB-莱比锡科学与技术信息中心) L3S Research Center, Leibniz University of Hannover(莱比锡汉诺威大学L3S研究中心) Leibniz University of Hannover(莱比锡汉诺威大学) University of Yaounde 1(Yaounde第一大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TIB AIssistant旨在通过人机协作平台提升跨学科科研效率,整合AI助手支持研究全流程任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16442 2025-12-19 cs.AI 70%

TIB AIssistant: a Platform for AI-Supported Research Across Research Life Cycles

TIB AIssistant: 一个跨研究生命周期的AI支持研究平台

Allard Oelen, Sören Auer

机构 * TIB – Leibniz Information Centre for Science(蒂宾根信息科学与技术研究中心) L3S Research Center, Leibniz University of Hannover(汉诺威莱布尼茨大学L3S研究中心)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TIB AIssistant是一个跨研究生命周期的AI支持研究平台,通过集成多个助手和外部学术服务,提升研究透明度和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16108 2025-12-19 cs.AI 70%

WeMusic-Agent: Efficient Conversational Music Recommendation via Knowledge Internalization and Agentic Boundary Learning

WeMusic-Agent: 通过知识内化和代理边界学习实现高效的对话音乐推荐

Wendong Bi, Yirong Mao, Xianglong Liu, Kai Tian, Jian Zhang, Hanjie Wang, Wenhui Que

专题命中 领域大模型 :LLM(abstract);pretraining(abstract);分类 cs.AI

AI总结 WeMusic-Agent通过知识内化和代理边界学习,实现高效对话音乐推荐,提升个性化和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16036 2025-12-19 cs.AI 70%

Topic Discovery and Classification for Responsible Generative AI Adaptation in Higher Education

高等教育中负责任生成式人工智能适应的专题发现与分类

Diane Myung-kyung Woodbridge, Allyson Seba, Freddie Seba, Aydin Schwartz

机构 * University of Southern California(美国南加州大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出了一种自动系统,用于发现和分类高等教育中关于生成式人工智能使用的政策,以促进负责任的AI应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23021 2025-12-19 cs.LG cs.IR 57%

Masked Diffusion for Generative Recommendation

掩码扩散用于生成性推荐

Kulin Shah, Bhuvesh Kumar, Neil Shah, Liam Collins

机构 * UT Austin(得克萨斯大学) Snap Inc(Snap公司)

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 本文提出利用掩码扩散替代自回归建模,以提升生成性推荐中语义ID序列的概率建模效果,尤其在数据受限情况下表现更优。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16841 2025-12-19 cs.CV 50%

Radiology Report Generation with Layer-Wise Anatomical Attention

基于层间解剖注意力的放射报告生成

Emmanuel D. Muñiz-De-León, Jorge A. Rosales-de-Golferichs, Ana S. Muñoz-Rodríguez, Alejandro I. Trejo-Castro, Eduardo de Avila-Armenta, Antonio Martínez-Torteya

专题命中 领域大模型 :language model(abstract)

AI总结 本文提出了一种基于层间解剖注意力的紧凑图像到文本模型,用于生成胸部X光报告的发现部分,通过整合解剖区域信息提升了报告的准确性和连贯性。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03508 2025-12-19 cs.CV 50%

Exploiting Domain Properties in Language-Driven Domain Generalization for Semantic Segmentation

利用领域特性进行语言驱动的领域泛化以实现语义分割

Seogkyu Jeon, Kibeom Hong, Hyeran Byun

机构 * Yonsei University(延世大学) Sookmyung Women’s University(淑明女子大学)

专题命中 领域大模型 :language model(abstract)

AI总结 本文提出DPMFormer框架,通过领域感知提示学习和对比学习提升语义分割的领域泛化能力。

Comments ICCV 2025 (poster)

详情

展开后加载摘要…

URL PDF HTML 收藏