arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-19 至 2025-12-19 共收录 194 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 18 篇

2512.16419 2025-12-19 cs.CY cs.CR 89%

Large Language Models as a (Bad) Security Norm in the Context of Regulation and Compliance

大语言模型作为(不良)安全规范在监管与合规背景下的作用

Kaspar Rosager Ludvigsen

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文探讨了大语言模型在网络安全和合规领域中的潜在风险,指出其固有弱点可能违反安全规范和法律义务,并提出通过替代方案和限制使用来缓解问题。

Comments 20 pages, presented at Information Law and Policy Centre Annual Conference 2024 at the Institute of Advanced Study, University of London

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16883 2025-12-19 cs.CL 88%

AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning

AdaSearch:通过强化学习平衡参数知识与搜索

Tzu-Han Lin, Wei-Lin Chen, Chen-An Li, Hung-yi Lee, Yun-Nung Chen, Yu Meng

机构 * National Taiwan University(台湾大学) Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 AdaSearch通过强化学习框架平衡参数知识与搜索,提高知识边界意识并减少不必要的搜索调用。

Comments Preprint. Code and artifacts will be uploaded to https://github.com/hank0316/AdaSearch

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17201 2025-12-19 physics.med-ph 88%

Root Cause Analysis of Radiation Oncology Incidents Using Large Language Models

利用大语言模型进行放射肿瘤事件的根本原因分析

Yuntao Wang, Mariluz De Ornelas, Matthew T. Studenski, Elizabeth Bossart, Siamak P. Najad-Davarani, Yunze Yang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 利用大语言模型分析放射肿瘤事件的根本原因,评估其在提升患者安全中的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12177 2025-12-19 cs.SI cs.DL 87%

LitFM: A Retrieval Augmented Structure-aware Foundation Model For Citation Graphs

LitFM:一种基于检索增强的结构感知文献基础模型

Jiasheng Zhang, Jialin Chen, Ali Maatouk, Ngoc Bui, Qianqian Xie, Leandros Tassiulas, Jie Shao, Hua Xu, Rex Ying

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 LitFM是一种基于检索增强的结构感知文献基础模型,通过整合引用图结构和知识注入的LLM,提升文献检索和相关性评估的准确性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15108 2025-12-19 cs.CL 83%

Knowledge Hierarchy Guided Biological-Medical Dataset Distillation for Domain LLM Training

基于知识层级的生物医学数据集蒸馏用于领域大语言模型训练

Xunxin Cai, Chengrui Wang, Qingqing Long, Yuanchun Zhou, Meng Xiao

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) University of Chinese Academy of Sciences(中国科学院大学) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于生物医学知识层级的自动数据蒸馏框架,提升领域大语言模型的训练效果,使Llama3-70B在参数量上超越GPT-4。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01310 2025-12-19 cs.CV 82%

Lost in Distortion: Uncovering the Domain Gap Between Computer Vision and Brain Imaging -- A Study on Pretraining for Age Prediction

迷失在失真中:计算机视觉与脑影像之间的领域差距——关于年龄预测预训练的研究

Yanteng Zhang, Songheng Li, Zeyu Shen, Qizhen Lan, Lipei Zhang, Yang Liu, Vince Calhoun

机构 * Center for Translational Research in Neuroimaging and Data Science(转化神经影像与数据科学研究中心) College of Artificial Intelligence, Chengdu University of Information Technology(成都信息科技大学人工智能学院) Department of Applied Mathematics and Statistics(应用数学与统计学系) McWilliams School of Biomedical Informatics(麦卡威廉生物医学信息学学院) Department of Applied Mathematics and Theoretical Physics(应用数学与理论物理系) School of Biomedical Engineering and Imaging Sciences(生物医学工程与影像科学学院)

专题命中 领域大模型 :pretraining(title,abstract);foundation model(abstract)

AI总结 本研究探讨了预训练在脑年龄预测中的应用,揭示了高质量数据与低质量数据在预训练中的不同影响,并强调了领域意识整理在构建可靠基础模型中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00931 2025-12-19 cs.CL cs.AI 79%

Mitigating Hallucinations in Zero-Shot Scientific Summarisation: A Pilot Study

缓解零样本科学摘要中的幻觉:一项初步研究

Imane Jaaouine, Ross D. King

机构 * Department of Chemical Engineering and Biotechnology(化学工程与生物技术系) University of Cambridge(剑桥大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨提示工程方法对缓解零样本科学摘要中的幻觉效果,发现上下文重复和随机添加能显著提升摘要与原文的对齐度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16567 2025-12-19 cs.CV 78%

Causal-Tune: Mining Causal Factors from Vision Foundation Models for Domain Generalized Semantic Segmentation

Causal-Tune: 从视觉基础模型中挖掘因果因素以实现领域通用的语义分割

Yin Zhang, Yongqiang Zhang, Yaoyue Zheng, Bogdan Raducanu, Dan Liu

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 Causal-Tune通过频谱分析和因果因素分离提升领域通用语义分割的鲁棒性

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18951 2025-12-19 cs.CV 78%

Percept, Chat, and then Adapt: Multimodal Knowledge Transfer of Foundation Models for Open-World Video Recognition

感知、对话,然后适应:面向开放世界视频识别的多模态基础模型知识迁移

Boyu Chen, Siran Chen, Kunchang Li, Qinglin Xu, Yu Qiao, Yali Wang

机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) the School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 本文提出PCA框架,通过感知、对话和适应三个阶段,利用多模态知识提升开放世界视频识别的性能。

Comments 35 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16701 2025-12-19 cs.AI 70%

Cyber Humanism in Education: Reclaiming Agency through AI and Learning Sciences

教育中的网络人本主义:通过人工智能与学习科学重新夺回主体性

Giovanni Adorni

机构 * DIBRIS, University of Genoa(热那亚大学DIBRIS)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出教育中的网络人本主义框架,通过反思能力、算法公民身份和对话式设计,重新夺回人类在AI驱动教育中的主体性。

Comments 15 pages, 16 references, Key Note preented at the "WAILS 2025 - The 2nd. Workshop on Artificial Intelligence with and for Learning Sciences", Cagliary, Italy, 10-12 December 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16447 2025-12-19 cs.AI 70%

Towards AI-Supported Research: a Vision of the TIB AIssistant

迈向AI支持的研究:TIB AIssistant的愿景

Sören Auer, Allard Oelen, Mohamad Yaser Jaradeh, Mutahira Khalid, Farhana Keya, Sasi Kiran Gaddipati, Jennifer D'Souza, Lorenz Schlüter, Amirreza Alasti, Gollam Rabby, Azanzi Jiomekong, Oliver Karras

机构 * TIB – Leibniz Information Centre for Science(TIB-莱比锡科学与技术信息中心) L3S Research Center, Leibniz University of Hannover(莱比锡汉诺威大学L3S研究中心) Leibniz University of Hannover(莱比锡汉诺威大学) University of Yaounde 1(Yaounde第一大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TIB AIssistant旨在通过人机协作平台提升跨学科科研效率,整合AI助手支持研究全流程任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16442 2025-12-19 cs.AI 70%

TIB AIssistant: a Platform for AI-Supported Research Across Research Life Cycles

TIB AIssistant: 一个跨研究生命周期的AI支持研究平台

Allard Oelen, Sören Auer

机构 * TIB – Leibniz Information Centre for Science(蒂宾根信息科学与技术研究中心) L3S Research Center, Leibniz University of Hannover(汉诺威莱布尼茨大学L3S研究中心)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TIB AIssistant是一个跨研究生命周期的AI支持研究平台,通过集成多个助手和外部学术服务,提升研究透明度和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16108 2025-12-19 cs.AI 70%

WeMusic-Agent: Efficient Conversational Music Recommendation via Knowledge Internalization and Agentic Boundary Learning

WeMusic-Agent: 通过知识内化和代理边界学习实现高效的对话音乐推荐

Wendong Bi, Yirong Mao, Xianglong Liu, Kai Tian, Jian Zhang, Hanjie Wang, Wenhui Que

专题命中 领域大模型 :LLM(abstract);pretraining(abstract);分类 cs.AI

AI总结 WeMusic-Agent通过知识内化和代理边界学习,实现高效对话音乐推荐,提升个性化和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16036 2025-12-19 cs.AI 70%

Topic Discovery and Classification for Responsible Generative AI Adaptation in Higher Education

高等教育中负责任生成式人工智能适应的专题发现与分类

Diane Myung-kyung Woodbridge, Allyson Seba, Freddie Seba, Aydin Schwartz

机构 * University of Southern California(美国南加州大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出了一种自动系统,用于发现和分类高等教育中关于生成式人工智能使用的政策,以促进负责任的AI应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23021 2025-12-19 cs.LG cs.IR 57%

Masked Diffusion for Generative Recommendation

掩码扩散用于生成性推荐

Kulin Shah, Bhuvesh Kumar, Neil Shah, Liam Collins

机构 * UT Austin(得克萨斯大学) Snap Inc(Snap公司)

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 本文提出利用掩码扩散替代自回归建模,以提升生成性推荐中语义ID序列的概率建模效果,尤其在数据受限情况下表现更优。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16841 2025-12-19 cs.CV 50%

Radiology Report Generation with Layer-Wise Anatomical Attention

基于层间解剖注意力的放射报告生成

Emmanuel D. Muñiz-De-León, Jorge A. Rosales-de-Golferichs, Ana S. Muñoz-Rodríguez, Alejandro I. Trejo-Castro, Eduardo de Avila-Armenta, Antonio Martínez-Torteya

专题命中 领域大模型 :language model(abstract)

AI总结 本文提出了一种基于层间解剖注意力的紧凑图像到文本模型,用于生成胸部X光报告的发现部分,通过整合解剖区域信息提升了报告的准确性和连贯性。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03508 2025-12-19 cs.CV 50%

Exploiting Domain Properties in Language-Driven Domain Generalization for Semantic Segmentation

利用领域特性进行语言驱动的领域泛化以实现语义分割

Seogkyu Jeon, Kibeom Hong, Hyeran Byun

机构 * Yonsei University(延世大学) Sookmyung Women’s University(淑明女子大学)

专题命中 领域大模型 :language model(abstract)

AI总结 本文提出DPMFormer框架,通过领域感知提示学习和对比学习提升语义分割的领域泛化能力。

Comments ICCV 2025 (poster)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识编辑与模型理解 8 篇

2512.16227 2025-12-19 cs.CL cs.AI 90%

An Information-Theoretic Framework for Robust Large Language Model Editing

一种基于信息理论的鲁棒大语言模型编辑框架

Qizhou Chen, Chengyu Wang, Taolin Zhang, Xiaofeng He

机构 * East China Normal University(东华大学) Alibaba Group(阿里巴巴集团) Hefei University of Technology(合肥工业大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于信息瓶颈理论的IBKE框架,通过紧凑的潜在表示实现鲁棒的大语言模型编辑,提升知识修正的准确性和通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16891 2025-12-19 cs.CV cs.AI cs.IR cs.LG cs.MM 86%

LinkedOut: Linking World Knowledge Representation Out of Video LLM for Next-Generation Video Recommendation

LinkedOut: 从视频大语言模型中提取世界知识表示以实现下一代视频推荐

Haichao Zhang, Yao Lu, Lichen Wang, Yunzhe Li, Daiwei Chen, Yunpeng Xu, Yun Fu

机构 * Northeastern University(东北大学) LinkedIn(领英) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 LinkedOut通过从视频中提取世界知识表示,实现低延迟、多视频输入的视频推荐,无需人工标注,取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16790 2025-12-19 cs.SE 80%

Inside Out: Uncovering How Comment Internalization Steers LLMs for Better or Worse

Inside Out: 解析评论内化如何引导LLM向好或向坏发展

Aaron Imani, Mohammad Moshirpour, Iftekhar Ahmed

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究通过分析LLM对评论的内部化过程,揭示了评论对代码补全、翻译等任务性能的影响,并发现代码摘要任务对评论概念的激活最强。

Comments Accepted in the 48th IEEE/ACM International Conference on Software Engineering (ICSE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16297 2025-12-19 cs.LG cs.AI 79%

Feature-Selective Representation Misdirection for Machine Unlearning

特征选择性表示误导用于机器去学习

Taozhao Chen, Linghan Huang, Kim-Kwang Raymond Choo, Huaming Chen

机构 * University of Sydney(悉尼大学) University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 SRMU通过特征意识的激活编辑框架,实现安全驱动的模型去学习,有效抑制有害表示并保持模型效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09587 2025-12-19 cs.CL 70%

OpenNER 1.0: Standardized Open-Access Named Entity Recognition Datasets in 50+ Languages

OpenNER 1.0: 50余种语言标准化开放访问命名实体识别数据集

Chester Palen-Michel, Maxwell Pickering, Maya Kruse, Jonne Sälevä, Constantine Lignos

机构 * Michtom School of Computer Science(米切姆计算机科学学院) Brandeis University(布兰迪大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 OpenNER 1.0提供50余种语言的标准化NER数据集,通过修正标注格式和统一表示形式,支持多语言和多本体NER研究,并展示了不同预训练模型在NER任务中的性能差异。

Comments Published in the proceedings of EMNLP 2025

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, pages 33637-33662, Suzhou, China. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16344 2025-12-19 cs.AI 70%

AI Needs Physics More Than Physics Needs AI

AI需要物理比物理需要AI更多

Peter Coveney, Roger Highfield

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了AI与物理之间的相互影响,指出物理对AI有更多贡献,并提出通过理论严谨性与机器学习灵活性结合来发展'大AI'的路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15743 2025-12-19 cs.AI 70%

Prompt-to-Parts: Generative AI for Physical Assembly and Scalable Instructions

Prompt-to-Parts: 生成式AI用于物理装配和可扩展指令

David Noever

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Prompt-to-Parts通过生成式AI生成物理可实现的装配指令,结合LDraw中间表示和Python库,实现复杂结构的可建造输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20056 2025-12-19 cs.CL 57%

Online-PVLM: Advancing Personalized VLMs with Online Concept Learning

在线-PVLM:通过在线概念学习推进个性化VLMs

Huiyu Bai, Runze Wang, Zhuoyun Du, Yiyang Zhao, Fengji Zhang, Haoyu Chen, Xiaoyong Zhu, Bo Zheng, Xuejiao Zhao

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) City University of Hong Kong(香港城市大学) University of Oulu(奥卢大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 Online-PVLM通过在线概念学习框架,实现个性化VLMs的高效实时适应,并提出OP-Eval基准评估其在现实场景中的性能。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他LLM 19 篇

2512.15722 2025-12-19 cs.CY cs.AI cs.CL 90%

Value Lens: Using Large Language Models to Understand Human Values

价值透镜:利用大语言模型理解人类价值观

Eduardo de la Cruz Fernández, Marcelo Karanik, Sascha Ossowski

机构 * Universidad Politécnica de Madrid(马德里理工大学) CETINIA Universidad Rey Juan Carlos(雷耶斯·卡洛斯大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 Value Lens利用大语言模型检测文本中的价值观,通过构建理论和文本分析两阶段实现对人类价值观的识别与评估。

Comments 4 pages. 2 figures. Published in ECAI 2025, Frontiers in Artificial Intelligence and Applications, Volume 413, pages 5175-5178

Journal ref Frontiers in Artificial Intelligence and Applications, Vol. 413, ECAI 2025, pp. 5175-5178 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16063 2025-12-19 cs.HC cs.AI 88%

A Multi-Agent Large Language Model Framework for Automated Qualitative Analysis

一个多智能体大语言模型框架用于自动化定性分析

Qidi Xu, Nuzha Amjad, Grace Giles, Alexa Cumming, De'angelo Hermesky, Alexander Wen, Min Ji Kwak, Yejin Kim

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出CoTI框架,通过多智能体协作实现自动化定性分析,提升主题识别效率,但指出过度依赖AI可能影响研究者独立思考。

Comments 42 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13302 2025-12-19 cs.CL cs.AI 88%

LLM one-shot style transfer for Authorship Attribution and Verification

LLM单次风格迁移用于作者身份识别与验证

Pablo Miralles-González, Javier Huertas-Tato, Alejandro Martín, David Camacho

机构 * Department of Computer Systems(计算机系统系) Technical University of Madrid(马德里技术大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出利用LLM的单次风格迁移能力,通过无监督方法提升作者身份识别与验证的性能,同时优化计算成本与任务表现的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16538 2025-12-19 cs.CR cs.LG 85%

A Systematic Study of Code Obfuscation Against LLM-based Vulnerability Detection

对抗基于大语言模型的漏洞检测的代码混淆系统研究

Xiao Li, Yue Li, Hao Wu, Yue Zhang, Yechao Zhang, Fengyuan Xu, Sheng Zhong

机构 * National Key Lab for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Shandong University(山东大学) Nanyang Technological University(南洋理工大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文系统研究了对抗基于大语言模型的漏洞检测的代码混淆技术,评估了不同混淆方法对LLM检测性能的影响,并提出了未来改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15804 2025-12-19 cs.SE 78%

XBIDetective: Leveraging Vision Language Models for Identifying Cross-Browser Visual Inconsistencies

XBIDetective: 利用视觉语言模型识别跨浏览器视觉不一致

Balreet Grewal, James Graham, Jeff Muizelaar, Jan Honza Odvarko, Suhaib Mujahid, Marco Castelluccio, Cor-Paul Bezemer

专题命中 其他LLM :language model(title,abstract)

AI总结 XBIDetective利用视觉语言模型识别跨浏览器视觉不一致,通过自动截图和分析检测渲染错误,准确率高达79%

详情

展开后加载摘要…

URL PDF HTML 收藏