arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-09 至 2025-12-09 共收录 20 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 20 篇

2512.06502 2025-12-09 cs.CE q-bio.QM 91%

Small Language Models Can Use Nuanced Reasoning For Health Science Research Classification: A Microbial-Oncogenesis Case Study

小型语言模型可以用于健康科学研究分类的细致推理:微生物肿瘤发生案例研究

Muhammed Muaaz Dawood, Mohammad Zaid Moonsamy, Kaela Kokkas, Hairong Wang, Robert F. Breiman, Richard Klein, Emmanuel K. Sekyi, Bruce A. Bassett

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

AI总结 本文研究小型语言模型在健康科学文献分类中的表现,发现其通过细致推理可达到大型语言模型的性能,但需结合有效提示策略以提高准确性。

Comments 43 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06812 2025-12-09 cs.CL 89%

Large Language Model-Based Generation of Discharge Summaries

基于大型语言模型的出院小结生成

Tiago Rodrigues, Carla Teixeira Lopes

机构 * INESC TEC

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在生成出院小结中的应用,发现专有模型在性能上优于开源模型,尽管存在幻觉和信息缺失的问题,但专有模型在生成准确的出院小结方面表现出色。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06001 2025-12-09 physics.ed-ph cs.CL 89%

Small Language Models Reshape Higher Education: Courses, Textbooks, and Teaching

小型语言模型重塑高等教育:课程、教材和教学

Jian Zhang, Jia Shao

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本研究利用小型语言模型重新设计大气物理课程,通过构建高维向量库实现教学资源的动态化与智能化,推动教育模式的变革。

Comments in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06405 2025-12-09 cs.IR 85%

TOOL4POI: A Tool-Augmented LLM Framework for Next POI Recommendation

TOOL4POI: 一种增强工具的LLM框架用于下一步POI推荐

Dongsheng Wang, Shen Gao, Chengrui Huang, Yuxi Huang, Ruixiang Feng, Shuo Shang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 Tool4POI通过外部检索和推理提升POI推荐性能,无需微调即可兼容现成LLM,实现对OOH场景的显著改进。

Comments A critical technical error was discovered during our internal review, leading to unreliable experimental results. The issue cannot be resolved, and the paper has also been formally withdrawn from AAAI 2026. We therefore request withdrawal of the arXiv version to maintain scientific accuracy

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06659 2025-12-09 cs.CR 85%

The Evolution of Agentic AI in Cybersecurity: From Single LLM Reasoners to Multi-Agent Systems and Autonomous Pipelines

代理AI在网络安全中的演变:从单一LLM推理者到多代理系统和自主流水线

Vaishali Vinay

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了网络安全中代理AI从单一LLM到多代理系统的发展,分析了五代分类法及各代在推理深度、工具使用等维度的差异,并总结了当前面临的挑战。

Comments Accepted at ICAIC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21933 2025-12-09 cs.CL cs.AI 82%

Why Chain of Thought Fails in Clinical Text Understanding

为什么链式思维在临床文本理解中失效

Jiageng Wu, Kevin Xie, Bowen Gu, Nils Krüger, Kueiyu Joshua Lin, Jie Yang

机构 * Harvard Medical School(哈佛医学院) MIT(麻省理工学院) Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究发现链式思维在临床文本理解中导致性能下降,揭示了其在临床任务中可靠性与可解释性的矛盾。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05993 2025-12-09 cs.CV cs.AI 79%

Domain-Specific Foundation Model Improves AI-Based Analysis of Neuropathology

领域特定基础模型提升基于人工智能的神经病理科分析

Ruchika Verma, Shrishtee Kandoi, Robina Afzal, Shengjia Chen, Jannes Jegminat, Michael W. Karlovich, Melissa Umphlett, Timothy E. Richardson, Kevin Clare, Quazi Hossain, Jorge Samanamud, Phyllis L. Faust, Elan D. Louis, Ann C. McKee, Thor D. Stein, Jonathan D. Cherry, Jesse Mez, Anya C. McGoldrick, Dalilah D. Quintana Mora, Melissa J. Nirenberg, Ruth H. Walker, Yolfrankcis Mendez, Susan Morgello, Dennis W. Dickson, Melissa E. Murray, Carlos Cordon-Cardo, Nadejda M. Tsankova, Jamie M. Walker, Diana K. Dangoor, Stephanie McQuillan, Emma L. Thorn, Claudia De Sanctis, Shuying Li, Thomas J. Fuchs, Kurt Farrell, John F. Crary, Gabriele Campanella

机构 * Windreich Department of AI and Human Health(AI与人类健康部门) Icahn School of Medicine at Mount Sinai(辛克医学院(梅奥医院)) Hasso Plattner Institute for Digital Health at Mount Sinai(梅奥医院数字健康研究所) Department of Neurology(神经病学部门) Department of Pathology(病理学部门) Columbia University(哥伦比亚大学) Memorial Sloan-Kettering Cancer Center(纪念斯隆凯特林癌症中心) Department of Neuroscience(神经科学部门) Mayo Clinic College of Medicine(梅奥诊所医学院) University of Texas Southwestern Medical Center(德克萨斯西南医学中心) Peter O’Donnell Jr. Brain Institute(彼得·奥多尼尔 Jr. 脑研究所) VA Boston Healthcare System(波士顿退伍军人医疗系统)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 NeuroFM通过专门训练于脑组织的领域特定基础模型,提升神经病理学AI分析的准确性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20549 2025-12-09 cs.LG cs.AI 79%

MedGR$^2$: Breaking the Data Barrier for Medical Reasoning via Generative Reward Learning

MedGR$^2$: 通过生成奖励学习突破医学推理的数据壁垒

Weihai Zhi, Jiayan Guo, Shangyang Li

专题命中 领域大模型 :language model(abstract);foundation model(abstract);SFT(abstract);分类 cs.AI、cs.LG

AI总结 MedGR$^2$通过生成奖励学习解决医学推理中的数据稀缺问题,实现高效训练和泛化,优于现有方法。

Comments 8 pages, 5 figures

Journal ref AAAI'2026 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21615 2025-12-09 cs.CL cs.AI cs.IR 79%

Refine Medical Diagnosis Using Generation Augmented Retrieval and Clinical Practice Guidelines

通过生成增强检索和临床实践指南提升医学诊断

Wenhao Li, Hongkuan Zhang, Hongwei Zhang, Zhengxu Li, Zengjie Dong, Yafan Chen, Niranjan Bidargaddi, Hong Liu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出GARMLE-G框架,通过生成增强检索和临床指南整合,提升医学诊断的准确性和临床实用性。

Journal ref Journal of Biomedical and Health Informatics (JBHI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07652 2025-12-09 cs.CV cs.AI 77%

An AI-Powered Autonomous Underwater System for Sea Exploration and Scientific Research

基于人工智能的自主水下系统用于海洋探索与科学研究

Hamad Almazrouei, Mariam Al Nasseri, Maha Alzaabi

机构 * College of Technological Innovation Zayed University(技术创新学院泽亚大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于人工智能的自主水下系统,通过集成YOLOv12 Nano、ResNet50、PCA和LLM,实现高效水下物体检测与分析,提升海洋科学研究效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06105 2025-12-09 cs.CV cs.AI 74%

Explainable Melanoma Diagnosis with Contrastive Learning and LLM-based Report Generation

基于对比学习和大语言模型的可解释性黑色素瘤诊断

Junwen Zheng, Xinran Xu, Li Rong Wang, Chang Cai, Lucinda Siyun Tan, Dingyuan Wang, Hong Liang Tey, Xiuyi Fan

专题命中 领域大模型 :LLM(title);分类 cs.AI

AI总结 本文提出基于对比学习和大语言模型的可解释性黑色素瘤诊断框架,通过将临床标准映射到视觉Transformer空间,实现图像与临床解释的透明连接,提升模型可解释性与临床信任度。

Comments AAAI-26-AIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06734 2025-12-09 cs.CL cs.AI 73%

A Patient-Doctor-NLP-System to contest inequality for less privileged

一名患者-医生-NLP系统以对抗不平等,为弱势群体服务

Subrit Dikshit, Ritu Tiwari, Priyank Jain

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PDFTEMRA通过整合模型蒸馏、频域调制等技术,为低资源语言用户提供高效、可访问的医疗NLP解决方案。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26153 2025-12-09 cs.AI 70%

A Field Guide to Deploying AI Agents in Clinical Practice

人工智能代理在临床实践中的部署指南

Jack Gallifant, Katherine C. Kellogg, Matt Butler, Amanda Centi, Shan Chen, Patrick F. Doyle, Sayon Dutta, Joyce Guo, Matthew J. Hadfield, Esther H. Kim, David E. Kozono, Hugo JWL Aerts, Adam B. Landman, Raymond H. Mak, Rebecca G. Mishuris, Tanna L. Nelson, Guergana K. Savova, Elad Sharon, Benjamin C. Silverman, Umit Topaloglu, Jeremy L. Warner, Danielle S. Bitterman

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一本面向实践者的指南,旨在解决生成式AI在临床实践中部署的挑战,强调数据整合、模型验证和治理等关键实施工作。

Comments Under review. 7 Tables, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14937 2025-12-09 cs.DB cs.LG 70%

Proceedings of the 3rd Italian Conference on Big Data and Data Science (ITADATA2024)

第三届意大利大数据与数据科学会议(ITADATA2024)会议论文集

Nicola Bena, Claudia Diamantini, Michela Natilli, Luigi Romano, Giovanni Stilo, Valentina Pansanella, Claudio A. Ardagna, Anna Monreale, Roberto Trasarti

机构 * CINI National Lab on Data Science(CINI数据科学国家实验室) ISTI CNR

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 ITADATA2024聚焦大数据与数据科学的理论与实践,涵盖数据治理、机器学习、医疗金融应用及社交网络分析等核心领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06447 2025-12-09 cs.CV 67%

Towards Stable Cross-Domain Depression Recognition under Missing Modalities

迈向稳定跨领域抑郁识别下的缺失模态

Jiuyi Chen, Mingkui Tan, Haifeng Lu, Qiuna Xu, Zhihua Wang, Runhao Zeng, Xiping Hu

机构 * School of Future Technology, South China University of Technology(未来技术学院,华南理工大学) PengCheng Laboratory(鹏城实验室) School of Software Engineering, South China University of Technology(软件工程学院,华南理工大学) Artificial Intelligence Research Institute, Shenzhen MSU-BIT University(人工智能研究院,深圳MSU-BIT大学) Guangdong-Hong Kong-Macao Joint Laboratory for Emotional Intelligence and Pervasive Computing(粤港澳大湾区情感智能与泛在计算联合实验室) School of Computer Science and Technology, Guangdong University of Technology(计算机科学与技术学院,广东工业大学) Department of Computer Science, City University of Hong Kong(计算机科学系,香港城市大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文提出SCD-MLLM框架,通过多源数据适配器和模态感知自适应融合模块,实现稳定跨领域抑郁症识别,提升多模态数据处理的鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06161 2025-12-09 cs.AI cs.LG 62%

Deep learning for autism detection using clinical notes: A comparison of transfer learning for a transparent and black-box approach

利用临床笔记进行自闭症检测的深度学习:透明与黑箱方法的迁移学习比较

Gondy Leroy, Prakash Bisht, Sai Madhuri Kandula, Nell Maltman, Sydney Rice

专题命中 领域大模型 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出了一种基于BioBERT的透明机器学习方法,通过混合数据集训练提升了自闭症检测的准确率,优于黑箱方法。

Comments 9 pages

Journal ref Artificial Intelligence in Medicine, February, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07650 2025-12-09 cs.IR cs.LG 57%

Exploring Test-time Scaling via Prediction Merging on Large-Scale Recommendation

通过预测合并探索大规模推荐中的测试时扩展

Fuyuan Lyu, Zhentai Chen, Jingyan Jiang, Lingjie Li, Xing Tang, Xiuqiang He, Xue Liu

机构 * MBZUAI \& McGill University \& \ - Quebec AI Institute Montreal Canada School of Artificial Intelligence Shenzhen Technology University Shenzhen China MBZUAI \& McGill University Abu Dhabi UAE MBZUAI \& McGill University \& \ - Quebec AI Institute School of Artificial Intelligence Shenzhen Technology University MBZUAI \& McGill University

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 本文提出通过预测合并探索大规模推荐中的测试时扩展,通过两种方法提升推荐系统的扩展效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06396 2025-12-09 cs.CR cs.AI 57%

AgenticCyber: A GenAI-Powered Multi-Agent System for Multimodal Threat Detection and Adaptive Response in Cybersecurity

AgenticCyber: 一种基于生成式AI的多智能体系统,用于多模态威胁检测与自适应响应在网络安全中

Shovan Roy

机构 * TNTech

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 AgenticCyber通过生成式AI驱动的多智能体系统,实现多模态威胁检测与自适应响应,提升网络安全性能和态势感知能力。

Comments 6 pages for IEEE conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25374 2025-12-09 cs.AI cs.CV 57%

Saliency Guided Longitudinal Medical Visual Question Answering

基于显著性的纵向医学视觉问答

Jialin Wu, Xiaofeng Liu

机构 * Dept. of Computer Science and Engineering University of California, San Diego(计算机科学与工程系,加州大学圣地亚哥分校) Dept. of Radiology and Biomedical Imaging Yale University(放射学与生物医学成像系,耶鲁大学)

专题命中 领域大模型 :pretraining(abstract);分类 cs.AI

AI总结 本文提出基于显著性的纵向医学视觉问答模型,通过显著性引导的编码器-解码器结构,在保持空间一致性的同时实现高效的临床变化识别。

Comments Published in NeurIPS Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07424 2025-12-09 cs.IR 50%

OnePiece: The Great Route to Generative Recommendation -- A Case Study from Tencent Algorithm Competition

OnePiece:生成推荐的伟大力量——来自腾讯算法竞赛的案例研究

Jiangxia Cao, Shuo Yang, Zijun Wang, Qinghai Tan

专题命中 领域大模型 :language model(abstract)

AI总结 本文提出统一编码器-解码器框架,验证生成推荐中ANN和自回归范式的缩放定律,发现两者损失均严格符合幂律缩放规律。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏