arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-08 至 2026-01-08 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 14 篇

2504.01216 2026-01-08 cs.CL cs.AI cs.LG 90%

Detecting PTSD in Clinical Interviews: A Comparative Analysis of NLP Methods and Large Language Models

在临床访谈中检测PTSD:自然语言处理方法和大语言模型的比较分析

Feng Chen, Dror Ben-Zeev, Gillian Sparks, Arya Kadakia, Trevor Cohen

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究比较了NLP方法和大语言模型在临床访谈中检测PTSD的效果,发现领域特定模型和嵌入方法表现最佳,强调了领域适应技术在PTSD筛查中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08614 2026-01-08 cs.CL 89%

A Super-Learner with Large Language Models for Medical Emergency Advising

基于大语言模型的医疗急救顾问超级学习器

Sergey K. Aityan, Abdolreza Mosaddegh, Rolando Herrero, Haitham Tayyar, Jiang Han, Vikram Sawant, Qi Chen, Rishabh Jain, Aruna Senthamaraikannan, Stephen Wood, Manuel Mersini, Rita Lazzaro, Mario Balzanelli, Nicola Iacovazzo, Ciro Gargiulo Isacco

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出基于大语言模型的医疗急救顾问超级学习器,通过整合多个模型提升诊断准确率,达到70%甚至85%的高水平表现。

Comments 12 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03702 2026-01-08 cs.MA 89%

A Chromatographic Process Design and Optimization Platform Powered by Large Language Models: A Case Application on Extract of Ginkgo Biloba Leaf

基于大语言模型的色谱过程设计与优化平台:以银杏叶提取物为例

Zhilong Tang, Shaohua Wu, Xinyan Zhao, Yu Wang, Xingchu Gong

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于大语言模型的色谱过程设计与优化平台ChromR,通过自动化流程显著缩短开发时间,应用于银杏叶提取物纯化案例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03988 2026-01-08 cs.SE cs.LG 88%

Using Small Language Models to Reverse-Engineer Machine Learning Pipelines Structures

利用小型语言模型反向工程机器学习流水线结构

Nicolas Lacroix, Mireille Blay-Fornarino, Sébastien Mosser, Frederic Precioso

机构 * Université Côte d’Azur, Inria, CNRS, I3S(法国蔚蓝海岸大学、Inria、CNRS、I3S)

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);分类 cs.LG

AI总结 本文研究小型语言模型在反向工程机器学习流水线结构中的应用,评估其在提升数据科学实践理解方面的潜力。

Comments SANER 2026 Registered Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03475 2026-01-08 cs.AI 87%

CPGPrompt: Translating Clinical Guidelines into LLM-Executable Decision Support

CPGPrompt:将临床指南转化为LLM可执行的决策支持

Ruiqi Deng, Geoffrey Martin, Tony Wang, Gongbo Zhang, Yi Liu, Chunhua Weng, Yanshan Wang, Justin F Rousseau, Yifan Peng

机构 * Information Science (Health Tech), Cornell Tech, New York, NY, USA(信息科学(健康科技),康奈尔科技,纽约,纽约州) Systems Engineering, Cornell University, Ithaca, NY, USA(系统工程,康奈尔大学,伊萨卡,纽约州) Population Health Sciences, Weill Cornell Medicine, New York, NY, USA(人口健康科学,韦尔医学院,纽约,纽约州) Computer and Information Science, Cornell University, Ithaca, NY, USA(计算机与信息科学,康奈尔大学,伊萨卡,纽约州) Department of Biomedical Informatics, Columbia University, New York, NY, USA(生物医学信息学系,哥伦比亚大学,纽约,纽约州) Department of Medicine, Weill Cornell Medicine, New York, NY, USA(医学系,韦尔医学院,纽约,纽约州) Department of Health Information Management, University of Pittsburgh, Pittsburgh, PA, USA(健康信息管理系,匹兹堡大学,匹兹堡,宾夕法尼亚州) Clinical and Translational Science Institute, University of Pittsburgh, Pittsburgh, PA, USA(临床与转化科学研究所,匹兹堡大学,匹兹堡,宾夕法尼亚州) Department of Neurology, UT Southwestern Medical Center, Dallas, TX, USA(神经病学系,德克萨斯西南医学中心,达拉斯,德克萨斯州) Peter O’Donnell Jr. Brain Institute, UT Southwestern Medical Center, Dallas, TX, USA(彼得·奥·donnell Jr.脑研究所,德克萨斯西南医学中心,达拉斯,德克萨斯州) Clinical Informatics Center, University of Texas Southwestern Medical Center, Dallas, USA(临床信息学中心,德克萨斯西南医学中心,达拉斯,美国) Institute of Artificial Intelligence for Digital Health, Weill Cornell Medicine, New York, NY USA(数字健康人工智能研究所,韦尔医学院,纽约,纽约州)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 CPGPrompt通过将临床指南转化为LLM可执行的结构化决策树,实现对患者病例的高效评估,提升了专科转诊和路径分类的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03436 2026-01-08 astro-ph.IM cs.AI 84%

MARVEL: A Multi Agent-based Research Validator and Enabler using Large Language Models

MARVEL:基于大语言模型的多智能体研究验证器与促进器

Nikhil Mukund, Yifang Luo, Fan Zhang, Lisa Barsotti, Erik Katsavounidis

机构 * MIT Kavli Institute for Astrophysics and Space Research and LIGO Laboratory(麻省理工学院凯斯利天文与空间研究所及LIGO实验室) Massachusetts Institute of Technology(麻省理工学院) State Key Laboratory of Ocean Sensing & Ocean College(海洋传感国家重点实验室) Zhejiang University(浙江大学) NSF AI Institute for Artificial Intelligence and Fundamental Interactions (IAIFI)(国家科学基金会人工智能与基本相互作用研究所) Cambridge, MA, USA(美国马萨诸塞州剑桥市)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

AI总结 MARVEL通过结合快速查询路径和深度搜索模式,为科学领域提供可部署的验证器,其在探测器操作内容上显著优于GPT-4o基线。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04163 2026-01-08 eess.IV cs.CV cs.LG 83%

Scanner-Induced Domain Shifts Undermine the Robustness of Pathology Foundation Models

扫描诱导的域偏移损害病理基础模型的鲁棒性

Erik Thiringer, Fredrik K. Gustafsson, Kajsa Ledesma Eriksson, Mattias Rantalainen

机构 * Department of Medical Epidemiology and Biostatistics, Karolinska Institutet(卡罗林斯卡研究所医学流行病学与生物统计学系) Department of Engineering Science, University of Oxford(牛津大学工程科学系)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了扫描诱导的域偏移对病理基础模型鲁棒性的影响,发现现有模型在面对扫描设备变异性时存在显著偏差,需改进嵌入稳定性和校准以提升临床可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03259 2026-01-08 cs.IR 82%

LLMDiRec: LLM-Enhanced Intent Diffusion for Sequential Recommendation

LLMDiRec: 基于大语言模型的意图扩散增强序列推荐

Bo-Chian Chen, Manel Slokom

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract)

AI总结 LLMDiRec通过整合大语言模型与意图感知扩散模型,提升序列推荐中复杂用户意图捕捉和长尾项推荐效果。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08849 2026-01-08 cs.CV 82%

Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis

为下一代医学超声图像分析适应视觉-语言基础模型

Jingguo Qu, Xinyang Han, Jia Ai, Juan Wu, Tong Zhao, Tonghuan Xiao, Sheng Ning, Yuqi Yang, Jing Qin, Ann Dorothy King, Winnie Chiu-Wing Chu, Jing Cai, Michael Tin-Cheung Ying

机构 * Department of Health Technology and Informatics, The Hong Kong Polytechnic University(健康科技与信息学系,香港理工大学) Centre for Smart Health and School of Nursing, The Hong Kong Polytechnic University(智能健康中心及护理学院,香港理工大学) Department of Imaging and Interventional Radiology, The Chinese University of Hong Kong(影像与介入放射学系,香港中文大学) Suzhou Hospital of Traditional Chinese Medicine Affiliated to Nanjing University of Chinese Medicine(南京中医药大学附属苏州中医医院) Department of Ultrasound, The Affiliated Changzhou No. 2 People's Hospital of Nanjing Medical University(南京医科大学附属常州第二人民医院超声科)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract)

AI总结 本文提出混合微调策略,通过频域过滤和多尺度特征聚合提升CLIP模型在超声图像分析中的性能,实现更高效和鲁棒的医学诊断应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03687 2026-01-08 cs.AI 79%

Personalized Medication Planning via Direct Domain Modeling and LLM-Generated Heuristics

通过直接领域建模和LLM生成的启发式方法实现个性化药物规划

Yonatan Vernik, Alexander Tuisov, David Izhaki, Hana Weitman, Gal A. Kaminka, Alexander Shleyfman

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

AI总结 本文通过直接领域建模和LLM生成的启发式方法,提升了个性化药物规划的规模和效率,支持更接近临床应用的实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11184 2026-01-08 cs.LG cs.CL 79%

Reinforcement Learning for Tool-Integrated Interleaved Thinking towards Cross-Domain Generalization

强化学习用于工具集成的交叉领域泛化思考

Zhengyu Chen, Jinluan Yang, Teng Xiao, Ruochen Zhou, Luan Zhang, Xiangyu Xi, Xiaowei Shi, Wei Wang, Jinggang Wang

机构 * Meituan(美团) Zhejiang University(浙江大学) Allen Institute for Artificial Intelligence(人工智能算法研究所) City University of Hong Kong(香港城市大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出RITE方法,通过强化学习和交叉领域工具执行,提升LLM在跨领域推理中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03335 2026-01-08 cs.AI cs.NE 77%

Digital Red Queen: Adversarial Program Evolution in Core War with LLMs

数字红皇后:基于大语言模型的Core War中的对抗程序进化

Akarsh Kumar, Ryan Bahlous-Boldi, Prafull Sharma, Phillip Isola, Sebastian Risi, Yujin Tang, David Ha

机构 * MIT(麻省理工学院) Sakana AI

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出DRQ算法,利用大语言模型在Core War游戏中通过持续适应变化的目标进化出通用且高效的战士,揭示了动态对抗进化在人工智能系统中的潜力。

Comments 14 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03733 2026-01-08 cs.CV cs.AI cs.CL cs.CY cs.LG 67%

RadDiff: Describing Differences in Radiology Image Sets with Natural Language

RadDiff:用自然语言描述放射学图像集的差异

Xiaoxian Shen, Yuhui Zhang, Sahithi Ankireddy, Xiaohan Wang, Maya Varma, Henry Guo, Curtis Langlotz, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学)

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 RadDiff通过多模态代理系统实现放射学图像集差异的自然语言描述,结合医学知识和多模态推理,在放射学研究配对中取得高准确率,推动临床影像分析的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03315 2026-01-08 cs.LG cs.AI 62%

Why LLMs Aren't Scientists Yet: Lessons from Four Autonomous Research Attempts

为何大语言模型尚未成为科学家:来自四个自主研究尝试的教训

Dhruv Trehan, Paras Chopra

专题命中 领域大模型 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了四个自主生成科研论文的尝试,揭示了大语言模型在科学工作流程中面临的六个常见失败模式,并提出了改进AI科学家系统的设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏