arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2604.27673 2026-05-01 cs.AI cs.CY cs.HC cs.LG cs.SI 82%

The TEA Nets framework combines AI and cognitive network science to model targets, events and actors in text

TEA Nets框架结合人工智能与认知网络科学,用于建模文本中的目标、事件和主体

Sebastiano Franchini, Alexis Carrillo, Edoardo Sebastiano De Duro, Riccardo Improta, Ali Aghazadeh Ardebili, Massimo Stella

机构 * CogNosco Lab, Department of Psychology and Cognitive Science, University of Trento(CogNosco实验室,心理学与认知科学系,特伦托大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 TEA Nets框架通过认知网络科学和人工智能提取文本中的主体、事件和目标,展示了在阴谋文本和LLM生成文本中进行可解释情绪检测、语义框架分析和语言研究的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22067 2026-04-29 cs.CL cs.AI 82%

Optimal Question Selection from a Large Question Bank for Clinical Field Recovery in Conversational Psychiatric Intake

从大规模问题库中选择最优问题以实现临床场景中的对话恢复

Guan Gui, Peter Zandi, Jacob Taylor, Ananya Joshi

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 本文提出一个基于临床问题库的问题选择框架,通过对比随机提问、临床基线和LLM引导策略,发现结构化问题和适应性策略能显著提升临床对话信息恢复效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23578 2026-04-28 cs.CL cs.AI 82%

LLMs Reading the Rhythms of Daily Life: Aligned Understanding for Behavior Prediction and Generation

LLMs阅读日常生活节奏:行为预测与生成的对齐理解

Fanjin Meng, Jingtao Ding, Nian Li, Yizhou Sun, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,BNRist,清华大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出BUA框架,通过结构化课程学习将LLMs融入人类行为建模,提升行为预测与生成能力,实验证明其在复杂行为建模中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23284 2026-04-28 cs.CL cs.AI 82%

Au-M-ol: A Unified Model for Medical Audio and Language Understanding

Au-M-ol:医疗音频与语言理解的统一模型

Meizhu Liu, Nistha Mitra, Paul Li, Amine Abdaoui, Adam Ledyard, Tao Sheng

机构 * Oracle AI Science(Oracle AI科学) Neuramill

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Au-M-ol模型,通过整合音频处理与大语言模型,提升医疗语音识别等任务的性能,实验显示其将词错误率降低56%,在噪声和专业术语等挑战下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21421 2026-04-24 cs.CR cs.AI cs.CL 82%

Differentially Private De-identification of Dutch Clinical Notes: A Comparative Evaluation

差分隐私的荷兰临床笔记去标识化:比较评估

Michele Miranda, Xinlan Yan, Nishant Mishra, Rachel Murphy, Ameen Abu-Hanna, Sébastien Bratières, Iacer Calixto

机构 * Sapienza University of Rome(罗马大学) Translated Amsterdam UMC(阿姆斯特丹大学医学中心) University of Amsterdam(阿姆斯特丹大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究比较了差分隐私、命名实体识别和大型语言模型在荷兰临床文本去标识化中的性能,发现结合语言预处理可显著提升隐私与效用的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21070 2026-04-24 cs.CL cs.LG 82%

DWTSumm: Discrete Wavelet Transform for Document Summarization

DWTSumm:基于离散小波变换的文档摘要

Rana Salama, Abdou Youssef, Mona Diab

机构 * School of Engineering and Applied Science, George Washington University(乔治华盛顿大学工程与应用科学学院) Faculty of Computers and Artificial Intelligence, Cairo University(开罗大学计算机与人工智能学院) Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种基于离散小波变换的多分辨率框架,用于长文档摘要,通过分解文本为全局和局部成分,提升摘要的语义相似性和事实一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12258 2026-04-22 cs.CL cs.AI 82%

Coding-Free and Privacy-Preserving Agentic Framework for Data-Driven Clinical Research

无编码且隐私保护的代理框架用于数据驱动的临床研究

Taehun Kim, Hyeryun Park, Hyeonhoon Lee, Yushin Lee, Kyungsang Kim, Hyung-Chul Lee

机构 * Infmedix, Co., Ltd.(Infmedix公司) Department of Transdisciplinary Studies, Seoul National University(首尔国立大学跨学科研究系) Healthcare AI Research Institute, Seoul National University Hospital(首尔国立大学医院医疗人工智能研究所) Department of Medicine, Seoul National University College of Medicine(首尔国立大学医学院医学系) Department of Transdisciplinary Medicine, Seoul National University Hospital(首尔国立大学医院跨学科医学系) Department of Radiology, Massachusetts General Hospital and Harvard Medical School(麻省总医院放射科及哈佛医学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出CARIS框架,通过整合大语言模型与模块化工具,实现无需编程的自然语言驱动研究,提升临床研究效率与隐私保护。

Comments 10 pages, 5 figures, 2 tables, Supplementary Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19897 2026-04-21 cs.AI cs.CL cs.CV cs.HC 82%

ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows

ScienceBoard: 评估多模态自主代理在真实科学工作流中的表现

Qiushi Sun, Zhoumianze Liu, Chang Ma, Zichen Ding, Fangzhi Xu, Zhangyue Yin, Haiteng Zhao, Zhenyu Wu, Kanzhi Cheng, Zhaoyang Liu, Jianing Wang, Qintong Li, Xiangru Tang, Tianbao Xie, Xiachong Feng, Xiang Li, Ben Kao, Wenhai Wang, Biqing Qi, Lingpeng Kong, Zhiyong Wu

机构 * The University of Hong Kong(香港大学) Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学) Peking University(北京大学) Nanjing University(南京大学) East China Normal University(华东师范大学) Yale University(耶鲁大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 ScienceBoard通过真实多领域环境和169个高质量任务评估多模态自主代理在科学工作流中的能力,发现现有代理在复杂任务中仅达到15%的成功率,揭示了改进设计原则的必要性。

Comments ICLR 2026 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17153 2026-04-21 cs.CL cs.AI 82%

From Legal Text to Executable Decision Models: Evaluating Structured Representations for Legal Decision Model Generation

从法律文本到可执行决策模型:评估结构化表示在法律决策模型生成中的应用

David Graus

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 本文研究通过结构化表示提升基于LLM的法律决策模型生成效果,发现输入约束显著提升模型相似度,且结构相似性与结果等价性互补。

Comments 10 pages, 3 figures, accepted to ICAIL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12352 2026-04-15 cs.AI cs.CL 82%

MultiDocFusion: Hierarchical and Multimodal Chunking Pipeline for Enhanced RAG on Long Industrial Documents

多文档融合:一种用于长工业文档增强RAG的分块流程

Joongmin Shin, Chanjun Park, Jeongbae Park, Jaehyung Seo, Heuiseok Lim

机构 * Human-inspired AI Research(人机协同人工智能研究所) Department of Computer Science and Engineering(计算机科学与工程系) School of Software(软件学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对长工业文档结构复杂的问题,提出MultiDocFusion分块流程,结合视觉解析、OCR提取、层次结构重建和DFS分组,提升RAG检索精度和问答质量。

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06603 2026-04-09 cs.CL cs.AI 82%

Scientific Knowledge-driven Decoding Constraints Improving the Reliability of LLMs

基于科学知识的解码约束:提升大语言模型的可靠性

Maotian Ma, Zheni Zeng, Zhenghao Liu, Yukun Yan

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Northeastern University(东北大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出SciDC方法,通过整合领域知识与强约束提升LLM在科学任务中的可靠性,实验显示在工业配方设计、肿瘤诊断和逆合成规划中平均准确率提升12%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04017 2026-03-18 cs.AI cs.LG physics.ao-ph 82%

Zephyrus: An Agentic Framework for Weather Science

Zephyrus:一种用于气象科学的代理框架

Sumanth Varambally, Marshall Fisher, Jas Thakker, Yiwei Chen, Zhirui Xia, Yasaman Jafari, Ruijia Niu, Manas Jain, Veeramakali Vignesh Manivannan, Zachary Novack, Luyu Han, Srikar Eranky, Salva Rühling Cachay, Taylor Berg-Kirkpatrick, Duncan Watson-Parris, Yi-An Ma, Rose Yu

机构 * UC San Diego(加州大学圣地亚哥分校)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文提出Zephyrus框架,结合大语言模型与天气数据交互,解决传统模型缺乏语言推理的问题,通过新基准测试展示其在天气任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12282 2026-03-03 cs.AI cs.LG 82%

AISSISTANT: Human-AI Collaborative Review and Perspective Research Workflows in Data Science

AIssistant: 人机协作的数据科学科研与视角研究工作流

Sasi Kiran Gaddipati, Farhana Keya, Gollam Rabby, Sören Auer

机构 * TIB Leibniz Information Centre for Science and Technology(图灵信息科学与技术研究所) L3S Research Center(L3S研究中心)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 AIssistant通过人机协作框架提升数据科学科研与视角研究的效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10004 2026-01-26 cs.AI cs.CL 82%

Exploring LLMs for Scientific Information Extraction Using The SciEx Framework

探索使用SciEx框架利用大语言模型进行科学信息提取

Sha Li, Ayush Sadekar, Nathan Self, Yiqi Su, Lars Andersland, Mira Chaplin, Annabel Zhang, Hyoju Yang, James B Henderson, Krista Wigginton, Linsey Marr, T. M. Murali, Naren Ramakrishnan

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出SciEx框架,通过解耦关键组件提升科学信息提取的准确性和一致性,评估结果显示其在多科学领域中的有效性。

Comments Accepted to the KGML Bridge at AAAI 2026 (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12471 2026-01-23 cs.CL cs.AI 82%

Knowing When to Abstain: Medical LLMs Under Clinical Uncertainty

知何时退避:医疗大语言模型在临床不确定性中的表现

Sravanthi Machcha, Sushrita Yerra, Sahil Gupta, Aishwarya Sahoo, Sharmin Sultana, Hong Yu, Zonghai Yao

机构 * Manning College of Information and Computer Sciences, UMass Amherst, MA, USA(马萨诸塞大学阿姆赫斯特曼宁信息与计算机科学学院) Center for Healthcare Organization and Implementation Research, VA Bedford Health Care(医疗组织与实施研究中心) Miner School of Computer and Information Sciences, UMass Lowell, MA, USA(米纳尔计算机与信息科学学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出MedAbstain基准,探讨医疗LLM在临床不确定性中的退避能力,发现显式退避选项能显著提升安全性,而模型规模和提示方法效果有限。

Comments Equal contribution for the first two authors; To appear in proceedings of the Main Conference of the European Chapter of the Association for Computational Linguistics (EACL) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08899 2026-01-01 cs.CL cs.AI cs.CY cs.LO 82%

Toward Robust Legal Text Formalization into Defeasible Deontic Logic using LLMs

迈向使用LLMs的稳健法律文本形式化到可撤销的规范逻辑

Elias Horner, Cristinel Mateis, Guido Governatori, Agata Ciabattoni

机构 * TU Wien(维也纳技术大学) AIT Austrian Institute of Technology(奥地利技术研究所) School of Engineering and Technology(工程与技术学院) Artificial Intelligence and Cyber Futures Institute(人工智能与未来网络研究院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出利用LLMs将法律文本形式化为可撤销规范逻辑,通过结构化管道和改进的评估方法,提升形式化的一致性和完整性。

Comments This version is an extended version with additional results and discussion

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21933 2025-12-09 cs.CL cs.AI 82%

Why Chain of Thought Fails in Clinical Text Understanding

为什么链式思维在临床文本理解中失效

Jiageng Wu, Kevin Xie, Bowen Gu, Nils Krüger, Kueiyu Joshua Lin, Jie Yang

机构 * Harvard Medical School(哈佛医学院) MIT(麻省理工学院) Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究发现链式思维在临床文本理解中导致性能下降,揭示了其在临床任务中可靠性与可解释性的矛盾。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20727 2025-10-24 cs.CL cs.AI 82%

Automated Extraction of Fluoropyrimidine Treatment and Treatment-Related Toxicities from Clinical Notes Using Natural Language Processing

Xizhi Wu, Madeline S. Kreider, Philip E. Empey, Chenyu Li, Yanshan Wang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10803 2025-10-16 cs.AI cs.CL cs.ET cs.IR 82%

Automated Thematic Analyses Using LLMs: Xylazine Wound Management Social Media Chatter Use Case

JaMor Hairston, Ritvik Ranjan, Sahithi Lakamana, Anthony Spadaro, Selen Bozkurt, Jeanmarie Perrone, Abeed Sarker

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Pages: 19, Abstract word count: 151 words, Manuscript word count: 2185 words, References: 14, Figures: 3, Tables: 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03536 2025-10-15 cs.CL cs.AI 82%

Triplet-Structured Knowledge Integration for Multi-Turn Medical Reasoning

Zhaohan Meng, Zaiqiao Meng, Siwei Liu, Iadh Ounis

机构 * School of Computing Science, University of Glasgow, UK(格拉斯哥大学计算机科学学院) School of Natural and Computing Science, University of Aberdeen, UK(阿伯丁大学自然与计算科学学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23537 2025-09-29 cs.LG cs.CL 82%

Domain-Aware Tensor Network Structure Search

Giorgos Iacovides, Wuyang Zhou, Chao Li, Qibin Zhao, Danilo Mandic

机构 * Department of Electrical and Electronic Engineering, Imperial College London(帝国理工学院伦敦校区电子与电气工程系) RIKEN AIP(日本理化学研究所AIP)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19326 2025-09-25 cs.CL cs.AI 82%

Unveiling the Merits and Defects of LLMs in Automatic Review Generation for Scientific Papers

Ruochi Li, Haoxuan Zhang, Edward Gehringer, Ting Xiao, Junhua Ding, Haihua Chen

机构 * North Carolina State University(北卡罗来纳州立大学) University of North Texas(德克萨斯大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted as short paper at 25th IEEE International Conference on Data Mining

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04696 2025-09-08 cs.CL cs.AI 82%

ODKE+: Ontology-Guided Open-Domain Knowledge Extraction with LLMs

Samira Khorshidi, Azadeh Nikfarjam, Suprita Shankar, Yisi Sang, Yash Govind, Hyun Jang, Ali Kasgari, Alexis McClimans, Mohamed Soliman, Vishnu Konda, Ahmed Fakhry, Xiaoguang Qi

机构 * Apple Inc(苹果公司)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16490 2025-07-30 cs.CL cs.CY cs.LG 82%

Exploring Knowledge Tracing in Tutor-Student Dialogues using LLMs

Alexander Scarlatos, Ryan S. Baker, Andrew Lan

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) University of Pennsylvania(宾夕法尼亚大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Published in LAK 2025: The 15th International Learning Analytics and Knowledge Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15410 2025-05-22 cs.AI cs.CL 82%

ClickSight: Interpreting Student Clickstreams to Reveal Insights on Learning Strategies via LLMs

Bahar Radmehr, Ekaterina Shved, Fatma Betül Güreş, Adish Singla, Tanja Käser

机构 * EPFL(苏黎世联邦理工学院) MPI-SWS(马克斯·普朗克研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted in Latebreaking results track in AIED 2025(26th International Conference on Artificial Intelligence in Education JULY 22-26, 2025 PALERMO, ITALY)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20000 2025-04-29 cs.CL cs.IR cs.LG 82%

Knowledge Distillation of Domain-adapted LLMs for Question-Answering in Telecom

Rishika Sen, Sujoy Roychowdhury, Sumit Soman, H. G. Ranjani, Srikhetra Mohanty

机构 * Ericsson R&D(爱立信研发)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments 10 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15545 2025-04-21 cs.LG cs.CL 82%

SciLitLLM: How to Adapt LLMs for Scientific Literature Understanding

Sihang Li, Jin Huang, Jiaxi Zhuang, Yaorui Shi, Xiaochen Cai, Mingjun Xu, Xiang Wang, Linfeng Zhang, Guolin Ke, Hengxing Cai

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06465 2025-04-11 cs.CL cs.AI 82%

MedCT: A Clinical Terminology Graph for Generative AI Applications in Healthcare

Ye Chen, Dongdong Huang, Haoyun Xu, Cong Fu, Lin Sheng, Qingli Zhou, Yuqiang Shen, Kai Wang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Accepted into ICCS 2025 and published in Springer's LNCS Series

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01788 2025-03-24 cs.CL cs.AI cs.IR 82%

LitLLM: A Toolkit for Scientific Literature Review

Shubham Agarwal, Gaurav Sahu, Abhay Puri, Issam H. Laradji, Krishnamurthy DJ Dvijotham, Jason Stanley, Laurent Charlin, Christopher Pal

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04095 2025-02-07 cs.CL cs.AI 82%

LLMs to Support a Domain Specific Knowledge Assistant

Maria-Flavia Lovin

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏