arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12706 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12706 篇

2512.09830 2025-12-12 cs.CL cs.AI 73%

LLMs in Interpreting Legal Documents

大型语言模型在解释法律文件中的应用

Simone Corbo

机构 * Simone Corbo

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了大型语言模型在法律文件解释中的应用,探讨了其在优化法律任务中的潜力及面临的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06734 2025-12-09 cs.CL cs.AI 73%

A Patient-Doctor-NLP-System to contest inequality for less privileged

一名患者-医生-NLP系统以对抗不平等,为弱势群体服务

Subrit Dikshit, Ritu Tiwari, Priyank Jain

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PDFTEMRA通过整合模型蒸馏、频域调制等技术,为低资源语言用户提供高效、可访问的医疗NLP解决方案。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04834 2025-12-05 cs.AI cs.CL cs.IR 73%

Are LLMs Truly Multilingual? Exploring Zero-Shot Multilingual Capability of LLMs for Information Retrieval: An Italian Healthcare Use Case

LLMs真的多语言吗?探索LLMs在信息检索中的零样本多语言能力:一个意大利医疗应用案例

Vignesh Kumar Kembu, Pierandrea Morandini, Marta Bianca Maria Ranzini, Antonino Nocera

机构 * Department of Electrical, Computer and Biomedical Engineering(电气、计算机与生物医学工程系) University of Pavia(帕维亚大学) IRCCS Humanitas Research Hospital(人类itas研究医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨了开源多语言LLMs在零样本条件下处理意大利语电子健康记录信息提取的能力,发现部分模型在泛化能力上存在不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04113 2025-12-05 cs.CY cs.AI cs.HC cs.LG 73%

AI-Enabled grading with near-domain data for scaling feedback with human-level accuracy

基于近域数据的AI评阅:实现人类水平准确性的反馈扩展

Shyam Agarwal, Ali Moghimi, Kevin C. Haudek

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于近域数据的AI评阅方法,实现人类水平的准确反馈,优于现有机器学习模型和大型语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17498 2025-12-03 cs.AI cs.CL cs.NE cs.SC 73%

Mechanisms of Symbol Processing for In-Context Learning in Transformer Networks

Transformer网络中上下文学习符号处理的机制

Paul Smolensky, Roland Fernandez, Zhenghao Herbert Zhou, Mattia Opper, Adam Davies, Jianfeng Gao

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种基于生产系统语言PSL的转换器架构,用于提升转换器在符号处理中的能力,展示了其在抽象符号任务中的应用和图灵通用性。

Journal ref Journal of Artificial Intelligence Research, 84(23) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10674 2025-12-01 cs.CL cs.AI cs.DB 73%

Continual Learning of Domain Knowledge from Human Feedback in Text-to-SQL

从人类反馈中持续学习领域知识的文本到SQL

Thomas Cook, Kelly Patel, Sivapriya Vellaichamy, Udari Madhushani Sehwag, Saba Rahimi, Zhen Zeng, Sumitra Ganesh

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种通过人类反馈持续学习领域知识的文本到SQL框架,通过记忆增强的代理提升查询准确性与错误减少。

Comments 34 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21757 2025-12-01 cs.CY cs.AI cs.CL cs.CR 73%

Medical Malice: A Dataset for Context-Aware Safety in Healthcare LLMs

医疗恶意:用于医疗LLM中情境感知安全的数据库

Andrew Maranhão Ventura D'addario

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 Medical Malice提出一个情境感知安全的医疗数据库,通过对抗性提示和伦理推理提升医疗LLM的安全性,以应对医疗领域复杂且系统性的威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10157 2025-12-01 cs.AI cs.CL 73%

One Patient, Many Contexts: Scaling Medical AI with Contextual Intelligence

一个患者,许多情境:通过情境智能扩展医疗AI

Michelle M. Li, Ben Y. Reis, Adam Rodman, Tianxi Cai, Noa Dagan, Ran D. Balicer, Joseph Loscalzo, Isaac S. Kohane, Marinka Zitnik

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出情境切换技术,通过调整模型推理而非重新训练,使医疗AI能适应不同专科、人群和地理环境,提升其在现实护理中的可靠性和扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20653 2025-11-27 cs.HC cs.AI cs.LG 73%

Domain-Grounded Evaluation of LLMs in International Student Knowledge

领域导向的LLM国际学生知识评估

Claudinei Daitx, Haitham Amar

机构 * ApplyBoard Inc(ApplyBoard公司)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文通过领域导向评估,分析LLM在留学咨询中的准确性与幻觉问题,提供评估协议以提升教育领域LLM的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17681 2025-11-26 cs.LG cs.AI 73%

Unlearning as Ablation: Toward a Falsifiable Benchmark for Generative Scientific Discovery

反例作为消去:面向生成科学发现的可证伪基准

Robert Yang

机构 * S6 Research(S6研究)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出'反例作为消去'作为可证伪基准,旨在检验AI在科学发现中的生成能力,通过系统移除目标结果并评估模型能否重新推导,推动AI-科学的基准发展。

Comments 6 pages + appendix. Accepted to NeurIPS 2025 AI4Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18319 2025-11-25 cs.AI cs.LG cs.SY eess.SY 73%

Weakly-supervised Latent Models for Task-specific Visual-Language Control

弱监督潜在模型用于任务特定的视觉语言控制

Xian Yeow Lee, Lasitha Vidyaratne, Gregory Sin, Ahmed Farahat, Chetan Gupta

机构 * Industrial AI Lab, Hitachi America, Ltd.(日立美国有限公司工业人工智能实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种任务特定的潜在动态模型,利用目标状态监督学习动作诱导位移,以提高空间定位任务中的视觉语言控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18295 2025-11-25 cs.SD cs.AI cs.CL eess.AS 73%

H-PRM: A Pluggable Hotword Pre-Retrieval Module for Various Speech Recognition Systems

H-PRM:一种适用于各种语音识别系统的可插拔热门词预检索模块

Huangyu Dai, Lingtao Mao, Ben Chen, Zihan Wang, Zihan Liang, Ying Han, Chenyi Lei, Han Li

机构 * Zhejiang Gongshang University(浙江工商大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 H-PRM通过声学相似性测量提升语音识别系统中热门词的召回率,适用于传统模型和音频大语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14227 2025-11-19 cs.AI cs.LG 73%

DevPiolt: Operation Recommendation for IoT Devices at Xiaomi Home

Yuxiang Wang, Siwen Wang, Haowei Han, Ao Wang, Boya Liu, Yong Zhao, Chengbo Wu, Bin Zhu, Bin Qin, Xiaokai Zhou, Xiao Yan, Jiawei Jiang, Bo Du

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 领域大模型 :LLM(abstract);preference optimization(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11883 2025-11-18 cs.CL cs.LG 73%

ClinStructor: AI-Powered Structuring of Unstructured Clinical Texts

Karthikeyan K, Raghuveer Thirukovalluru, David Carlson

机构 * Duke University(杜克大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05901 2025-11-14 cs.CL cs.AI 73%

Retrieval-Augmented Generation in Medicine: A Scoping Review of Technical Implementations, Clinical Applications, and Ethical Considerations

Rui Yang, Matthew Yu Heng Wong, Huitao Li, Xin Li, Wentao Zhu, Jingchi Liao, Kunyu Yu, Jonathan Chong Kai Liew, Weihao Xuan, Yingjian Chen, Yuhe Ke, Jasmine Chiat Ling Ong, Douglas Teodoro, Chuan Hong, Daniel Shi Wei Ting, Nan Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15568 2025-11-12 cs.LG cs.AI 73%

A Cautionary Tale About "Neutrally" Informative AI Tools Ahead of the 2025 Federal Elections in Germany

Ina Dormuth, Sven Franke, Marlies Hafer, Tim Katzke, Alexander Marx, Emmanuel Müller, Daniel Neider, Markus Pauly, Jérôme Rutinowski

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref Explainable Artificial Intelligence (xAI 2025). Communications in Computer and Information Science, vol. 2580, pp. 64-85. Springer, Cham (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05968 2025-11-11 cs.CV cs.AI cs.LG 73%

DiA-gnostic VLVAE: Disentangled Alignment-Constrained Vision Language Variational AutoEncoder for Robust Radiology Reporting with Missing Modalities

Nagur Shareef Shaik, Teja Krishna Cherukuri, Adnan Masood, Dong Hye Ye

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for Oral Presentation at the 40th AAAI Conference on Artificial Intelligence (AAAI-26), Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04255 2025-11-07 cs.CV cs.AI cs.LG 73%

MedSapiens: Taking a Pose to Rethink Medical Imaging Landmark Detection

Marawan Elbatel, Anbang Wang, Keyuan Liu, Kaouther Mouheb, Enrique Almar-Munoz, Lizhuo Lin, Yanqi Yang, Karim Lekadir, Xiaomeng Li

机构 * The Hong Kong University of Science and Technology(香港科技大学) The University of Hong Kong(香港大学) Erasmus MC(埃因霍温麦斯学院) Medical University of Innsbruck(因斯布鲁克医科大学) University of Barcelona(巴塞罗那大学)

专题命中 领域大模型 :foundation model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20368 2025-11-07 cs.IR cs.AI cs.CL 73%

Hierarchical Retrieval with Evidence Curation for Open-Domain Financial Question Answering on Standardized Documents

Jaeyoung Choe, Jihoon Kim, Woohwan Jung

机构 * Department of Applied Artificial Intelligence, Hanyang University(应用人工智能系,翰阳大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03542 2025-11-06 cs.CL cs.AI 73%

SOLVE-Med: Specialized Orchestration for Leading Vertical Experts across Medical Specialties

Roberta Di Marino, Giovanni Dioguardi, Antonio Romano, Giuseppe Riccio, Mariano Barone, Marco Postiglione, Flora Amato, Vincenzo Moscato

机构 * University of Naples Federico II, DIETI, Naples, Italy(那不勒斯费德里科二世大学,DIETI,那不勒斯,意大利) Northwestern University, Department of Computer Science, Evanston, IL, United States(西北大学,计算机科学系,伊利诺伊州埃文斯顿,美国)

专题命中 领域大模型 :language model(abstract);small language model(abstract);分类 cs.CL、cs.AI

Journal ref 28th European Conference on Artificial Intelligence, 25-30 October 2025, Bologna, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03498 2025-11-06 cs.CL cs.LG 73%

BanglaSTEM: A Parallel Corpus for Technical Domain Bangla-English Translation

Kazi Reyazul Hasan, Mubasshira Musarrat, A. B. M. Alim Al Islam, Muhammad Abdullah Adnan

机构 * Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00985 2025-11-05 cs.DB cs.AI cs.CL 73%

ORANGE: An Online Reflection ANd GEneration framework with Domain Knowledge for Text-to-SQL

Yiwen Jiao, Tonghui Ren, Yuche Gao, Zhenying He, Yinan Jing, Kai Zhang, X. Sean Wang

机构 * Fudan University(复旦大学) Tencent Cloud(腾讯云) University of Cambridge(剑桥大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 4 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23104 2025-11-05 cs.CL cs.AI cs.IR 73%

Leveraging Hierarchical Organization for Medical Multi-document Summarization

Yi-Li Hsu, Katelyn X. Mei, Lucy Lu Wang

机构 * National Tsing Hua University(清华大学) University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09586 2025-11-05 cs.HC cs.AI cs.CL 73%

ValueCompass: A Framework for Measuring Contextual Value Alignment Between Human and LLMs

Hua Shen, Tiffany Knearem, Reshmi Ghosh, Yu-Ju Yang, Nicholas Clark, Tanushree Mitra, Yun Huang

机构 * NYU Shanghai(纽约大学上海校区) New York University(纽约大学) University of Washington(华盛顿大学) MBZUAI Microsoft(微软) UIUC(伊利诺伊大学香槟分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01386 2025-11-04 cs.CL cs.AI cs.IR 73%

RAGSmith: A Framework for Finding the Optimal Composition of Retrieval-Augmented Generation Methods Across Datasets

Muhammed Yusuf Kartal, Suha Kagan Kose, Korhan Sevinç, Burak Aktas

机构 * TOBB University of Economics and Technology(托布卡大学经济与技术学院) Roketsan Inc.(罗克特兰公司)

专题命中 领域大模型 :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 45 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26974 2025-11-03 cs.CL cs.AI 73%

Overview of the MEDIQA-OE 2025 Shared Task on Medical Order Extraction from Doctor-Patient Consultations

Jean-Philippe Corbeil, Asma Ben Abacha, Jerome Tremblay, Phillip Swazinna, Akila Jeeson Daniel, Miguel Del-Agua, Francois Beaulieu

机构 * Microsoft Healthcare & Life Sciences(微软医疗与生命科学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26402 2025-10-31 cs.AI cs.LG 73%

Autograder+: A Multi-Faceted AI Framework for Rich Pedagogical Feedback in Programming Education

Vikrant Sahu, Gagan Raj Gupta, Raghav Borikar, Nitin Mane

机构 * Indian Institute of Technology(印度理工学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25016 2025-10-30 cs.SE cs.AI cs.HC cs.LG 73%

Towards Human-AI Synergy in Requirements Engineering: A Framework and Preliminary Study

Mateen Ahmed Abbasi, Petri Ihantola, Tommi Mikkonen, Niko Mäkitalo

机构 * Faculty of Information Technology, University of Jyväskylä(信息技术学院,于韦斯屈耶大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at the 2025 Sixth International Conference on Intelligent Data Science Technologies and Applications (IDSTA 2025),8 pages, 4 figures. Published in IEEE

Journal ref 2025 Sixth International Conference on Intelligent Data Science Technologies and Applications (IDSTA 2025), IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24677 2025-10-29 cs.CL cs.AI 73%

Dissecting Role Cognition in Medical LLMs via Neuronal Ablation

Xun Liang, Huayi Lai, Hanyu Wang, Wentao Zhang, Linfeng Zhang, Yanfang Chen, Feiyu Xiong, Zhiyu Li

机构 * School of Information, Renmin University of China(中国人民大学信息学院) Center of Machine Learning Research, Peking University(北京大学机器学习研究中心) School of Artificial Intelligence, Shanghai Jiaotong University(上海交通大学人工智能学院) Health Informatics Committee of the China Society for Scientific and Technical Information, Renmin University of China(中国科学技术信息学会健康信息技术委员会,中国人民大学) Institute for Advanced Algorithms Research (IAAR), Shanghai, China(先进算法研究所(IAAR),上海,中国) Memtensor Research Center, Shanghai, China(Memtensor研究中心,上海,中国)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17873 2025-10-28 cs.CL cs.AI cs.CE 73%

MOOSE-Chem3: Toward Experiment-Guided Hypothesis Ranking via Simulated Experimental Feedback

Wanhao Liu, Zonglin Yang, Jue Wang, Lidong Bing, Di Zhang, Dongzhan Zhou, Yuqiang Li, Houqiang Li, Erik Cambria, Wanli Ouyang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学) MiroMind

专题命中 领域大模型 :LLM(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏