arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2512.02593 2026-03-10 cs.CL cs.MA cs.NE cs.SD eess.AS 84%

Spoken Conversational Agents with Large Language Models

基于大语言模型的语音对话代理

Chao-Han Huck Yang, Andreas Stolcke, Larry Heck

机构 * NVIDIA Research(NVIDIA研究)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

AI总结 本文探讨了如何通过大语言模型构建语音对话代理,涵盖从级联到端到端系统的路径,以及跨模态对齐和联合训练等关键技术,同时讨论了隐私、安全和评估中的开放问题。

Comments Accepted to EMNLP 2025 Tutorial

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21281 2026-03-05 cs.AI 84%

RLJP: Legal Judgment Prediction via First-Order Logic Rule-enhanced with Large Language Models

通过一阶逻辑规则增强的大语言模型进行法律判决预测

Yue Zhang, Zhiliang Tian, Shicheng Zhou, Haiyang Wang, Wenqing Hou, Yuying Liu, Xuechen Zhao, Minlie Huang, Ye Wang, Bin Zhou

机构 * College of Computer Science and Technology, National University of Defense and Technology(国防科技大学计算机科学与技术学院) College of Electronic Engineering, National University of Defense Technology(国防科技大学电子工程学院) School of Data and Computer Science, Shandong Women’s University(山东女子大学数据与计算机科学学院) Institute for Artificial Intelligence, Tsinghua University(清华大学人工智能研究院)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

AI总结 本文提出基于一阶逻辑和对比学习的规则增强方法,通过三阶段流程提升法律判决预测的适应性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18060 2026-02-19 cs.CL 84%

Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions

在回答和解释具有挑战性的医疗问题上评估大型语言模型

Hanjie Chen, Zhouxiang Fang, Yash Singla, Mark Dredze

机构 * Rice University(里士满大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

AI总结 本文提出两个新数据集用于评估大型语言模型在回答和解释具有挑战性的医疗问题上的能力,并通过实验展示了这些数据集的难度及模型表现。

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15951 2026-02-19 astro-ph.CO cs.LG 84%

MadEvolve: Evolutionary Optimization of Cosmological Algorithms with Large Language Models

MadEvolve:利用大语言模型进行宇宙学算法的进化优化

Tianyi Li, Shihui Zang, Moritz Münchmeyer

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.LG

AI总结 MadEvolve利用大语言模型优化宇宙学算法,通过进化方法提升计算性能并公开相关任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10740 2026-02-12 cs.CL 84%

Reinforced Curriculum Pre-Alignment for Domain-Adaptive VLMs

强化课程预对齐用于领域自适应视觉-语言模型

Yuming Yan, Shuo Yang, Kai Tang, Sihong Chen, Yang Zhang, Ke Xu, Dan Hu, Qun Yu, Pengfei Hu, Edith C. H. Ngai

机构 * Tencent(腾讯)

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);post-training(abstract)

AI总结 本文提出RCPA方法,通过课程意识的渐进调节机制,在领域自适应中平衡领域知识获取与通用能力保持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01479 2026-02-03 cs.CL 84%

Ebisu: Benchmarking Large Language Models in Japanese Finance

Ebisu:日本金融领域大语言模型基准测试

Xueqing Peng, Ruoyu Xiang, Fan Zhang, Mingzi Song, Mingyang Jiang, Yan Wang, Lingfei Qian, Taiki Hara, Yuqing Guo, Jimin Huang, Junichi Tsujii, Sophia Ananiadou

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

AI总结 Ebisu通过两个专家标注任务评估日本金融语言理解,揭示了现有LLMs在处理隐含承诺和嵌套金融术语时的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24314 2026-01-21 cs.CL 84%

QianfanHuijin Technical Report: A Novel Multi-Stage Training Paradigm for Finance Industrial LLMs

千帆辉金技术报告:面向金融工业大模型的新型多阶段训练范式

Shupeng Li, Weipeng Lu, Linyun Liu, Chen Lin, Shaofei Li, Zhendong Tan, Hanjun Zhong, Yucheng Zeng, Chenghao Zhu, Mengyue Liu, Daxiang Dong, Jianmin Wu, Yunting Xiao, Annan Li, Danyu Liu, Jingnan Zhang, Licen Liu, Dawei Yin, Dou Shen

机构 * Qianfan Team Baidu AI Cloud(百度AI云团队)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 千帆辉金提出一种面向金融工业大模型的新型多阶段训练范式,通过持续预训练和细粒度后训练流程提升模型的金融推理与代理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13246 2026-01-19 cs.CL cs.CY 84%

When People are Floods: Analyzing Dehumanizing Metaphors in Immigration Discourse with Large Language Models

当人们是洪水:利用大型语言模型分析移民话语中的去人性化隐喻

Julia Mendelsohn, Ceren Budak

机构 * University of Maryland(马里兰大学) University of Michigan(密歇根大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

AI总结 本文利用大型语言模型分析移民话语中的去人性化隐喻,探讨隐喻、政治意识形态与用户参与之间的关系。

Comments To appear at ACL 2025. Please cite ACL version when proceedings are available

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (2025) 8079-8103

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03436 2026-01-08 astro-ph.IM cs.AI 84%

MARVEL: A Multi Agent-based Research Validator and Enabler using Large Language Models

MARVEL:基于大语言模型的多智能体研究验证器与促进器

Nikhil Mukund, Yifang Luo, Fan Zhang, Lisa Barsotti, Erik Katsavounidis

机构 * MIT Kavli Institute for Astrophysics and Space Research and LIGO Laboratory(麻省理工学院凯斯利天文与空间研究所及LIGO实验室) Massachusetts Institute of Technology(麻省理工学院) State Key Laboratory of Ocean Sensing & Ocean College(海洋传感国家重点实验室) Zhejiang University(浙江大学) NSF AI Institute for Artificial Intelligence and Fundamental Interactions (IAIFI)(国家科学基金会人工智能与基本相互作用研究所) Cambridge, MA, USA(美国马萨诸塞州剑桥市)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

AI总结 MARVEL通过结合快速查询路径和深度搜索模式,为科学领域提供可部署的验证器,其在探测器操作内容上显著优于GPT-4o基线。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10044 2025-12-02 cs.CR cs.AI 84%

Large Language Models for Power System Security: A Novel Multi-Modal Approach for Anomaly Detection in Energy Management Systems

用于电力系统安全的大型语言模型:一种用于能源管理系统异常检测的新型多模态方法

Aydin Zaboli, Junho Hong, Alexandru Stefanov, Chen-Ching Liu, Chul-Sang Hwang

机构 * Department of Electrical and Computer Engineering, University of Michigan -- Dearborn, MI, 48128 USA.(电气与计算机工程系,密歇根大学迪尔伯恩分校) Department of Electrical Sustainable Energy, Technische Universiteit Delft, 2628 CD Delft, Netherlands.(可持续能源系,代尔夫特理工大学) Bradley Department of Electrical and Computer Engineering, Virginia Polytechnic Institute and State University, Blacksburg, VA 24061, USA.(布雷德利电气与计算机工程系,弗吉尼亚理工学院和州立大学) Smart Grid Research Division System Reliability Research Team, Korea Electrotechnology Research Institute (KERI), Gwangju-si, 61751, South Korea.(智能电网研究分会系统可靠性研究团队,韩国电力技术研究所(KERI))

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

AI总结 本文提出了一种基于大型语言模型的多模态方法,用于电力系统中能源管理系统的安全防护和异常检测。

Comments 10 Figures; 6 Tables; Accepted, IEEE ACCESS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24119 2025-11-10 cs.SE cs.AI 84%

Leveraging Large Language Models for Code Translation and Software Development in Scientific Computing

Akash Dhruv, Anshu Dubey

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克琴特研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) Argonne National Laboratory(阿贡国家实验室)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04278 2025-08-07 cs.AI 84%

Large Language Model's Multi-Capability Alignment in Biomedical Domain

Wentao Wu, Linqing Chen, Hanmeng Zhong, Weilei Wang

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14162 2025-05-19 cs.AI 84%

EIAD: Explainable Industrial Anomaly Detection Via Multi-Modal Large Language Models

Zongyun Zhang, Jiacheng Ruan, Xian Gao, Ting Liu, Yuzhuo Fu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

Comments Accepted by ICME2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16406 2025-03-04 cs.CL 84%

From RAGs to riches: Utilizing large language models to write documents for clinical trials

Nigel Markey, Ilyass El-Mansouri, Gaetan Rensonnet, Casper van Langen, Christoph Meier

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

Comments 6 pages, 2 figures

Journal ref Clinical Trials: Journal of the Society for Clinical Trials (2025) -- online ahead of print

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05615 2025-02-11 cs.CV cs.AI 84%

XiHeFusion: Harnessing Large Language Models for Science Communication in Nuclear Fusion

Xiao Wang, Qingquan Yang, Fuling Wang, Qiang Chen, Wentao Wu, Yu Jin, Jingtao Jiang, Liye Jin, Bo Jiang, Dengdi Sun, Wanli Lv, Meiwen Chen, Zehua Chen, Guosheng Xu, Jin Tang

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08974 2025-01-16 cs.CL 84%

Learning to Extract Cross-Domain Aspects and Understanding Sentiments Using Large Language Models

Karukriti Kaushik Ghosh, Chiranjib Sur

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07191 2025-01-14 eess.SY cs.LG cs.SY 84%

Pre-Trained Large Language Model Based Remaining Useful Life Transfer Prediction of Bearing

Laifa Tao, Zhengduo Zhao, Xuesong Wang, Bin Li, Wenchao Zhan, Xuanyuan Su, Shangyu Li, Qixuan Huang, Haifei Liu, Chen Lu, Zhixuan Lian

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02346 2025-01-07 physics.med-ph cs.AI 84%

Exploring the Capabilities and Limitations of Large Language Models for Radiation Oncology Decision Support

Florian Putz, Marlen Haderleina, Sebastian Lettmaier, Sabine Semrau, Rainer Fietkau, Yixing Huang

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

Comments Officially published in the Red Journal

Journal ref International Journal of Radiation Oncology, Biology, Physics. 2024 Mar 15;118(4):900-4

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05533 2024-12-10 cs.LG cs.CR 84%

Can large language models be privacy preserving and fair medical coders?

Ali Dadsetan, Dorsa Soleymani, Xijie Zeng, Frank Rudzicz

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00175 2024-05-02 cs.CL cs.IR 84%

Towards a Search Engine for Machines: Unified Ranking for Multiple Retrieval-Augmented Large Language Models

Alireza Salemi, Hamed Zamani

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.16416 2024-01-26 cs.CL 84%

Improving Large Language Models for Clinical Named Entity Recognition via Prompt Engineering

Yan Hu, Qingyu Chen, Jingcheng Du, Xueqing Peng, Vipina Kuttichi Keloth, Xu Zuo, Yujia Zhou, Zehan Li, Xiaoqian Jiang, Zhiyong Lu, Kirk Roberts, Hua Xu

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

Comments 17 pages, 5 tables, 6 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01040 2024-01-09 cs.CL 84%

From Beginner to Expert: Modeling Medical Knowledge into General LLMs

Qiang Li, Xiaoyan Yang, Haowen Wang, Qin Wang, Lei Liu, Junjie Wang, Yang Zhang, Mingyuan Chu, Sen Hu, Yicheng Chen, Yue Shen, Cong Fan, Wangshu Zhang, Teng Xu, Jinjie Gu, Jing Zheng, Guannan Zhang Ant Group

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Developed by Ant Group for PubMedQA leaderboard

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02034 2024-01-05 cs.CL 84%

Text2MDT: Extracting Medical Decision Trees from Medical Texts

Wei Zhu, Wenfeng Li, Xing Tian, Pengfei Wang, Xiaoling Wang, Jin Chen, Yuanbin Wu, Yuan Ni, Guotong Xie

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11811 2023-11-21 cs.AI 84%

Large Language Models and Explainable Law: a Hybrid Methodology

Marco Billi, Alessandro Parenti, Giuseppe Pisano, Marco Sanchi

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07197 2023-11-03 cond-mat.mtrl-sci cs.AI 84%

MatChat: A Large Language Model and Application Service Platform for Materials Science

Ziyi Chen, Fankai Xie, Meng Wan, Yang Yuan, Miao Liu, Zongguo Wang, Sheng Meng, Yangang Wang

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

Journal ref Chinese Physics B 32, 118104 (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.17050 2023-10-02 cs.CL 84%

Interpretable Long-Form Legal Question Answering with Retrieval-Augmented Large Language Models

Antoine Louis, Gijs van Dijck, Gerasimos Spanakis

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

Comments Under review. Code is available at https://github.com/maastrichtlawtech/lleqa

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14522 2023-08-02 cs.CL 84%

CliniDigest: A Case Study in Large Language Model Based Large-Scale Summarization of Clinical Trial Descriptions

Renee D. White, Tristan Peng, Pann Sripitak, Alexander Rosenberg Johansen, Michael Snyder

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

Comments 7 pages, 3 figures, 3 tables, conference: ACM GoodIt 23'; Second co-author: Tristan Peng; Citation: White, Peng, et al

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10250 2023-07-21 cs.AI 84%

Abductive Reasoning with the GPT-4 Language Model: Case studies from criminal investigation, medical practice, scientific research

Remo Pareschi

专题命中 领域大模型 :language model(title,abstract);large language model(abstract,comments);分类 cs.AI

Comments The article is 12 pages long and has one figure. It also includes a link to some ChatGPT dialogues that show the experiments that support the article's findings. The article will be published in V. Bambini and C. Barattieri di San Pietro (eds.), Sistemi Intelligenti, Special Section "Multidisciplinary perspectives on ChatGPT and the family of Large Language Models"

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12135 2023-07-20 cs.CL 84%

Understand Legal Documents with Contextualized Large Language Models

Xin Jin, Yuchen Wang

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

Comments SemEval 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20661 2026-08-24 cs.AI cs.CE cs.CL cs.IR 新提交 84%

Auditable by Construction: An Ontology-Driven Framework for Trustworthy LLM Analytics in Enterprise Finance

可审计性原生:面向企业金融领域可信大语言模型分析的本体驱动框架

Sergiy Lunyakin

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文针对企业金融大语言模型应用的信任问题,提出知识驱动分析框架KDAF,结合本体与CARP技术,在FinanceBench评估中,其可审计性优于基线方法,表明可审计性是该框架的核心优势。

Comments 20 pages, 1 figure, 4 tables, 1 algorithm. Artifact deposit with configurations, ontology schema, prompts, audit reports and reconstruction scripts: this https URL (https://doi.org/10.5281/zenodo.22022068)

详情

展开后加载摘要…

URL PDF HTML 收藏