arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2406.14882 2024-06-24 cs.CL 90%

70B-parameter large language models in Japanese medical question-answering

Issey Sukeda, Risa Kishikawa, Satoshi Kodera

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);pretraining(abstract)

Comments 7 pages, 2 figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14212 2024-05-24 cs.CR cs.CL 90%

Federated Domain-Specific Knowledge Transfer on Large Language Models Using Synthetic Data

Haoran Li, Xinyuan Zhao, Dadi Guo, Hanlin Gu, Ziqian Zeng, Yuxing Han, Yangqiu Song, Lixin Fan, Qiang Yang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11040 2024-05-21 cs.CL physics.med-ph 90%

From Generalist to Specialist: Improving Large Language Models for Medical Physics Using ARCoT

Jace Grandinetti, Rafe McBeth

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 8 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00566 2024-05-02 cs.CE cs.CL q-fin.GN 90%

NumLLM: Numeric-Sensitive Large Language Model for Chinese Finance

Huan-Yi Su, Ke Wu, Yu-Hao Huang, Wu-Jun Li

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14310 2024-03-26 cs.CL 90%

Navigating Prompt Complexity for Zero-Shot Classification: A Study of Large Language Models in Computational Social Science

Yida Mu, Ben P. Wu, William Thorne, Ambrose Robinson, Nikolaos Aletras, Carolina Scarton, Kalina Bontcheva, Xingyi Song

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);prompting(abstract)

Comments Accepted at LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15818 2024-02-27 cs.CL 90%

Linguistic Intelligence in Large Language Models for Telecommunications

Tasnim Ahmed, Nicola Piovesan, Antonio De Domenico, Salimur Choudhury

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08859 2024-02-15 cs.AI 90%

Large Language Model with Graph Convolution for Recommendation

Yingpeng Du, Ziyan Wang, Zhu Sun, Haoyan Chua, Hongzhi Liu, Zhonghai Wu, Yining Ma, Jie Zhang, Youchen Sun

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07658 2024-02-13 cs.CL cs.SD eess.AS 90%

The Sound of Healthcare: Improving Medical Transcription ASR Accuracy with Large Language Models

Ayo Adedeji, Sarita Joshi, Brendan Doohan

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 31 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07016 2024-02-13 cs.AI 90%

REALM: RAG-Driven Enhancement of Multimodal Electronic Health Records Analysis via Large Language Models

Yinghao Zhu, Changyu Ren, Shiyun Xie, Shukai Liu, Hangyuan Ji, Zixiang Wang, Tao Sun, Long He, Zhoujun Li, Xi Zhu, Chengwei Pan

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05129 2024-02-09 cs.CL 90%

Best Practices for Text Annotation with Large Language Models

Petter Törnberg

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07102 2024-01-17 cs.NE cs.AI 90%

Evolving Code with A Large Language Model

Erik Hemberg, Stephen Moskal, Una-May O'Reilly

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 34 pages, 9 figures, 6 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13059 2023-12-21 cs.CY cs.AI cs.HC 90%

Beyond Traditional Teaching: The Potential of Large Language Models and Chatbots in Graduate Engineering Education

Mahyar Abedi, Ibrahem Alshybani, Muhammad Rubayat Bin Shahadat, Michael S. Murillo

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 45 pages, 18 figures, preprint for PLOS ONE

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01430 2023-08-04 cs.CL 90%

FinVis-GPT: A Multimodal Large Language Model for Financial Chart Analysis

Ziao Wang, Yuhang Li, Junda Wu, Jaehyeon Soon, Xiaofeng Zhang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments (FinLLM 2023)@IJCAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.01146 2023-07-21 cs.CL 90%

RadAdapt: Radiology Report Summarization via Lightweight Domain Adaptation of Large Language Models

Dave Van Veen, Cara Van Uden, Maayane Attias, Anuj Pareek, Christian Bluethgen, Malgorzata Polacin, Wah Chiu, Jean-Benoit Delbrouck, Juan Manuel Zambrano Chaves, Curtis P. Langlotz, Akshay S. Chaudhari, John Pauly

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);prompting(abstract)

Comments 12 pages, 10 figures. Published in ACL BioNLP. Compared to v1, v2 includes minor edits and one additional figure in the appendix. Compared to v2, v3 includes a link to the project's GitHub repository

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02907 2023-06-06 cs.CL cs.SE 90%

SelfEvolve: A Code Evolution Framework via Large Language Models

Shuyang Jiang, Yuhao Wang, Yu Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17367 2023-05-30 cs.CL 90%

Augmenting Large Language Model Translators via Translation Memories

Yongyu Mu, Abudurexiti Reheman, Zhiquan Cao, Yuchun Fan, Bei Li, Yinqiao Li, Tong Xiao, Chunliang Zhang, Jingbo Zhu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.13138 2022-12-27 cs.CL 90%

Large Language Models Encode Clinical Knowledge

Karan Singhal, Shekoofeh Azizi, Tao Tu, S. Sara Mahdavi, Jason Wei, Hyung Won Chung, Nathan Scales, Ajay Tanwani, Heather Cole-Lewis, Stephen Pfohl, Perry Payne, Martin Seneviratne, Paul Gamble, Chris Kelly, Nathaneal Scharli, Aakanksha Chowdhery, Philip Mansfield, Blaise Aguera y Arcas, Dale Webster, Greg S. Corrado, Yossi Matias, Katherine Chou, Juraj Gottweis, Nenad Tomasev, Yun Liu, Alvin Rajkomar, Joelle Barral, Christopher Semturs, Alan Karthikesalingam, Vivek Natarajan

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29668 2026-08-24 cs.AI cs.CL 版本更新 90%

GRASP: Gated Regression-Aware Skill Proposer for Self-Improving LLM Agents

GRASP: 门控回归感知技能提议器用于自我改进的LLM智能体

Johannes Moll, Jean-Philippe Corbeil, Jiazhen Pan, Martin Hadamitzky, Daniel Rueckert, Lisa Adams, Keno Bressem

机构 * Technical University of Munich and TUM University Hospital(慕尼黑技术大学及慕尼黑大学医院) Microsoft Healthcare & Life Sciences(微软医疗与生命科学)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出GRASP方法,通过门控回归感知技能库编辑,在硬回归预算下确保每次技能更新带来净改进,显著提升LLM智能体在结构化环境中的操作可靠性。

Comments Accepted at EMNLP 2026 (Main Conference). Code and data: this https URL (https://github.com/jomoll/GRASP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01050 2026-08-04 cs.AI cs.CL cs.SE 新提交 90%

Don't Offer What Can't Be Done: Deterministic Executability Gating for LLM Skill Selection at Scale

不要提供无法完成的任务:面向大规模LLM技能选择的确定性可执行性门控机制

Ortal Ashkenazi, Vitalii Kloz, Mykhailo Ulianchenko

机构 * Wix Israel(Wix以色列) Wix Ukraine(Wix乌克兰)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 该研究针对大规模LLM技能选择中不可执行技能的干扰问题,提出三阶段选择流水线,经生产分析和反事实测试,可大幅减少技能描述上下文并阻止不可执行技能影响模型选择。

Comments 7 pages, 3 figures. Preprint. Submitted to the ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2027), Applied Data Science Track; currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25718 2026-07-30 cs.LG cs.AI cs.IR 版本更新 90%

Tools Are Not Islands: Set-Level Tool Retrieval for LLM Agents via Query-Conditioned Hyperedge Prediction

工具并非孤岛:通过查询条件超边预测为语言模型智能体进行集合级工具检索

Xinyi Hong, Pinjun Dong, Xinyang Yu, Binyan Jiang

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究LLM智能体的工具检索问题,提出HYSET方法,将其表述为查询条件超边预测,通过特定基数交互捕捉工具兼容性,设计为预选择模块,实验证明该方法在工具检索性能及任务成功率上优于基线,还支持零样本/少样本迁移。

Comments 9 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05132 2026-07-28 cs.CL cs.AI 版本更新 90%

PrinciplismQA: A Philosophy-Grounded Approach to Assessing LLM-Human Clinical Medical Ethics Alignment

PrinciplismQA: 一种基于哲学的评估LLM与人类临床医学伦理对齐的方法

Chang Hong, Minghao Wu, Qingying Xiao, Yuchi Wang, Xiang Wan, Guangjun Yu, Benyou Wang, Yan Hu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) National Health Data Institute, Shenzhen(深圳国家健康数据研究院) Shenzhen Research Institute of Big Data(深圳大数据研究院)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 本文提出PrinciplismQA,一种基于哲学框架的评估方法,用于评估LLM在临床医学伦理上的对齐情况,通过专家验证的问题集揭示模型在伦理推理上的不足。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10576 2026-07-28 cs.LG cs.AI 版本更新 90%

LLM-Based Scientific Equation Discovery via Physics-Informed Token-Regularized Policy Optimization

基于大语言模型的科学方程发现:通过物理引导的令牌正则化策略优化

Boxiao Wang, Kai Li, Tianyi Liu, Chen Li, Junzhe Wang, Yifan Zhang, Jian Cheng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) State Key Laboratory of Aerodynamics(航空动力国家重点实验室) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院)

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出PiT-PO框架,通过强化学习使LLM成为适应性生成器,生成科学一致且结构简洁的方程,提升科学发现性能。

Comments Accepted at KDD 2026. Code is available at https://github.com/CAS-CLab/PiT-PO

Journal ref Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining, Vol. 2, pp. 12195-12206, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21134 2026-07-28 cs.CL cs.CY cs.LG 版本更新 90%

TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law

TRIDENT:评估金融、医学和法律领域大语言模型的安全性

Zheng Hui, Yijiang River Dong, Ehsan Shareghi, Nigel Collier

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 研究针对大语言模型在金融、医学和法律领域的安全评估问题,基于相关伦理准则定义安全原则并引入Trident-Bench基准进行评估,揭示了不同模型的安全差距,为LLM安全研究提供了系统资源和研究基础。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01585 2026-07-03 cs.LO cs.AI cs.CL 新提交 90%

ADVENT: LLM-Driven Automatic Predicate Invention for ILP

ADVENT: 基于LLM的归纳逻辑编程自动谓词发明

Tingting Yu, Pei-Cing Huang, Chan Hsu, Chan-Tung Ku, Yihuang Kang

机构 * Department of Information Management(信息管理系) National Sun Yat-Sen University(国立成功大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出ADVENT机制,利用大语言模型生成候选谓词并通过Prolog验证迭代优化,实现自动谓词发明,在扑克牌数据集上显著提升ILP成功率并支持跨任务知识复用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20702 2026-06-23 cs.CV cs.AI cs.LG 新提交 90%

Beyond Templates: Revisiting Zero-Shot Remote Sensing through Meta-Prompting

超越模板:通过元提示重新审视零样本遥感

Eirini Baltzi, Dionysis Christopoulos, Sotiris Spanos, Valsamis Ntouskos, Konstantinos Karantzalos

机构 * Remote Sensing Lab, National Technical University of Athens(遥感实验室,国家技术大学雅典分校) Remote Sensing Lab, Department of Engineering and Sciences, National Technical University of Athens(遥感实验室,工程与科学系,国家技术大学雅典分校) Universitas Mercatorum(默卡托大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);prompting(title,abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究通过元提示框架(MPVR)在17种视觉语言模型和12个遥感数据集上探索零样本性能,发现语义丰富的LLM生成描述可能引入噪声,而轻量级查询嵌入校准能稳定提升分类和检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17461 2026-06-17 cs.AR cs.AI cs.LG 新提交 90%

AUTOGATE: Automated Clock Gating via Toggling-Aware LLM-based RTL Rewriting

AUTOGATE:基于翻转感知的LLM驱动RTL重写的自动时钟门控

Yiting Wang, Chenhui Deng, Chia-Tung Ho, Yanqing Zhang, Zhuo Feng, Cunxi Yu, Ang Li, Gang Qu, Brucek Khailany

机构 * University of Maryland, College Park(马里兰大学学院公园分校) NVIDIA(英伟达)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 提出AUTOGATE框架,通过ML-LLM协同设计将波形翻转迹线转化为紧凑表示,指导LLM进行RTL重写,实现层次化代码库中的时钟门控优化,平均降低动态功耗49.31%。

Comments 9 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15277 2026-06-16 cs.IR cs.AI cs.DB cs.ET cs.LG 新提交 90%

Guiding Federated Graph Recommendation with LLM-encoded knowledge

利用LLM编码知识指导联邦图推荐

Thi Minh Chau Nguyen, Hien Trang Nguyen, Duc Anh Nguyen, Van Ho-Long, Thanh Trung Huynh, Zhao Ren

机构 * institutetext(机构)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 针对联邦图推荐中跨客户端图表示对齐难的问题,提出利用大语言模型编码的语义信号指导结构表示的选择性聚合,提升推荐准确性。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08088 2026-06-16 cs.LG cs.AI 90%

Online Domain-aware LLM Decoding for Continual Domain Evolution

在线领域感知的LLM解码用于持续领域演变

Mohammad Abu-Shaira, Weishi Shi

机构 * University of North Texas(北卡罗来纳州立大学)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 本文提出在线领域感知解码框架ODD,通过概率融合和自适应置信度调节,提升LLM在持续领域变化中的适应能力,实验表明其在语法和语义生成任务中表现优异。

Journal ref Advances in Knowledge Discovery and Data Mining, PAKDD 2026, LNAI 16600, pp. 565-577, Springer, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11640 2026-06-11 cs.LG cs.AI 新提交 90%

TAROT: Task-Adaptive Refinement of LLM-prior Graphs for Few-shot Tabular Learning

TAROT: 面向小样本表格学习的任务自适应LLM先验图精炼

Ruxue Shi, Yili Wang, Mengnan Du, Hangting Ye, Yi Chang, Xin Wang

机构 * Jilin University(吉林大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 提出TAROT框架,通过构建并精炼任务自适应语义图,利用LLM先验和GNN编码特征语义关系,提升小样本表格学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03029 2026-06-03 cs.CL cs.AI 90%

Conditional Hypothesis Generation for LLM-Based Text Analysis with Researcher-Specified Covariates

基于研究者指定协变量的条件假设生成用于LLM文本分析

Paiheng Xu, Jing Liu, Wei Ai

机构 * University of Maryland, College Park(马里兰大学 College Park 分校)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出条件假设生成框架,通过纳入研究者指定的协变量来引导LLM发现相关子组内而非全局的差异模式,并采用特征-协变量交互和分层内去均值与逆频率重加权两种方法解决子组不平衡和符号反转问题。

详情

展开后加载摘要…

URL PDF HTML 收藏