arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12706 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12706 篇

2504.10982 2025-04-29 cs.CL cs.AI 73%

Exploring the Role of Knowledge Graph-Based RAG in Japanese Medical Question Answering with Small-Scale LLMs

Yingjian Chen, Feiyang Li, Xingyu Song, Tianxiao Li, Zixin Xu, Xiujie Chen, Issey Sukeda, Irene Li

机构 * The University of Tokyo(东京大学) NEC Laboratories America(NEC美国实验室) Dokkyo Medical University(多摩医学大学) Graduate School of Frontier Sciences, The University of Tokyo(东京大学前沿科学研究生院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12311 2025-04-29 cs.CL cs.AI 73%

Open Domain Question Answering with Conflicting Contexts

Siyi Liu, Qiang Ning, Kishaloy Halder, Wei Xiao, Zheng Qi, Phu Mon Htut, Yi Zhang, Neha Anna John, Bonan Min, Yassine Benajiba, Dan Roth

机构 * AWS AI Labs(AWS人工智能实验室) University of Pennsylvania(宾夕法尼亚大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18353 2025-04-28 cs.LG cs.AI 73%

Testing Individual Fairness in Graph Neural Networks

Roya Nasiri

机构 * Jheronimus Academy of Data Science, Tilburg University(杰罗尼姆斯数据科学学院,蒂尔堡大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00174 2025-04-23 cs.CL cs.AI cs.IR 73%

The Text Classification Pipeline: Starting Shallow going Deeper

Marco Siino, Ilenia Tinnirello, Marco La Cascia

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Foundations and Trends in Information Retrieval (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13950 2025-04-22 cs.LG cs.AI 73%

Open-Medical-R1: How to Choose Data for RLVR Training at Medicine Domain

Zhongxi Qiu, Zhang Zhang, Yan Hu, Heng Li, Jiang Liu

机构 * Research Institute of Trustworthy Autonomous Systems(可信自主系统研究 institute)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12681 2025-04-18 cs.CL cs.AI 73%

GRAIL: Gradient-Based Adaptive Unlearning for Privacy and Copyright in LLMs

Kun-Woo Kim, Ji-Hoon Park, Ju-Min Han, Seong-Whan Lee

机构 * Korea University(高丽大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12338 2025-04-18 cs.CL cs.LG 73%

Paging Dr. GPT: Extracting Information from Clinical Notes to Enhance Patient Predictions

David Anderson, Michaela Anderson, Margret Bjarnadottir, Stephen Mahar, Shriyan Reyya

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Paper and Online Supplement combined into one PDF. 26 pages. 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18040 2025-04-16 cs.CL cs.AI 73%

Key Algorithms for Keyphrase Generation: Instruction-Based LLMs for Russian Scientific Keyphrases

Anna Glazkova, Dmitry Morozov, Timur Garipov

机构 * University of Tyumen(秋明大学) Novosibirsk State University(新西伯利亚国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The 12th International Conference on Analysis of Images, Social Networks and Texts (AIST'2024)

Journal ref Lecture Notes in Computer Science, 2025, vol 15419, pp. 107-119

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10421 2025-04-15 cs.CL cs.AI 73%

Can We Edit LLMs for Long-Tail Biomedical Knowledge?

Xinhao Yi, Jake Lever, Kevin Bryson, Zaiqiao Meng

机构 * University of Glasgow(格拉斯哥大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07703 2025-04-14 cs.AI cs.CL 73%

DSBench: How Far Are Data Science Agents from Becoming Data Science Experts?

Liqiang Jing, Zhehui Huang, Xiaoyang Wang, Wenlin Yao, Wenhao Yu, Kaixin Ma, Hongming Zhang, Xinya Du, Dong Yu

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) Tencent AI Lab(腾讯AI实验室) University of Southern California(南加州大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11376 2025-04-10 cs.CL cs.AI cs.DL 73%

Annotating Scientific Uncertainty: A comprehensive model using linguistic patterns and comparison with existing approaches

Panggih Kusuma Ningrum, Philipp Mayr, Nina Smirnova, Iana Atanassova

机构 * Université Marie et Louis Pasteur(路易·巴斯德大学) Institut Universitaire de France (IUF)(法国大学研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Paper Accepted for Publication in the Journal of Informetrics (2025)

Journal ref 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02068 2025-04-01 cs.CL cs.AI 73%

The interplay between domain specialization and model size

Roseval Malaquias Junior, Ramon Pires, Thales Sales Almeida, Kenzo Sakiyama, Roseli A. F. Romero, Rodrigo Nogueira

机构 * University of São Paulo (USP)(圣保罗大学) State University of Campinas (UNICAMP)(坎皮纳斯州立大学) Maritaca AI(马里塔卡人工智能公司)

专题命中 领域大模型 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21349 2025-03-28 cs.CL cs.LG 73%

Fine-Tuning LLMs on Small Medical Datasets: Text Classification and Normalization Effectiveness on Cardiology reports and Discharge records

Noah Losch, Lucas Plagwitz, Antonius Büscher, Julian Varghese

机构 * Institute of Medical Informatics(医学信息学研究所) University of Münster(明斯特大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 4 pages, 2 tables,

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18594 2025-03-25 cs.CL cs.AI 73%

ClinText-SP and RigoBERTa Clinical: a new set of open resources for Spanish Clinical NLP

Guillem García Subies, Álvaro Barbero Jiménez, Paloma Martínez Fernández

机构 * Universidad Carlos III de Madrid(马德里卡洛斯三世大学) Instituto de Ingeniería del Conocimiento(知识工程研究所)

专题命中 领域大模型 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15527 2025-03-21 cs.HC cs.AI cs.LG 73%

Exploring the Panorama of Anxiety Levels: A Multi-Scenario Study Based on Human-Centric Anxiety Level Detection and Personalized Guidance

Longdi Xian, Junhao Xu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08247 2025-03-20 cs.CL cs.AI 73%

MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data

Tianyu Han, Lisa C. Adams, Jens-Michalis Papaioannou, Paul Grundmann, Tom Oberhauser, Alexei Figueroa, Alexander Löser, Daniel Truhn, Keno K. Bressem

机构 * University Hospital Aachen(亚琛大学医院) Technical University of Munich(慕尼黑工业大学) Berliner Hochschule für Technik (BHT)(柏林应用技术大学) German Heart Center(德国心脏中心)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14136 2025-03-19 cs.CL cs.AI 73%

CARE: A QLoRA-Fine Tuned Multi-Domain Chatbot With Fast Learning On Minimal Hardware

Ankit Dutta, Nabarup Ghosh, Ankush Chatterjee

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12988 2025-03-17 cs.CL cs.AI 73%

Few-Shot Learning for Mental Disorder Detection: A Continuous Multi-Prompt Engineering Approach with Medical Knowledge Injection

Haoxin Liu, Wenli Zhang, Jiaheng Xie, Buomsoo Kim, Zhu Zhang, Yidong Chai, Sudha Ram

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14687 2025-03-13 cs.CL cs.AI 73%

API-Assisted Code Generation for Question Answering on Varied Table Structures

Yihan Cao, Shuyi Chen, Ryan Liu, Zhiruo Wang, Daniel Fried

专题命中 领域大模型 :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023 camera ready, 13 pages, 11 figures

Journal ref Proceedings of the Conference on Empirical Methods in Natural Language Processing, Association for Computational Linguistics, 2023, pages 14536-14548, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03486 2025-03-12 cs.CL cs.AI 73%

BIPED: Pedagogically Informed Tutoring System for ESL Education

Soonwoo Kwon, Sojung Kim, Minju Park, Seunghyun Lee, Kyuseok Kim

机构 * Riiid(리이드(Riiid)) KAIST(韩国科学技术院) Twelve Labs Riiid AI Research(Riiid人工智能研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17764 2025-03-11 cs.LG cs.AI 73%

DeepSeek vs. ChatGPT vs. Claude: A Comparative Study for Scientific Computing and Scientific Machine Learning Tasks

Qile Jiang, Zhiwei Gao, George Em Karniadakis

机构 * Brown University(布朗大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03194 2025-03-06 cs.CL cs.AI 73%

Structured Outputs Enable General-Purpose LLMs to be Medical Experts

Guangfu Guo, Kai Zhang, Bryan Hoo, Yujun Cai, Xiaoqian Lu, Nanyun Peng, Yiwei Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02032 2025-03-05 cs.CL cs.AI cs.CV 73%

Comparative Analysis of OpenAI GPT-4o and DeepSeek R1 for Scientific Text Categorization Using Prompt Engineering

Aniruddha Maiti, Samuel Adewumi, Temesgen Alemayehu Tikure, Zichun Wang, Niladri Sengupta, Anastasiia Sukhanova, Ananya Jana

机构 * West Virginia State University(西弗吉尼亚州立大学) Fractal Analytics Inc(分形分析公司) Marshall University(马歇尔大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ASEE North Central Section 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01064 2025-03-04 cs.CL cs.AI cs.CV 73%

Scientific Reasoning: Assessment of Multimodal Generative LLMs

Florian Dreyer, Ekaterina Kolos, Daria Matiash

机构 * University of Stuttgart(斯图加特大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20301 2025-02-28 cs.CV cs.AI cs.CL 73%

M^3Builder: A Multi-Agent System for Automated Machine Learning in Medical Imaging

Jinghao Feng, Qiaoyu Zheng, Chaoyi Wu, Ziheng Zhao, Ya Zhang, Yanfeng Wang, Weidi Xie

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 38 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10172 2025-02-28 cs.CL cs.AI 73%

Increasing the Accessibility of Causal Domain Knowledge via Causal Information Extraction Methods: A Case Study in the Semiconductor Manufacturing Industry

Houssam Razouk, Leonie Benischke, Daniel Garber, Roman Kern

机构 * Infineon Technologies Austria AG(英飞凌奥地利技术公司) Graz University of Technology(格拉茨工业大学) Université Bourgogne Franche-Comté(勃艮第-弗朗什-孔泰大学) Know-Center GmbH(Know-Center有限公司)

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16069 2025-02-27 cs.AI cs.LG 73%

Curie: Toward Rigorous and Automated Scientific Experimentation with AI Agents

Patrick Tser Jern Kon, Jiachen Liu, Qiuyi Ding, Yiming Qiu, Zhenning Yang, Yibo Huang, Jayanth Srinivasa, Myungjin Lee, Mosharaf Chowdhury, Ang Chen

机构 * University of Michigan(密歇根大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09046 2025-02-26 cs.IR cs.AI cs.LG 73%

HyPA-RAG: A Hybrid Parameter Adaptive Retrieval-Augmented Generation System for AI Legal and Policy Applications

Rishi Kalra, Zekun Wu, Ayesha Gulley, Airlie Hilliard, Xin Guan, Adriano Koshiyama, Philip Treleaven

机构 * Holistic AI(整体人工智能公司) University College London(伦敦大学学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments NAACL 2025 Industry Track & EMNLP 2024 CustomNLP4U Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.02233 2025-02-25 cs.CL cs.AI 73%

Augmenting Black-box LLMs with Medical Textbooks for Biomedical Question Answering

Yubo Wang, Xueguang Ma, Wenhu Chen

机构 * University of Waterloo(滑铁卢大学)

专题命中 领域大模型 :LLM(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments This version has been accepted and published at EMNLP Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15714 2025-02-25 cs.IR cs.AI cs.CL 73%

TrustDataFilter:Leveraging Trusted Knowledge Base Data for More Effective Filtering of Unknown Information

Jinghong Zhang, Yidong Cui, Weiling Wang, Xianyou Cheng

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Research Institute of Chemical Defense(防化研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 8 figures, submitted to IEEE Transactions on Knowledge and Data Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏