arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12659 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12659 篇

2506.10974 2025-10-09 cs.CL cs.AI cs.HC cs.LG cs.MA 80%

AutoMind: Adaptive Knowledgeable Agent for Automated Data Science

Yixin Ou, Yujie Luo, Jingsheng Zheng, Lanning Wei, Zhuoyun Yu, Shuofei Qiao, Jintian Zhang, Da Zheng, Yuren Mao, Yunjun Gao, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Ongoing work

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10599 2025-09-26 cs.LG cs.AI cs.CL 80%

UDDETTS: Unifying Discrete and Dimensional Emotions for Controllable Emotional Text-to-Speech

Jiaxuan Liu, Yang Xiang, Han Zhao, Xiangang Li, Yingying Gao, Shilei Zhang, Zhenhua Ling

机构 * University of Science and Technology of China(中国科学技术大学) Alibaba Group(阿里巴巴集团) China Mobile(中国移动)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07019 2025-09-26 cs.HC 80%

Case Law Grounding: Using Precedents to Align Decision-Making for Humans and AI

Quan Ze Chen, Amy X. Zhang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at ACM Collective Intelligence 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10901 2025-09-19 cs.LG cs.AI cs.CL 80%

3DS: Medical Domain Adaptation of LLMs via Decomposed Difficulty-based Data Selection

Hongxin Ding, Yue Fang, Runchuan Zhu, Xinke Jiang, Jinyang Zhang, Yongxin Xu, Xu Chu, Junfeng Zhao, Yasha Wang

机构 * School of Computer Science, Peking University, Beijing, China(北京大学计算机学院) Key Laboratory of High Confidence Software Technologies, Ministry of Education(教育部高可信软件技术重点实验室) National Engineering Research Center for Software Engineering, Peking University, China(软件工程国家级工程研究中心) Big Data Technology Research Center, Nanhu Laboratory, Jiaxing, China(南湖实验室大数据技术研究中心) Peking University Information Technology Institute, Tianjin Binhai, China(北京大学信息科学技术研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10748 2025-09-16 cs.CV 80%

SCOPE: Speech-guided COllaborative PErception Framework for Surgical Scene Segmentation

Jecia Z. Y. Mao, Francis X Creighton, Russell H Taylor, Manish Sahu

机构 * LCSR, Johns Hopkins University(约翰霍普金斯大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07353 2025-09-10 cs.AI cs.CL cs.LG 80%

Benchmarking for Domain-Specific LLMs: A Case Study on Academia and Beyond

Rubing Chen, Jiaxin Wu, Jian Wang, Xulu Zhang, Wenqi Fan, Chenghua Lin, Xiao-Yong Wei, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) The University of Manchester(曼彻斯特大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18113 2025-08-26 cs.AI cs.CL cs.LG 80%

The AI Data Scientist

Farkhad Akimov, Munachiso Samuel Nwadike, Zangir Iklassov, Martin Takáč

机构 * Department of Machine Learning, MBZUAI, Abu Dhabi, UAE(机器学习系,MBZUAI,阿布扎比,阿联酋) Department of Natural Language Processing, MBZUAI, Abu Dhabi, UAE(自然语言处理系,MBZUAI,阿布扎比,阿联酋)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14572 2025-08-15 cs.CL cond-mat.mtrl-sci cs.AI cs.LG 80%

Evaluating the Performance and Robustness of LLMs in Materials Science Q&A and Property Predictions

Hongchen Wang, Kangming Li, Scott Ramsay, Yao Fehlis, Edward Kim, Jason Hattrick-Simpers

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07880 2025-08-12 cs.MA 80%

Multi-agent systems for chemical engineering: A review and perspective

Sophia Rupprecht, Qinghe Gao, Tanuj Karia, Artur M. Schweidtmann

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06496 2025-08-12 cs.CV cs.MA 80%

Med-GRIM: Enhanced Zero-Shot Medical VQA using prompt-embedded Multimodal Graph RAG

Rakesh Raj Madavan, Akshat Kaimal, Hashim Faisal, Chandrakala S

机构 * Shiv Nadar University Chennai(施瓦斯纳大学钦奈)

专题命中 领域大模型 :large language model(abstract);language model(abstract);small language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14079 2025-07-21 cs.CL cs.AI cs.IR cs.LG 80%

DENSE: Longitudinal Progress Note Generation with Temporal Modeling of Heterogeneous Clinical Notes Across Hospital Visits

Garapati Keerthana, Manik Gupta

机构 * Department of Computer Science and Information Systems, Birla Institute of Technology and Science, Pilani, Hyderabad Campus(计算机科学与信息系统系,比拉理工学院,比拉理工学院,海得拉巴校区)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12990 2025-07-18 cs.LG cs.AI cs.CL 80%

Teach Old SAEs New Domain Tricks with Boosting

Nikita Koriagin, Yaroslav Aksenov, Daniil Laptev, Gleb Gerasimov, Nikita Balagansky, Daniil Gavrilov

机构 * T-Tech HSE University(俄罗斯高等经济大学) Moscow Institute of Physics and Technology(莫斯科物理技术学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03092 2025-06-19 cs.CL cs.AI cs.LG 80%

REVOLVE: Optimizing AI Systems by Tracking Response Evolution in Textual Optimization

Peiyan Zhang, Haibo Jin, Leyang Hu, Xinnuo Li, Liying Kang, Man Luo, Yangqiu Song, Haohan Wang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 20 pages, 2 figures, accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09420 2025-06-12 cs.AI cs.CL cs.HC cs.LG cs.MA 80%

A Call for Collaborative Intelligence: Why Human-Agent Systems Should Precede AI Autonomy

Henry Peng Zou, Wei-Chieh Huang, Yaozu Wu, Chunyu Miao, Dongyuan Li, Aiwei Liu, Yue Zhou, Yankai Chen, Weizhi Zhang, Yangning Li, Liancheng Fang, Renhe Jiang, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) University of Tokyo(东京大学) Tsinghua University(清华大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00072 2025-06-03 cs.CY cs.AI cs.CL cs.LG 80%

Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs

Nariman Naderi, Zahra Atf, Peter R Lewis, Aref Mahjoub far, Seyed Amir Ahmad Safavi-Naini, Ali Soroush

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This paper was accepted for presentation at the 7th International Workshop on EXplainable, Trustworthy, and Responsible AI and Multi-Agent Systems (EXTRAAMAS 2025). Workshop website: https://extraamas.ehealth.hevs.ch/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21503 2025-05-28 cs.CL cs.AI cs.LG q-bio.OT 80%

Silence is Not Consensus: Disrupting Agreement Bias in Multi-Agent LLMs via Catfish Agent for Clinical Decision Making

Yihan Wang, Qiao Yan, Zhenghao Xing, Lihao Liu, Junjun He, Chi-Wing Fu, Xiaowei Hu, Pheng-Ann Heng

机构 * The Chinese University of Hong Kong(香港中文大学) Amazon(亚马逊) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03179 2025-05-07 cs.CR 80%

Bridging Expertise Gaps: The Role of LLMs in Human-AI Collaboration for Cybersecurity

Shahroz Tariq, Ronal Singh, Mohan Baruwal Chhetri, Surya Nepal, Cecile Paris

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 20 pages, 10 figures, 2 tables, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08444 2025-04-29 cs.CL cs.AI cs.IR cs.LG 80%

W-RAG: Weakly Supervised Dense Retrieval in RAG for Open-domain Question Answering

Jinming Nian, Zhiyuan Peng, Qifan Wang, Yi Fang

机构 * Santa Clara University(圣克拉拉大学) Meta AI

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16615 2025-04-24 cs.CL cs.AI cs.LG 80%

Lawma: The Power of Specialization for Legal Annotation

Ricardo Dominguez-Olmedo, Vedant Nanda, Rediet Abebe, Stefan Bechtold, Christoph Engel, Jens Frankenreiter, Krishna Gummadi, Moritz Hardt, Michael Livermore

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Tübingen AI Center(图宾根人工智能中心) Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) ETH Zurich(苏黎世联邦理工学院) Max Planck Institute for Research on Collective Goods(马克斯·普朗克集体研究研究所) Washington University in St. Louis - School of Law(圣路易斯华盛顿大学法学院) University of Virginia School of Law(弗吉尼亚大学法学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20509 2025-03-03 cs.CV 80%

CoCa-CXR: Contrastive Captioners Learn Strong Temporal Structures for Chest X-Ray Vision-Language Understanding

Yixiong Chen, Shawn Xu, Andrew Sellergren, Yossi Matias, Avinatan Hassidim, Shravya Shetty, Daniel Golden, Alan Yuille, Lin Yang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00036 2025-02-27 cs.CL cs.AI cs.LG 80%

EMERGE: Enhancing Multimodal Electronic Health Records Predictive Modeling with Retrieval-Augmented Generation

Yinghao Zhu, Changyu Ren, Zixiang Wang, Xiaochen Zheng, Shiyun Xie, Junlan Feng, Xi Zhu, Zhoujun Li, Liantao Ma, Chengwei Pan

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments CIKM 2024 Full Research Paper; arXiv admin note: text overlap with arXiv:2402.07016

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16952 2025-01-29 cs.CL cs.AI cs.LG 80%

Multiple Abstraction Level Retrieve Augment Generation

Zheng Zheng, Xinyi Ni, Pengyu Hong

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03839 2025-01-08 eess.IV cs.CV 80%

MedFocusCLIP : Improving few shot classification in medical datasets using pixel wise attention

Aadya Arora, Vinay Namboodiri

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19260 2025-01-03 cs.CL cs.AI cs.LG 80%

MEDEC: A Benchmark for Medical Error Detection and Correction in Clinical Notes

Asma Ben Abacha, Wen-wai Yim, Yujuan Fu, Zhaoyi Sun, Meliha Yetisgen, Fei Xia, Thomas Lin

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This version has been updated with further clarification regarding the model size estimates that were mined from public articles only and provided to aid in contextualizing model performance. The authors cannot vouch for the accuracy of those estimates

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15270 2025-01-03 cs.CL cs.AI cs.CE cs.CY cs.LG 80%

Baichuan4-Finance Technical Report

Hanyu Zhang, Boyu Qiu, Yuhao Feng, Shuqi Li, Qian Ma, Xiyuan Zhang, Qiang Ju, Dong Yan, Jian Xie

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15256 2024-12-23 cs.CL cs.AI cs.LG 80%

Structured Extraction of Real World Medical Knowledge using LLMs for Summarization and Search

Edward Kim, Manil Shrestha, Richard Foty, Tom DeLay, Vicki Seyfert-Margolis

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 3 figures, Work published in 4th Workshop on Knowledge Graphs and Big Data (In Conjunction with IEEE Big Data 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12456 2024-12-18 cs.LG cs.AI cs.CL cs.DB 80%

Graph Learning in the Era of LLMs: A Survey from the Perspective of Data, Models, and Tasks

Xunkai Li, Zhengyu Wu, Jiayi Wu, Hanwen Cui, Jishuo Jia, Rong-Hua Li, Guoren Wang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments In progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02159 2024-12-04 cs.LG cs.AI cs.CL cs.CR 80%

Jailbreak Defense in a Narrow Domain: Limitations of Existing Methods and a New Transcript-Classifier Approach

Tony T. Wang, John Hughes, Henry Sleight, Rylan Schaeffer, Rajashree Agrawal, Fazl Barez, Mrinank Sharma, Jesse Mu, Nir Shavit, Ethan Perez

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to the AdvML-Frontiers and SoLaR workshops at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11910 2024-11-26 cs.LG cs.AI cs.CL 80%

AIGS: Generating Science from AI-Powered Automated Falsification

Zijun Liu, Kaiming Liu, Yiqi Zhu, Xuanyu Lei, Zonghan Yang, Zhenhe Zhang, Peng Li, Yang Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Pre-print. 35 pages. Official website: https://agent-force.github.io/AIGS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11582 2024-11-19 cs.SE cs.SY eess.SY 80%

Exploring LLMs for Verifying Technical System Specifications Against Requirements

Lasse M. Reinpold, Marvin Schieseck, Lukas P. Wagner, Felix Gehlhoff, Alexander Fay

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Submitted to 3rd IEEE Industrial Electronics Society Annual Online Conference (ONCON)

详情

展开后加载摘要…

URL PDF HTML 收藏