arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12659 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12659 篇

2303.12057 2023-09-28 cs.CY cs.CL 89%

Large Language Models Can Be Used to Estimate the Latent Positions of Politicians

Patrick Y. Wu, Jonathan Nagler, Joshua A. Tucker, Solomon Messing

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 18 pages, 4 figures; V2: fixed graphical error on Figure 2; V3: reorganized sections, updated prose; V4: added additional scales and analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09120 2023-09-19 cs.AI cs.CY 89%

Public Perceptions of Gender Bias in Large Language Models: Cases of ChatGPT and Ernie

Kyrie Zhixuan Zhou, Madelyn Rose Sanfilippo

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.02884 2023-09-08 cs.CL 89%

Aligning Large Language Models for Clinical Tasks

Supun Manathunga, Isuru Hettigoda

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01071 2023-09-06 cs.CL 89%

Business Process Text Sketch Automation Generation Using Large Language Model

Rui Zhu, Quanzhou Hu, Wenxin Li, Honghao Xiao, Chaogang Wang, Zixin Zhou

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12241 2023-08-24 cs.IR cs.AI 89%

LLMRec: Benchmarking Large Language Models on Recommendation Task

Junling Liu, Chao Liu, Peilin Zhou, Qichen Ye, Dading Chong, Kang Zhou, Yueqi Xie, Yuwei Cao, Shoujin Wang, Chenyu You, Philip S. Yu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08285 2023-08-17 cs.IR cs.CL 89%

Pre-training with Large Language Model-based Document Expansion for Dense Passage Retrieval

Guangyuan Ma, Xing Wu, Peng Wang, Zijia Lin, Songlin Hu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 10 pages, 3 tables, 4 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04140 2023-08-11 cs.CL 89%

Increasing Diversity While Maintaining Accuracy: Text Data Generation with Large Language Models and Human Interventions

John Joon Young Chung, Ece Kamar, Saleema Amershi

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted as a long paper at ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04898 2023-08-10 cs.CR cs.LG cs.SE 89%

An Empirical Study on Using Large Language Models to Analyze Software Supply Chain Security Failures

Tanmay Singla, Dharun Anandayuvaraj, Kelechi G. Kalu, Taylor R. Schorlemmer, James C. Davis

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 22 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06984 2023-07-10 cs.CL 89%

Evaluating Open-Domain Question Answering in the Era of Large Language Models

Ehsan Kamalloo, Nouha Dziri, Charles L. A. Clarke, Davood Rafiei

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments ACL 2023; code and data released at https://github.com/ehsk/OpenQA-eval

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.12650 2023-07-04 cs.CL cs.IR 89%

Few-shot Reranking for Multi-hop QA via Language Model Prompting

Muhammad Khalifa, Lajanugen Logeswaran, Moontae Lee, Honglak Lee, Lu Wang

专题命中 领域大模型 :language model(title,abstract);prompting(title,abstract);large language model(abstract);分类 cs.CL

Comments ACL 2023 - Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14457 2023-06-27 cs.CL 89%

Fauno: The Italian Large Language Model that will leave you senza parole!

Andrea Bacciu, Giovanni Trappolini, Andrea Santilli, Emanuele Rodolà, Fabrizio Silvestri

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02754 2023-06-06 cs.CL 89%

PULSAR: Pre-training with Extracted Healthcare Terms for Summarising Patients' Problems and Data Augmentation with Black-box Large Language Models

Hao Li, Yuping Wu, Viktor Schlegel, Riza Batista-Navarro, Thanh-Tung Nguyen, Abhinav Ramesh Kashyap, Xiaojun Zeng, Daniel Beck, Stefan Winkler, Goran Nenadic

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by ACL 2023's workshop BioNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13821 2023-05-24 q-bio.GN cs.AI cs.IR 89%

GenSpectrum Chat: Data Exploration in Public Health Using Large Language Models

Chaoran Chen, Tanja Stadler

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09612 2023-05-17 cs.CL cs.IR 89%

Large Language Models are Built-in Autoregressive Search Engines

Noah Ziems, Wenhao Yu, Zhihan Zhang, Meng Jiang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to ACL 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.14354 2023-04-28 cs.CL 89%

Industrial Engineering with Large Language Models: A case study of ChatGPT's performance on Oil & Gas problems

Oluwatosin Ogundare, Srinath Madasu, Nathanial Wiggins

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Industrial Engineering with LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.13382 2023-02-01 cs.CL 89%

Numeracy from Literacy: Data Science as an Emergent Skill from Large Language Models

David Noever, Forrest McKee

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.05238 2022-12-13 cs.CL cond-mat.mtrl-sci 89%

Structured information extraction from complex scientific text with fine-tuned large language models

Alexander Dunn, John Dagdelen, Nicholas Walker, Sanghoon Lee, Andrew S. Rosen, Gerbrand Ceder, Kristin Persson, Anubhav Jain

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.01142 2022-02-03 cs.SE cs.CR cs.LG 89%

Pop Quiz! Can a Large Language Model Help With Reverse Engineering?

Hammond Pearce, Benjamin Tan, Prashanth Krishnamurthy, Farshad Khorrami, Ramesh Karri, Brendan Dolan-Gavitt

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.LG

Comments 18 pages, 19 figures. Linked dataset: https://doi.org/10.5281/zenodo.5949075

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13800 2026-02-17 cs.RO cs.HC 89%

Ontological grounding for sound and natural robot explanations via large language models

通过大语言模型实现声音和自然的机器人解释的本体论基础

Alberto Olivares-Alarcos, Muhammad Ahsan, Satrio Sanjaya, Hsien-I Lin, Guillem Alenyà

机构 * Institute of Electrical and Control Engineering, National Yang Ming Chiao Tung University(电子与控制工程研究所,国立阳明交通大学)

专题命中 领域大模型 :language model(title,abstract);large language model(title,abstract);LLM(abstract)

AI总结 本文提出结合本体推理与大语言模型的框架,以生成自然且语义准确的机器人解释,提升人机交互的透明度和可解释性。

Comments An extended abstract of this article is accepted for presentation at AAMAS 2026: Olivares-Alarcos, A., Muhammad, A., Sanjaya, S., Lin, H. and Alenyà, G. (2026). Blending ontologies and language models to generate sound and natural robot explanations. In Proceedings of the International Conference on Autonomous Agents and Multiagent Systems. IFAAMAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19488 2025-06-17 cs.IR 89%

CoLLM: Integrating Collaborative Embeddings into Large Language Models for Recommendation

Yang Zhang, Fuli Feng, Jizhi Zhang, Keqin Bao, Qifan Wang, Xiangnan He

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments)

Comments Accepted by IEEE TKDE 2025 (add new LLM backbone Qwen2-1.5B and NDCG metric)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02095 2025-02-17 cs.CR 89%

DomainLynx: Leveraging Large Language Models for Enhanced Domain Squatting Detection

Daiki Chiba, Hiroki Nakano, Takashi Koide

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,journal_ref)

Comments Originally presented at IEEE CCNC 2025. An extended version of this work has been published in IEEE Access: https://doi.org/10.1109/ACCESS.2025.3542036

Journal ref D. Chiba, H. Nakano, and T. Koide, "DomainLynx: Advancing LLM Techniques for Robust Domain Squatting Detection," IEEE Access, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01951 2026-07-03 physics.soc-ph cs.AI cs.CL 新提交 89%

Robust for the Wrong Reasons: The Representational Geometry of LLM Robustness to Science Skepticism

鲁棒性源于错误原因:LLM对科学怀疑论鲁棒性的表征几何

Minjong Cheon

机构 * Department of Computer Science and Engineering, Sejong University(信息科学与工程系,世宗大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 通过行为测量、线性探针和激活修补,研究三个指令调优模型在气候、疫苗和进化三个科学共识领域对怀疑论的反应,发现模型表现出三种不同策略而非谄媚退缩,且鲁棒性不跨领域转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20477 2026-06-23 cs.CV cs.CL cs.LG 新提交 89%

Scalable Training of Spatially Grounded 2D Vision-Language Models for Radiology

面向放射学的空间定位2D视觉-语言模型的可扩展训练

Yusuf Salcan, Simon Ging, Robin Tibor Schirrmeister, Philipp Arnold, Elmar Kotter, Behzad Bozorgtabar, Thomas Brox

机构 * Computer Vision Group, University of Freiburg, Germany(德国弗莱堡大学计算机视觉组) Department of Radiology, Medical Center -- University of Freiburg, Germany(德国弗莱堡大学医学中心放射科) CRIION-AI Lab, Freiburg, Germany(德国弗莱堡CRIION-AI实验室)

专题命中 领域大模型 :LLM(summary_cn,abstract);language model(title,abstract);分类 cs.CL、cs.LG

AI总结 提出RefRad2D大规模双语数据集,通过LLM和自动分割生成空间定位数据,训练RadGrounder模型联合完成报告生成、VQA和空间定位,在外部基准上取得竞争性结果。

Comments Accepted for MICCAI 2026. First two authors: equal contribution. Last two authors: equal supervision

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15566 2026-06-16 cs.CL cs.AI 新提交 89%

LLM-Assisted Stance Detection in Scientific Discourse: A Test Case in Bayesian Cognitive Science

科学话语中的立场检测:以贝叶斯认知科学为例的LLM辅助方法

Eyup Engin Kucuk, Tarik Kelestemur, Ömer Dağlar Tanrikulu

机构 * University of New Hampshire(新罕布什尔大学) Independent Researcher(独立研究员)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出结合理论驱动编码手册、专家标注和诊断门控提示优化的方法,利用三个前沿LLM检测贝叶斯模型在科学文本中的现实主义/工具主义立场,在210篇文章的6858条引文中达到0.78的联合信度。

Comments 9 pages, 4 figures; Code and data: https://github.com/EyupEK/autoresearch_bayes

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02377 2025-10-15 cs.CL cs.AI 89%

A Few-Shot Approach for Relation Extraction Domain Adaptation using Large Language Models

Vanni Zavarella, Juan Carlos Gamero-Salinas, Sergio Consoli

机构 * Department of Mathematics and Computer Science, University of Cagliari, Cagliari, Italy(数学与计算机科学系,卡利亚里大学,卡利亚里,意大利) Institute of Data Science and Artificial Intelligence (DATAI), Universidad de Navarra, Pamplona, Spain(数据科学与人工智能研究所(DATAI),纳瓦拉大学,潘普隆,西班牙) European Commission, Joint Research Centre (DG JRC), Ispra (VA), Italy(欧洲委员会,联合研究中心(DG JRC),伊斯普拉(瓦拉),意大利)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Journal ref CEUR Workshop Proceedings, Vol. 3894 (2024), Workshop at KDD 2024 on Deep Learning and Large Language Models for Knowledge Graphs

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06272 2025-05-23 cs.CL cs.AI cs.IR 89%

Evaluating LLM-based Approaches to Legal Citation Prediction: Domain-specific Pre-training, Fine-tuning, or RAG? A Benchmark and an Australian Law Case Study

Jiuzhou Han, Paul Burgess, Ehsan Shareghi

机构 * Department of Data Science & AI, Monash University(数据科学与人工智能系,莫纳什大学) Faculty of Law, Monash University(法学院,莫纳什大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments For code, data, and models see https://auslawbench.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13667 2025-04-21 cs.HC cs.AI cs.CL 89%

Large Language Models Will Change The Way Children Think About Technology And Impact Every Interaction Paradigm

Russell Beale

机构 * School of Computer Science, University of Birmingham(计算机科学学院,伯明翰大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted for IDC 2025. Citation: Russell Beale. 2025. Large Language Models Will Change The Way Children Think About Technology And Impact Every Interaction Paradigm. In Proceedings of Interaction Design and Children Conference (IDC2025). ACM, New York, NY, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19340 2024-10-15 cs.CV cs.AI cs.LG cs.MM 89%

Integrating Large Language Models into a Tri-Modal Architecture for Automated Depression Classification on the DAIC-WOZ

Santosh V. Patapati

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Keywords: Multi-Modal Neural Networks, Deep Learning, Large Language Models, Depression Diagnosis, Biomedical Informatics, DAIC-WOZ

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10131 2024-06-06 cs.CL cs.AI 89%

RAFT: Adapting Language Model to Domain Specific RAG

Tianjun Zhang, Shishir G. Patil, Naman Jain, Sheng Shen, Matei Zaharia, Ion Stoica, Joseph E. Gonzalez

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);pretraining(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.15498 2023-06-28 cs.CL cs.AI cs.HC 89%

Using Large Language Models to Provide Explanatory Feedback to Human Tutors

Jionghao Lin, Danielle R. Thomas, Feifei Han, Shivang Gupta, Wei Tan, Ngoc Dang Nguyen, Kenneth R. Koedinger

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 12 pages Workshop paper, The 24th International Conference on Artificial Intelligence in Education, AIED 2023 Educational Dialogue Act Classification, Large Language Models, Named Entity Recognition, Tutor Training, Explanatory Feedback, Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏