arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2311.16153 2023-11-30 cs.CR cs.AI 85%

Identifying and Mitigating Vulnerabilities in LLM-Integrated Applications

Fengqing Jiang, Zhangchen Xu, Luyao Niu, Boxin Wang, Jinyuan Jia, Bo Li, Radha Poovendran

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11652 2023-11-21 cs.AI 85%

Web News Timeline Generation with Extended Task Prompting

Sha Wang, Yuchen Li, Hanhua Xiao, Lambert Deng, Yanfei Dong

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09825 2023-11-17 cs.CL 85%

Human Still Wins over LLM: An Empirical Study of Active Learning on Domain-Specific Annotation Tasks

Yuxuan Lu, Bingsheng Yao, Shao Zhang, Yun Wang, Peng Zhang, Tun Lu, Toby Jia-Jun Li, Dakuo Wang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14088 2023-11-16 cs.CL 85%

MedEval: A Multi-Level, Multi-Task, and Multi-Domain Medical Benchmark for Language Model Evaluation

Zexue He, Yu Wang, An Yan, Yao Liu, Eric Y. Chang, Amilcare Gentili, Julian McAuley, Chun-Nan Hsu

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments Accepted to EMNLP 2023. Camera-ready version: updated IRB, added more evaluation results on LLMs such as GPT4, LLaMa2, and LLaMa2-chat

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02660 2023-11-07 cs.CL 85%

LLM-enhanced Self-training for Cross-domain Constituency Parsing

Jianling Li, Meishan Zhang, Peiming Guo, Min Zhang, Yue Zhang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2023 main conf

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09241 2023-10-16 cs.CL 85%

Precedent-Enhanced Legal Judgment Prediction with LLM and Domain-Model Collaboration

Yiquan Wu, Siying Zhou, Yifei Liu, Weiming Lu, Xiaozhong Liu, Yating Zhang, Changlong Sun, Fei Wu, Kun Kuang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12028 2023-08-24 cs.IR cs.AI 85%

LKPNR: LLM and KG for Personalized News Recommendation Framework

Chen hao, Xie Runfeng, Cui Xiangyang, Yan Zhou, Wang Xin, Xuan Zhanwei, Zhang Kai

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03360 2023-08-08 cs.CL 85%

Coupling Symbolic Reasoning with Language Modeling for Efficient Longitudinal Understanding of Unstructured Electronic Medical Records

Shivani Shekhar, Simran Tiwari, T. C. Rensink, Ramy Eskander, Wael Salloum

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07411 2023-07-17 cs.CL cs.CY 85%

Detecting LLM-Generated Text in Computing Education: A Comparative Study for ChatGPT Cases

Michael Sheinman Orenstrakh, Oscar Karnalim, Carlos Anibal Suarez, Michael Liut

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 18 pages total (16 pages, 2 reference pages). In submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01972 2023-07-06 cs.CL 85%

Open-Domain Hierarchical Event Schema Induction by Incremental Prompting and Verification

Sha Li, Ruining Zhao, Manling Li, Heng Ji, Chris Callison-Burch, Jiawei Han

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to ACL 2023. 19 pages with appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05827 2023-06-12 cs.CL 85%

Towards the Exploitation of LLM-based Chatbot for Providing Legal Support to Palestinian Cooperatives

Rabee Qasem, Banan Tantour, Mohammed Maree

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03788 2023-05-09 cs.CL 85%

Harnessing the Power of BERT in the Turkish Clinical Domain: Pretraining Approaches for Limited Data Scenarios

Hazal Türkmen, Oğuz Dikenelli, Cenk Eraslan, Mehmet Cem Çallı, Süha Süreyya Özbek

专题命中 领域大模型 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14956 2023-03-31 cs.CL 85%

Unified Text Structuralization with Instruction-tuned Language Models

Xuanfan Ni, Piji Li, Huayang Li

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.08091 2023-02-17 cs.CL 85%

Do We Still Need Clinical Language Models?

Eric Lehman, Evan Hernandez, Diwakar Mahajan, Jonas Wulff, Micah J. Smith, Zachary Ziegler, Daniel Nadler, Peter Szolovits, Alistair Johnson, Emily Alsentzer

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.14739 2022-12-02 cs.AI cs.NE 85%

A Case for Business Process-Specific Foundation Models

Yara Rizk, Praveen Venkateswaran, Vatche Isahagian, Vinod Muthusamy

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.10024 2021-10-20 cs.CY cs.AI 85%

Risks of AI Foundation Models in Education

Su Lin Blodgett, Michael Madaio

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12263 2026-06-09 cs.CL cs.AI cs.LG 版本更新 85%

Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers

多模态生成式引擎优化:针对视觉-语言模型排序器的排名操纵

Yixuan Du, Chenxiao Yu, Haoyan Xu, Ziyi Wang, Yue Zhao, Xiyang Hu

机构 * Georgetown University(乔治城大学) University of Southern California(南加州大学) University of Maryland, College Park(马里兰大学学院公园分校) Arizona State University(亚利桑那州立大学)

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract,comments);分类 cs.CL、cs.AI、cs.LG

AI总结 提出多模态生成式引擎优化(MGEO)方法,通过联合优化图像扰动和文本后缀,利用视觉-语言模型内部跨模态知识耦合,实现对产品排名的有效操纵,揭示了多模态基础模型知识基础的脆弱性。

Comments Proceedings of the 4th Workshop on Towards Knowledgeable Foundation Models (KnowFM) at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19929 2026-02-27 cs.NI cs.IT math.IT 85%

BeamVLM for Low-altitude Economy: Generative Beam Prediction via Vision-language Models

BeamVLM 用于低空经济:通过视觉-语言模型进行生成式波束预测

Chenran Kou, Changsheng You, Mingjiang Wu, Dingzhu Wen, Zezhong Zhang, Chengwen Xing

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 BeamVLM 通过视觉-语言模型实现生成式波束预测,提升无人机与地面基站间通信的准确性和泛化能力。

Comments We propose a novel end-to-end generative framework for beam prediction by using vision-language models

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08354 2024-11-14 physics.geo-ph 85%

Developing a Foundation Model for Predicting Material Failure

Agnese Marcato, Javier E. Santos, Aleksandra Pachalieva, Kai Gao, Ryley Hill, Esteban Rougier, Qinjun Kang, Jeffrey Hyman, Abigail Hunter, Janel Chua, Earl Lawrence, Hari Viswanathan, Daniel O'Malley

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at NeurIPS 2024 "Foundation Models for Science: Progress, Opportunities, and Challenges" Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01907 2024-09-04 cs.HC 85%

Focus Agent: LLM-Powered Virtual Focus Group

Taiyu Zhang, Xuesong Zhang, Robbe Cools, Adalberto L. Simeone

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 8 pages, the 24th Intelligent Virtual Agent Conference

Journal ref Taiyu Zhang, Xuesong Zhang, Robbe Cools, and Adalberto Simeone. 2024. Focus Agent: LLM-Powered Virtual Focus Group. In ACM International Conference on Intelligent Virtual Agents (IVA '24), September 16--19, 2024, GLASGOW, United Kingdom

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13476 2026-08-14 cs.AI cs.CL 新提交 85%

MARC v1: An Open-Source Multi-Agent Framework for Clinical AI Reasoning and Coordination

MARC v1:一个用于临床AI推理与协作的开源多智能体框架

Saisha Shetty, Satvik Tripathi, Austin Lin, Colin Zhao, Theodore Kim, Don Enwerem, Jacinta Arnold, Shahriar Faghani, Tessa S Cook

专题命中 领域大模型 :LLM(summary_cn,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出开源多智能体框架MARC v1,以确定性多智能体编排替代整体式LLM提示用于临床推理,含角色专业化智能体与分解器模块,支持多部署方式,具备模型无关、可解释等特性。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00740 2026-08-04 cs.CL cs.AI 版本更新 85%

MedTextWeaver: Procedural Knowledge Evolution in Agentic Medical Text Editing

ExperienceWeaver: 优化基于 LLM 的临床文本改进的小样本经验学习

Ziyan Xiao, Yinghao Zhu, Liang Peng, Kyongtae T Bae, Lequan Yu

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学)

专题命中 领域大模型 :LLM(title_cn,summary_cn);分类 cs.CL、cs.AI

AI总结 ExperienceWeaver 通过经验学习优化小样本下 LLM 的临床文本改进,通过提炼反馈知识提升模型修订能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29066 2026-08-03 cs.CL cs.AI 新提交 85%

Semantics of Subterfuge: Benchmarking Legal Deception Detection Against General-domain State-of-the-Art

欺骗的语义:针对通用领域最先进模型的法律欺骗检测基准测试

Theekshana Samaradiwakara, Nisansa de Silva, George C. Lobb

机构 * University of Moratuwa(莫拉图瓦大学) The Law Office of George C. Lobb(乔治·C·洛布律师事务所)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文针对法律领域的自动欺骗检测,对比了微调Transformer模型与大型语言模型在通用和法律数据集上的表现,发现领域敏感性显著,思维链提示效果逊于直接分类,强调需开发适配法律领域的可解释系统。

Comments 5 pages paper

Journal ref ICAIL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27845 2026-07-31 cs.CL cs.AI 新提交 85%

AutoSupervision: Closing the Feedback Loop in Scientific Workflows with Grounded Revision Verification

AutoSupervision:通过基于事实的修订验证闭合科学工作流中的反馈循环

Haobo Li, Eunseo Jung, Wenxiao Zhao, Feng Liu, Jiong Wang, Kaiyi Xu, Zijie Guo, Zixin Chen, Ben Fei, Fenghua Ling, Lei Bai

机构 * Shanghai AI Laboratory(上海人工智能实验室) University of California, Los Angeles(加州大学洛杉矶分校) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出AutoSupervision,利用《自然·通讯》5.6万篇文章的评审记录构建数据集,发现LLM刻画评审关切表现较好但证据验证是瓶颈,为AI辅助科学工作流提供反馈循环闭合方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09502 2026-07-13 cs.LG cs.AI cs.IR 新提交 85%

All Explanations are Wrong, But Many Are Useful: Exploring the Rashomon Explanation Set with Large Language Models

所有解释都是错误的,但许多解释是有用的:用大语言模型探索罗生门解释集

Pan Li

机构 * Scheller College of Business, Georgia Tech(舍勒商学院,佐治亚理工学院)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI、cs.LG

AI总结 研究指出机器学习模型解释存在准确性与可解释性权衡非根本性的观点,引入罗生门解释范式,提出RashomonLLM工作流程,经实验验证其在多任务中显著优于基线,提升业务性能并奠定消费者信任基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00031 2026-06-02 cs.CL cs.AI 85%

LLMs for Cardiovascular Risk Prediction from Structured Clinical Data

基于结构化临床数据的LLMs心血管风险预测

Jeba Maliha, Md Rafiul Kabir

机构 * Central Michigan University(中央密歇根大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 提出混合框架将结构化临床数据转换为自然语言表示,利用LLMs进行冠心病预测,并验证了高保真度与隐私保护优势。

Comments International Conference on Intelligent Systems, Blockchain, and Communication Technologies

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14150 2026-05-29 cs.AI cs.LG cs.NE 85%

CodeEvolve: an open source evolutionary coding agent for algorithmic discovery and optimization

CodeEvolve:用于算法发现和优化的开源进化编码智能体

Henrique Assumpção, Diego Ferreira, Leandro Campos, Fabricio Murai

机构 * Inter Science - Inter&Co Federal University of Minas Gerais(联邦大学伯南迪斯) Worcester Polytechnic Institute(沃思彻斯特理工大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 提出CodeEvolve开源框架,结合大语言模型与岛屿进化搜索,通过灵感交叉、元提示和深度细化,在AlphaEvolve基准上匹配或超越5/9问题,并在匹配条件下优于OpenEvolve和ShinkaEvolve,以更低成本超越前沿闭源集成。

Comments 21 pages, 16 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29368 2026-05-29 cs.CL cs.AI 85%

SURGENT: A Surgical Multi-Agent Assistance System Across the Perioperative Workflow

SURGENT: 一种跨围手术期工作流程的手术多智能体辅助系统

Dongsheng Shi, Yue Li, Xin Yi, Yongyi Cui, Huawei Feng, Linlin Wang

机构 * East China Normal University(华东师范大学) City University of Hong Kong(香港城市大学)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出SURGENT手术多智能体辅助系统,结合思维树规划器、多科室协作智能体和检索增强推理,通过新型记忆设计管理长期患者病史和短期工作摘要,在五项围手术期任务中优于基线LLM和现有医疗多智能体框架。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01092 2026-05-19 cs.AI cs.LG 85%

The Alien Space of Science: Sampling Coherent but Cognitively Unavailable Research Directions

科学的异类空间:采样连贯但认知不可用的研究方向

Alejandro H. Artiles, Martin Weiss, Levin Brinkmann, Iyad Rahwan, Bernhard Schölkopf, Christopher Pal, Hugo Larochelle, Anirudh Goyal, Nasim Rahaman

机构 * Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ELLIS Institute Tübingen(图宾根ELLIS研究所) Polytechnique Montreal(蒙特利尔理工学院) CIFAR AI Chair(CIFAR人工智能主席) Mila – Quebec AI Institute(魁北克人工智能研究所) Tiptree Systems(Tiptree系统)

专题命中 领域大模型 :LLM(summary_cn,abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种框架,通过分解论文为概念单元并学习两个互补模型,采样出连贯但认知不可用的研究方向,扩展了LLM生成的潜在词汇库。

Comments 10 main pages, 42 appendix pages, 29 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12275 2026-05-12 cs.CL cs.LG 85%

GONE: Structural Knowledge Unlearning via Neighborhood-Expanded Distribution Shaping

GONE: 通过邻域扩展分布塑造实现结构知识卸载

Chahana Dahal, Ashutosh Balasubramaniam, Zuobin Xiong

机构 * University of Nevada, Las Vegas(内华达大学拉斯维加斯分校) Indian Institute of Technology Guwahati(印度理工学院古瓦哈提分校)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出GONE基准,用于评估LLM在结构知识图谱中的知识卸载能力,引入NEDS框架通过图连接性识别相关邻居,实现精确的遗忘边界划分,展示出在知识编辑和卸载任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏