arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2305.00447 2023-10-18 cs.IR 90%

TALLRec: An Effective and Efficient Tuning Framework to Align Large Language Model with Recommendation

Keqin Bao, Jizhi Zhang, Yang Zhang, Wenjie Wang, Fuli Feng, Xiangnan He

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments RecSys '23: Proceedings of the 17th ACM Conference on Recommender Systems; September 2023 Pages; 1007-1014

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01783 2023-10-04 cs.LG cs.AI cs.CL cs.HC 90%

Can large language models provide useful feedback on research papers? A large-scale empirical analysis

Weixin Liang, Yuhui Zhang, Hancheng Cao, Binglu Wang, Daisy Ding, Xinyu Yang, Kailas Vodrahalli, Siyu He, Daniel Smith, Yian Yin, Daniel McFarland, James Zou

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16289 2023-09-29 cs.CL cs.AI cs.LG 90%

LawBench: Benchmarking Legal Knowledge of Large Language Models

Zhiwei Fei, Xiaoyu Shen, Dawei Zhu, Fengzhe Zhou, Zhuo Han, Songyang Zhang, Kai Chen, Zongwen Shen, Jidong Ge

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14683 2023-08-29 cs.CL cs.AI cs.LG 90%

Fine-Tuning Llama 2 Large Language Models for Detecting Online Sexual Predatory Chats and Abusive Texts

Thanh Thi Nguyen, Campbell Wilson, Janis Dalins

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06921 2023-08-15 cs.CY 90%

CodeHelp: Using Large Language Models with Guardrails for Scalable Support in Programming Classes

Mark Liffiton, Brad Sheese, Jaromir Savelka, Paul Denny

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00457 2023-07-11 cs.IR cs.AI cs.CL cs.LG 90%

GenRec: Large Language Model for Generative Recommendation

Jianchao Ji, Zelong Li, Shuyuan Xu, Wenyue Hua, Yingqiang Ge, Juntao Tan, Yongfeng Zhang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.03678 2023-07-10 cs.CL cs.AI cs.LG 90%

Evaluating the Effectiveness of Large Language Models in Representing Textual Descriptions of Geometry and Spatial Relations

Yuhan Ji, Song Gao

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref GIScience 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05052 2023-06-09 cs.LG cs.AI cs.CL 90%

Interpretable Medical Diagnostics with Structured Data Extraction by Large Language Models

Aleksa Bisercic, Mladen Nikolic, Mihaela van der Schaar, Boris Delibasic, Pietro Lio, Andrija Petrovic

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02220 2023-06-06 cs.CL cs.AI cs.LG 90%

WangLab at MEDIQA-Chat 2023: Clinical Note Generation from Doctor-Patient Conversations using Large Language Models

John Giorgi, Augustin Toma, Ronald Xie, Sondra S. Chen, Kevin R. An, Grace X. Zheng, Bo Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Camera-ready submission to ClinicalNLP @ ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03022 2023-04-07 cs.IR 90%

TagGPT: Large Language Models are Zero-shot Multimodal Taggers

Chen Li, Yixiao Ge, Jiayong Mao, Dian Li, Ying Shan

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19529 2026-08-21 cs.CL cs.AI 新提交 90%

When Machines Speak: A Unified Generative Framework for Integrating Machine-Native Symbols into Pretrained Large Language Models

当机器说话:将机器原生符号整合到预训练大语言模型的统一生成框架

Su Yan, Rakesh Iyer

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);分类 cs.CL、cs.AI

AI总结 研究针对预训练大语言模型无法处理机器原生符号的问题,提出UniLang框架将机器原生符号与自然语言 token 同等建模,在序列推荐、法律先例预测任务上均优于基线,拓展了LLMs的应用范围。

Comments Code: https://github.com/Stella-S-Yan/llm-internalization

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08850 2024-05-29 cs.AI cs.CE cs.LG 90%

Assessing Economic Viability: A Comparative Analysis of Total Cost of Ownership for Domain-Adapted Large Language Models versus State-of-the-art Counterparts in Chip Design Coding Assistance

Amit Sharma, Teodor-Dumitru Ene, Kishor Kunal, Mingjie Liu, Zafar Hasan, Haoxing Ren

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);分类 cs.AI、cs.LG

Comments Paper accepted in IEEE-ACM conference: 2024 IEEE LLM-Aided Design Workshop (LAD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21079 2026-08-24 cs.LG 新提交 90%

Causal Modeling of Adverse Pregnancy Outcomes via Adaptive LLM Proposals

基于自适应大语言模型提议的不良妊娠结局因果建模

Kavimayil P. Komarasamy, Saurabh Mathur, Ameet Soni, David M. Haas, Kristian Kersting, Sriraam Natarajan

机构 * The University of Texas at Dallas(德克萨斯大学达拉斯分校) Technical University of Darmstadt(达姆施塔特工业大学) Swarthmore College(斯沃斯莫尔学院) Indiana University School of Medicine(印第安纳大学医学院) Hessian Center for Artificial Intelligence(黑森人工智能中心) German Research Center for AI (DFKI)(德国人工智能研究中心(DFKI))

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出神经符号框架,将LLM作为自适应提议分布,结合其先验知识与数据经验评分,在真实临床数据集上建模APOs,恢复专家验证边并识别新因果关系,为干预提供新见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19008 2026-08-21 cs.AI 版本更新 90%

Computational Phenomenology of Borderline Personality Disorder: A Comparative Evaluation of LLM-Simulated Expert Personas and Human Clinical Experts

边缘型人格障碍的计算现象学:对LLM模拟专家人设与人类临床专家的比较评估

Marcin Moskalewicz, Anna Sterna, Karolina Drożdż, Kacper Dudzic, Marek Pokropski, Paula Flores

机构 * IDEAS Research Institute(IDEAS研究机构) Adam Mickiewicz University(亚当·密茨凯维奇大学) AMU Center for Artificial Intelligence(AMU人工智能中心) Poznań University of Medical Sciences(波兹南医科大学) Maria Curie-Skłodowska University(玛丽·居里-斯洛多夫斯卡大学) University of Warsaw(华沙大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究比较了LLM模拟专家与人类专家在边缘型人格障碍定性分析中的表现,发现模型在某些方面与人类难以区分,并能识别人类遗漏的主题,展示了AI增强分析的潜力。

Comments 28 pages, 8 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18080 2026-08-20 cs.AI 新提交 90%

Large Language Models in Mental Health: A Systematic Review of Applications, Innovations, and Ethical Challenges

心理健康领域的大语言模型:应用、创新与伦理挑战的系统综述

Yisong Chen, Yifan Gao, Sijing Yu, Chuqing Zhao, Yang Lu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 该系统综述梳理了大语言模型在心理健康领域的多类应用、技术创新,同时探讨了其面临的伦理与监管挑战,并倡导建立保障其安全公平部署的框架。

Comments Systematic review. Published in Journal of Industrial Integration and Management (2025). Applications of large language models in mental health, including social media analysis, clinical conversational agents, therapy support tools, multimodal learning, and ethical considerations

Journal ref Journal of Industrial Integration and Management (JIIM), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22664 2026-08-20 cs.AI 版本更新 90%

MBABench: Evaluating LLM Agents on End-to-End Spreadsheet Tasks in Finance

WorkstreamBench: 评估LLM代理在金融领域的端到端电子表格任务

Thomson Yen, Julian Poeltl, Harshith Srinivas Gear, Yilin Meng, Joshua Fan, Adam Shen, Yili Liu, Ali Bauyrzhan, Patrick Shea, Siri Du, Haoyang Liu, Daniel Guetta, Hongseok Namkoong

机构 * Decision, Risk, and Operations Division, Columbia Business School(哥伦比亚商学院决策、风险与运营部门) ESB Business School, Reutlingen University(图宾根大学ESB商学院)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出WorkstreamBench,用于评估LLM代理在金融领域复杂端到端电子表格任务中的能力,重点在于财务建模和情景分析等关键流程,通过三个维度(准确性、公式、格式)的细粒度标准来衡量解决方案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17433 2026-08-19 cs.AI cs.MA 新提交 90%

Task-Aware Harness Provisioning for LLM Agents in Mission-Critical Infrastructure Operations

面向关键任务基础设施操作中LLM智能体的任务感知工具链配置

Liangtao Lin, Qingang Zhang, Zhaomeng Zhu, Tianwei Zhang, Yonggang Wen

机构 * Nanyang Technological University(南洋理工大学)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 该研究针对LLM智能体的工具链配置问题,提出映射引导的升级算法,在液体冷却任务中提升了准确率并减少token使用,在电网任务中提供低成本替代方案,揭示工具链配置遵循领域依赖的帕累托前沿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17341 2026-08-19 cs.AI 新提交 90%

LLM-Only PDDL Domain Repair with Open-Weight Models

仅使用大语言模型的PDDL领域修复:基于开放权重模型

Nader Karimi Bavandpour, Pascal Bercher

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文评估开放权重大语言模型仅用LLM方法修复PDDL模型错误的能力,发现其F1分数优于符号基线,但测试通过率仍不足,无法保证满足修复所需的测试约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14573 2026-08-18 cs.NI cs.AI 新提交 90%

WARA: Toward Automated Wireless Optimization Research with Closed-Loop LLM Agents

WARA:面向自动化无线优化研究的闭环大语言模型智能体

Yuan Guo, Yilong Chen, Chao Hu, Xianghao Yu, Liang Hong, Jie Xu

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出首个面向无线领域的端到端闭环LLM自动研究框架WARA,通过工件介导控制实现自动化无线优化研究,其性能优于单次LLM生成,接近同行评审论文质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11241 2026-08-13 cs.AI cs.IR 新提交 90%

RecSys Factory: Bounding LLM Agent Autonomy to Decision Points in the Industrial Recommender Lifecycle

RecSys Factory:限制LLM智能体在工业推荐生命周期内的自主决策点

Dongyang Ao, Kaixiang Fang, Shijie Xu

机构 * Tencent(腾讯) FiT(腾讯FiT)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 RecSys Factory 是限制 LLM 智能体自主到决策点的平台,解决工业推荐系统运营的三角困境,在腾讯三业务线部署 78 天,CLI 调度成功率达 78.6%。

Comments 21 pages, 6 figures, 9 tables. Reports a 78-day deployment across three heterogeneous industrial recommender business lines (1,624 CLI-tool dispatches). Companion paper: AutoResearch (P3b), which instantiates the same substrate for autonomous research

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16749 2026-08-13 cs.CR cs.AI 交叉投稿 90%

Evaluating LLM Generated Detection Rules in Cybersecurity

评估大语言模型(LLM)生成的网络安全检测规则

Anna Bertiger, Bobby Filar, Aryan Luthra, Stefano Meschiari, Aiden Mitchell, Sam Scholten, Vivek Sharath

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出开源评估框架与基准指标,以保留集法对比LLM与人工生成的网络安全规则,多维度评估LLM规则生成器有效性,并分析了Sublime Security的自动检测工程师(ADE)能力。

Comments Preprint of a paper accepted at the Conference on Applied Machine Learning in Information Security (CAMLIS 2025). 11 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07202 2026-08-10 cs.AI 新提交 90%

Authoring and Management of Transparent Research Integrity Assessments of Randomised Clinical Trial Publications Using LLM-assisted Tools and Provenance Knowledge Graphs

使用LLM辅助工具和来源知识图谱撰写与管理随机临床试验出版物的透明研究完整性评估

Milan Markovic, Goutham Indukuri, Somayajulu Sripada, Colby J. Vorland, Jack Wilkinson, Clare Robertson, Mark Bolland, Andrew Grey, Miriam Brazzelli, Alison Avenell

机构 * Interdisciplinary Institute, University of Aberdeen(阿伯丁大学跨学科研究所) University of Aberdeen(阿伯丁大学) Indiana University(印第安纳大学) University of Manchester(曼彻斯特大学) Aberdeen Centre for Evaluation, University of Aberdeen(阿伯丁大学阿伯丁评估中心) University of Auckland(奥克兰大学)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文介绍了基于LLM的INSPECT-AI工具,结合INSPECT-SR框架与RIPE-O本体,生成含140项评估的RIPE-KG,用于辅助人工评估已发表RCT的研究完整性。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06632 2026-08-10 cs.AI 新提交 90%

Shape Your Feed: An LLM-based Agentic System for Conversational Recommendation

塑造你的信息流:一种基于大语言模型的智能体对话推荐系统

Ziyun Xu, Bosen Ding, Yue Zhang, Ji Qi, Qingyuan Song, Jizhou Huang, Liwei Wang, Jefferey Santelli, Yue Weng, Qichao Que, Zhenheng Yang, Junfeng Pan, Linhong Zhu

机构 * Meta Platforms(元平台公司)

专题命中 领域大模型 :LLM(title,summary_cn);preference optimization(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出基于LLM的智能体推荐框架SYF,采用三层架构实现实时多模态内容协同策划,经离线评估与在线A/B实验验证,可提升信息流相关性与用户情感,为工业场景提供交互式推荐方案。

Comments Accepted in RecSys 2026 Industrial Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06422 2026-08-10 cs.LG 新提交 90%

Sharding Prevents LLM Oversight Failures and Adversarial Exploitation

分片可防止大语言模型(LLM)的监督失效与对抗性利用

Victor Akinwande, J. Zico Kolter, Aran Nayebi

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.LG

AI总结 该研究针对LLM监督中裁决数量增加导致一致性下降的问题,提出分片方法,可提升监督一致性、抵御对抗攻击,且分片后较弱裁判可超越更强的整体裁判。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03866 2026-08-05 cs.AI cs.SY eess.SY 新提交 90%

ADMITBench: A Safety-Governed Reference Framework for Evaluating the Admissibility of Industrial LLM Advisories

ADMITBench:用于评估工业LLM咨询建议可采纳性的安全管控参考框架

Yash Misra, Javal Vyas, Siddharth Gutta, Mehmet Mercangöz

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本研究提出ADMITBench框架,用于评估工业LLM咨询建议的可采纳性,该框架采用带版本的安全管控评估契约,0.1.0版本为公开参考实现,面向技术与研究评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03382 2026-08-05 cs.IR cs.LG 新提交 90%

LLM-Derived Priors for Thompson Sampling in Cold-Start Comment Recommendation

用于冷启动评论推荐中汤普森采样的大语言模型衍生先验

Eugene Lee, Oseong Choi, Byungsoo Kang, Taeyeong Jang

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 该研究提出用大语言模型(LLM)从评论文本提取语义信号生成贝叶斯先验,用于冷启动评论推荐的汤普森采样,经在线A/B/C测试验证其在稀疏反馈场景中效果显著。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10016 2026-08-04 cs.IR cs.LG 版本更新 90%

Tokenizing Numerical and Embedding Features for LLM RecSys

用于语言模型推荐系统的数值和嵌入特征分词

Zhe Xu, Ankit Peshin, Chiyu Zhang, Feng Qi, Johnson Lui, Anil Ramakrishna, Justin Johnson, Carl Hu, Kaushik Rangadurai, Luke Simon

机构 * Meta

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对多数基于大语言模型的推荐器无法利用非文本信号的问题,提出软令牌融合框架,将数值和嵌入特征映射到LLM嵌入空间,在基于共享参数LLM的双塔检索模型中实例化该框架,实验证明该方法有效提升了检索性能。

Journal ref Second Tokenization Workshop @ COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28889 2026-08-03 cs.HC cs.AI 新提交 90%

Human-LLM Collaborative Inductive Coding for Conceptualizing K-12 Educator AI Use

面向K-12教育工作者AI使用的人机协同归纳编码方法

Alex Liu, Min Sun, Lief Esbenshade, Michael Xiao, Victor Tian, Zachary Zhang, Kevin He

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出多阶段人机协同编码流程,将LLM作为标注工具辅助K-12教育工作者交互语料库编码,保留人类概念权威,构建含72个条目的分层编码本,为定性研究提供可审计模板。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28683 2026-08-03 cs.SE cs.AI 新提交 90%

Metaphor-Induced Algorithmic Steering: Cross-Domain Procedural Transfer in LLM Code Generation

隐喻诱导的算法引导:LLM代码生成中的跨领域过程迁移

Zhibo Hu, Chen Wang, Yanfeng Shu, Hye-young Paik, Liming Dong, Liming Zhu

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出MASC框架,发现隐喻会诱导LLM代码生成模型迁移低效率过程模式,可高检测率识别此类隐喻技能与低效率实现,揭示其通过源场景过程模式迁移运作的机制。

Comments 12 pages, 11 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28538 2026-07-31 cs.CV cs.LG 新提交 90%

ScaFE: Data-Efficient Scar Classification with LLM-Generated Clinical Feature Programs

ScaFE:基于大语言模型生成的临床特征程序实现数据高效的瘢痕分类

Ruman Wang, Hangting Ye

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 ScaFE将LLM临床知识转化为本地可执行的特征程序,结合轻量级随机森林,在瘢痕分类任务中实现数据高效、跨站点的高性能,且决策可审计,优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏