arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2303.14177 2023-03-27 cs.CL cs.AI 84%

Scaling Expert Language Models with Unsupervised Domain Discovery

Suchin Gururangan, Margaret Li, Mike Lewis, Weijia Shi, Tim Althoff, Noah A. Smith, Luke Zettlemoyer

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06580 2023-03-14 cs.CV cs.CL cs.LG 84%

Towards General Purpose Medical AI: Continual Learning Medical Foundation Model

Huahui Yi, Ziyuan Qin, Qicheng Lao, Wei Xu, Zekun Jiang, Dequan Wang, Shaoting Zhang, Kang Li

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.03980 2023-01-11 cs.CL cs.AI 84%

Language Models sounds the Death Knell of Knowledge Graphs

Kunal Suri, Atul Singh, Prakhar Mishra, Swapna Sourav Rout, Rajesh Sabapathy

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.01134 2022-10-07 cs.CV cs.AI cs.LG 84%

Learning to Prompt for Vision-Language Models

Kaiyang Zhou, Jingkang Yang, Chen Change Loy, Ziwei Liu

专题命中 领域大模型 :language model(title,abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments International Journal of Computer Vision (IJCV), 2022. Update: Adds results on the DOSCO (DOmain Shift in COntext) benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.01394 2021-04-06 cs.CV cs.CL cs.LG 84%

MMBERT: Multimodal BERT Pretraining for Improved Medical VQA

Yash Khare, Viraj Bagal, Minesh Mathew, Adithi Devi, U Deva Priyakumar, CV Jawahar

专题命中 领域大模型 :pretraining(title,abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.02288 2021-03-22 cs.CL cs.LG 84%

Continual Domain-Tuning for Pretrained Language Models

Subendhu Rongali, Abhyuday Jagannatha, Bhanu Pratap Singh Rawat, Hong Yu

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments Updated from a previous shorter version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17892 2025-10-22 cs.CL 84%

Advances in Pre-trained Language Models for Domain-Specific Text Classification: A Systematic Review

Zhyar Rzgar K. Rostam, Gábor Kertész

机构 * Doctoral School of Applied Informatics and Applied Mathematics, Obuda University(应用信息学与应用数学博士学院,奥布达大学) John von Neumann Faculty of Informatics, Obuda University(冯·诺依曼信息学学院,奥布达大学) Laboratory of Parallel and Distributed Systems, Institute for Computer Science and Control (SZTAKI), Hungarian Research Network (HUN-REN)(并行与分布式系统实验室,计算机科学与控制研究所(SZTAKI),匈牙利研究网络(HUN-REN))

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments 41 pages, 10 figures, 13 tables

Journal ref Zhyar Rzgar K. Rostam and Gábor Kertész. 2025. Advances in Pre-trained Language Models for Domain-Specific Text Classification: A Systematic Review. ACM Trans. Intell. Syst. Technol. 16, 6, Article 124 (December 2025), 41 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14048 2025-08-21 eess.AS cs.CL 84%

RAG-Boost: Retrieval-Augmented Generation Enhanced LLM-based Speech Recognition

Pengcheng Wang, Sheng Li, Takahiro Shinozaki

机构 * School of Engineering(工程学院)

专题命中 领域大模型 :LLM(title,abstract);SLM(abstract,comments);分类 cs.CL

Comments accepted at Interspeech2025 MLC-SLM Challenge workshop (task I system description)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00574 2025-07-02 cs.LG 84%

Foundation Models for Clinical Records at Health System Scale

Haresh Rengaraj Rajamohan, Xiang Gao, Weicheng Zhu, Shih-Lun Huang, Long Chen, Kyunghyun Cho, Cem M. Deniz, Narges Razavian

机构 * new york university(纽约大学)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

Comments Accepted to ICML 2025 Workshop on Foundation Models for Structured Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07235 2024-10-21 cs.AR cs.AI cs.PL cs.SE 84%

LLM-aided explanations of EDA synthesis errors

Siyu Qiu, Benjamin Tan, Hammond Pearce

专题命中 领域大模型 :LLM(title,comments);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6 pages, 6 figures. Accepted in IEEE LLM Aided Design Workshop (LAD'2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09898 2023-09-19 cs.AI 84%

Towards Ontology Construction with Language Models

Maurice Funk, Simon Hosemann, Jean Christoph Jung, Carsten Lutz

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.AI

Comments KBC-LM'23: Knowledge Base Construction from Pre-trained Language Models workshop at ISWC 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27856 2026-08-18 cs.CV 版本更新 83%

Benchmarking Foundation and Large Language Models for Few-Shot Medical Image Segmentation

基准测试用于小样本医学图像分割的基础模型与大语言模型

Jinghong Liu, Yuchuan Deng, Fanping Liu, Meng Huang, Xirong Li

专题命中 领域大模型 :large language model(title);language model(title)

AI总结 该研究推出统一基准FAME,涵盖四类模型,含14958个样本,评估得出小样本分割的关键规律,助力开发更有效的小样本医学分割方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06068 2026-08-07 cs.HC cs.IR 新提交 83%

Cleo: A Transparent and Controllable Chatbot for Conversational Commerce

Cleo:一款用于会话式商务的透明且可控制的聊天机器人

Kevin Schott, Jan Lattenkamp, Daniel Hienert, Dagmar Kern

专题命中 领域大模型 :LLM(summary_cn,abstract);prompting(abstract)

AI总结 Cleo是一款用于会话式商务的透明可控制聊天机器人,通过混合架构、可审计排序机制等解决LLM的不透明性等问题,为产品搜索决策提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23054 2026-08-06 cs.CL cs.AI cs.LG 版本更新 83%

DeepImagine: Clinical Trial Outcome Prediction via Stepwise Local Counterfactual Imaginations

DeepImagine: 通过连续反事实想象学习生物医学推理

Youze Zheng, Jianyou Wang, Yuhan Chen, Matthew Feng, Longtian Bao, Hanyuan Zhang, Maxim Khan, Aditya K. Sehgal, Christopher D. Rosin, Umber Dube, Ramamohan Paturi

机构 * Laboratory for Emerging Intelligence, University of California, San Diego(新兴智能实验室,加州大学圣地亚哥分校) Department of Dermatology, University of California, San Diego(皮肤科系,加州大学圣地亚哥分校) University of Chicago(芝加哥大学) Elsevier(艾尔斯特出版社)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出DeepImagine框架,通过连续反事实想象训练语言模型进行生物医学推理,利用反事实对偶和强化学习提升临床试验预测性能,展示模型在生物医学领域的可解释性改进。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28229 2026-07-31 cs.CL cs.AI cs.IR cs.LG 新提交 83%

EMBL AI Librarian: Life-Sciences Knowledge Layer for AI Agents

EMBL AI Librarian:面向AI智能体的生命科学知识层

Luigi Sigillo, Matteo Silvestri, Francesco Tabaro, Rajat Bhatnagar, Syed Irtaza Mubashar, Matt Jeffryes, Daljit Nijjer, Vittorio Perera, Ola Spjuth, Julio Saez-Rodriguez, Melissa Harrison, Fabio Petroni

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究推出EMBL AI Librarian,为AI智能体升级Europe PMC接口,通过LLM统筹检索,在多基准任务中提升性能,代码已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26073 2026-07-30 cs.IR 新提交 83%

Guess Where You Go: Generative Next Point-of-Interest Recommendation in Amap

猜猜你要去哪里:高德地图中的生成式下一个兴趣点推荐

Penglong Zhai, Bowen Zheng, Jie Li, Yifang Yuan, Yue Liu, Sicong Wang, Mingyang Yin, Tingting Hu, Shuaijun Guo, Fanyi Di, Xin Li

专题命中 领域大模型 :LLM(summary_cn,abstract);pretraining(abstract)

AI总结 该研究提出Gwhere框架,结合SID生成与LLM生成式下一个POI推荐,经实验验证其在高德地图中可提升P-CTR和U-CTR,已部署应用且效果显著。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05808 2026-07-08 cs.CY 新提交 83%

Say What? Examining Text and Voice Input Modalities for Prompt-Based Programming in Computing Education

说什么?审视计算教育中基于提示的编程的文本和语音输入方式

Kaitlin Riegel, Yan Cathy Hua, Paul Denny, Victor-Alexandru Pădurean, Juho Leinonen, James Prather, Adish Singla

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 探索编程入门学生用文本或语音输入解决提示问题的情况,发现输入文本提示的学生更易首次尝试成功,多数学生偏好文本,定性分析揭示学生对两种输入方式的看法及优缺点,为计算教育多模态工具和教学设计提供启示。

Comments ITiCSE'26 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14654 2026-06-15 cs.AI cs.CL cs.LG 新提交 83%

Abstracting Cross-Domain Action Sequences into Interpretable Workflows

将跨领域动作序列抽象为可解释的工作流

Gaurav Verma, Scott Counts

机构 * Microsoft Corporation(微软公司)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出WorkflowView框架,利用大语言模型将低层动作序列抽象为高层活动,在三个不同任务中验证了有效性和泛化能力,实现高语义相似度和预测性能。

Comments preprint; 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12916 2026-06-12 cs.AI cs.CL cs.LG 新提交 83%

MDForge: Agentic Molecular Dynamics Pipeline Design under Sparse Simulator Feedback

MDForge:稀疏模拟器反馈下的智能分子动力学流水线设计

Zehong Wang, Yijun Ma, Connor R. Schmidt, Tianyi Ma, Weixiang Sun, Ziming Li, Xiaoguang Guo, Chuxu Zhang, Matthew J. Webber, Yanfang Ye

机构 * University of Notre Dame(圣母大学) University of Connecticut(康涅狄格大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出MDForge,利用LLM智能体通过多智能体辩论将稀疏奖励稠密化,自动设计分子动力学流水线,在SAMPL基准上达到专家水平,并发现新型高亲和力CB[7]结合剂。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20819 2026-06-11 physics.chem-ph 版本更新 83%

DynaMate2: runtime registration of expert-defined tools for agentic scientific workflow automation

DynaMate2:使代理AI民主化,用于专家设计的定制工作流

Orlando A. Mendible-Barreto, Ajay Vallabh, Ubaldo M. Córdova-Figueroa, Yamil J. Colón

专题命中 领域大模型 :LLM(summary_cn,abstract);foundation model(abstract)

AI总结 本文提出DynaMate2,一种分层代理框架和开源模板,旨在降低研究人员将现有专家定义的Python函数转换为AI可调用工具的门槛,通过让LLM负责任务路由和工具选择,而非生成科学代码,从而实现自动化科学工作流的民主化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09030 2026-06-09 cs.LG cs.AI cs.CL 新提交 83%

TRIAGE: Dialectical Reasoning for Explainable Risk Prediction on Irregularly Sampled Medical Time Series with LLMs

TRIAGE: 基于辩证推理的不规则采样医学时间序列风险可解释预测方法

Hyeongwon Jang, Gyouk Chu, Changhun Kim, Joonhyung Park, Hangyul Yoon, Eunho Yang

机构 * KAIST(韩国科学技术院) AITRICS University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出TRIAGE框架,利用大语言模型对竞争性临床结果生成辩证推理,缓解风险极化,实现连续风险评分与可解释推理,在三个基准上AUPRC提升3.3%,校准误差降低81%。

Comments Code is available at https://github.com/HyeongWon-Jang/TRIAGE

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07688 2026-06-09 cs.IR cs.AI cs.CL cs.LG 新提交 83%

TRACER: Token ReAssignment for Concept ERasure in Generative Recommendation

TRACER: 面向生成式推荐中概念擦除的令牌重分配

Ziheng Chen, Jiali Cheng, Zezhong Fan, Hadi Amiri, Diyuan Wu, Gabriele Tolomei, Yang Zhang

机构 * Stony Brook University(石英布鲁克大学) University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校) Columbia University(哥伦比亚大学) Institute of Science and Technology Austria(奥地利科学技术研究院) Sapienza University of Rome(罗马大学 sapienza) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对生成式推荐中概念遗忘与推荐效用冲突的问题,提出基于令牌重分配的概念遗忘框架TRACER,通过将概念相关物品重分配给替代令牌并引入一致性正则化,有效移除目标概念同时保持推荐效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09506 2026-06-09 cs.CE 83%

Beyond Knowledge to Agency: Evaluating Expertise, Autonomy, and Integrity in Finance with CNFinBench

超越知识到能动性:用CNFinBench评估金融领域的专业知识、自主性和完整性

Jinru Ding, Chao Ding, Yidong Jiang, Wenrao Pang, Boyi Xiao, Zhiqiang Liu, Jiayuan Chen, Yun Zhong, Tiantian Yuan, Junming Guan, Dawei Cheng, Jie Xu

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出CNFinBench基准,通过专业知识、自主性和完整性三维度评估LLM在金融领域的代理能力,并引入HICS指标量化多轮对抗攻击下的安全退化。

Journal ref Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00829 2026-06-02 cs.CV 83%

The Right Inference Strategy Is All You Need: Nearly Training-Free Domain-Wise Inference for EgoCross Challenge

正确的推理策略即是一切:面向EgoCross挑战的近乎无需训练的领域感知推理

Leyi Wu, Yifan Zhao, Jinjie Zhang, Yinchuan Li, Ying-Cong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) Knowin

专题命中 领域大模型 :SFT(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 针对EgoCross挑战中源受限场景下多模态大模型在领域偏移严重的自我中心视频问答任务上表现不佳的问题,提出一种领域感知推理策略,通过为四个目标领域分别设计不同的输入、提示和答案映射流程,在不进行额外训练的情况下显著提升基线模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30529 2026-06-01 cs.CL cs.AI cs.LG 83%

Generalistic or Specific Embeddings, Which is Better? An Empirical Study on Search for Clinical Coding in Non-English Languages

通用嵌入还是特定嵌入,哪个更好?非英语语言临床编码搜索的实证研究

David Rey-Blanco, Roberto Cruz

机构 * TietAI

专题命中 领域大模型 :LLM(abstract,abstract_cn);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究通过使用大型生成语言模型生成的合成数据微调双语编码器,构建两阶段检索器,解决了非英语语言临床编码检索中召回率下降的问题,并在多语言基准上取得了优于BioBERT-ST的性能。

Comments 24 pages, 12 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29210 2026-05-29 cs.CR 83%

SAMD: A Tool for Identifying False Data Injection Scenarios in AI/ML-enabled Medical Devices

SAMD:一种识别AI/ML医疗设备中虚假数据注入场景的工具

Mohammadreza Hallajiyan, Xueren Ge, Athish Pranav Dharmalingam, Gargi Mitra, Shahrear Iqbal, Homa Alemzadeh, Karthik Pattabiraman

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出SAMD工具,基于STPA-Sec和LLM自动化识别AI/ML医疗设备设计阶段的虚假数据注入漏洞与攻击场景,在五个FDA批准设备上验证了高精度与效率。

Comments 10 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27958 2026-05-28 cs.CL cs.AI cs.LG 83%

Pressure-Testing Deception Probes in LLMs: Scaling, Robustness, and the Geometry of Deceptive Representations

压力测试LLM中的欺骗探针:扩展性、鲁棒性与欺骗表示的几何结构

Sachin Kumar

机构 * LexisNexis(LexisNexis公司)

专题命中 领域大模型 :LLM(title_cn,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过系统压力测试,诊断线性探针在分布偏移下失效的原因,发现风格增强可恢复近完美检测,并证明欺骗编码非单一线性方向或熵代理,而是分布式亚阈值特征。

Comments Accepted at the GEM Workshop @ ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19633 2026-05-20 cs.CL cs.AI cs.LG cs.NE cs.SE 83%

optimize_anything: A Universal API for Optimizing any Text Parameter

optimize_anything: 一个用于优化任何文本参数的通用API

Lakshya A Agrawal, Donghyun Lee, Shangyin Tan, Wenjie Ma, Karim Elmaaroufi, Rohit Sandadi, Sanjit A. Seshia, Koushik Sen, Dan Klein, Ion Stoica, Joseph E. Gonzalez, Omar Khattab, Alexandros G. Dimakis, Matei Zaharia

机构 * MIT(麻省理工学院)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于LLM的通用优化系统,能够跨不同领域实现文本参数的优化,展示了其在六个多样化任务中的state-of-the-art性能,通过多任务搜索和跨问题迁移实现了高效的优化。

Comments 16 pages, 11 figures; Blog: https://gepa-ai.github.io/gepa/blog/2026/02/18/introducing-optimize-anything/

Journal ref Proceedings of the ACM Conference on AI and Agentic Systems (CAIS 26), May 26-29, 2026, San Jose, CA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14995 2026-05-15 cs.AI cs.CL cs.LG cs.SI 83%

Explainable Detection of Depression Status Shifts from User Digital Traces

从用户数字痕迹中可解释地检测抑郁状态转变

Loris Belcastro, Francesco Gervino, Fabrizio Marozzo, Domenico Talia, Paolo Trunfio

机构 * DIMES, University of Calabria(DIMES,卡塔尔大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一个可解释框架,通过结合多个BERT模型提取多维信号,构建用户轨迹以识别抑郁状态转变,利用大语言模型生成可读报告,提升解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22586 2026-05-13 cs.LG cs.AI cs.CL 83%

TabDLM: Free-Form Tabular Data Generation via Joint Numerical-Language Diffusion

TabDLM:通过联合数值-语言扩散生成自由形式表格数据

Donghong Cai, Jiarui Feng, Yanbo Wang, Da Zheng, Yixin Chen, Muhan Zhang

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校) Peking University(北京大学) Ant Group(蚂蚁集团)

专题命中 领域大模型 :LLM(abstract,abstract_cn);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出TabDLM,通过联合数值-语言扩散模型生成包含文本、分类和数值特征的自由形式表格数据,有效解决多模态数据生成难题。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏