arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 911 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 911 篇

2608.03187 2026-08-05 cs.NE 新提交 88%

NeuroMosaic: Anatomically Grounded Multimodal Large Language Modeling for Molecularly Aware Glioma Reasoning from 3D MRI and Clinical Narratives

NeuroMosaic:基于解剖学的多模态大语言模型,用于从3D MRI和临床叙事中进行分子感知的胶质瘤推理

Yantong Liu, Zheyu Zhang, Runpeng Liu, Mu Xitang, Seong-Yoon Shin, Hyun-Ae Lee

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 该研究针对多模态医疗大语言模型在神经肿瘤学中的结构缺陷,提出NeuroMosaic模型,通过多模块架构实现胶质瘤的准确推理,在多个数据集上取得优异性能,验证了解剖学索引路由机制的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02617 2026-08-05 cs.CL cs.AI cs.LG 新提交 88%

Preferred, Not Safer: Pairwise Preference Is a Poor Proxy for Clinical Safety

偏好而非安全:成对偏好并非临床安全的可靠替代指标

Fay Elhassan, David Sasu, Alexandra Kulinkina, Lars Henning Klein, Mary-Anne Hartley

机构 * EPFL(洛桑联邦理工学院) LiGHT Laboratory(LiGHT实验室)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究表明临床医生成对偏好并非LLM临床安全的可靠替代指标,其排名靠前的模型仍存在大量临床安全失败,提出结合偏好与安全反馈的临床调整排名方法,支持分离偏好与安全的评估实践。

Comments 27 pages,10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24116 2026-07-28 cs.CR 新提交 88%

A Cybersecurity MLPS Large Language Model with Multi-Path Retrieval Fusion

一种具有多路径检索融合的网络安全多级保护方案大语言模型

Qian Li, Zhenyan Qi, Liang Shen, Yuan Zhang, Yifan Wan, Junyuan Ma, Yining Hu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 针对网络安全MLPS,提出集成多种检索策略的大语言模型框架,结合分层、基于树及基于词元化的匹配检索,减少无关干扰,采用多维加权评分评估,在十个典型问题实验中该特定领域模型总分更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20284 2026-07-23 cs.CV 新提交 88%

Multimodal Large Language Models for Remote Sensing Image Understanding: Domain-Specific or General-Purpose?

用于遥感图像理解的多模态大语言模型:领域特定还是通用?

Qiwei Ma, Chunping Qiu, Xinjun Cheng, Xiaoyu Zhang, Puhong Duan, Ke Yang, Xudong Kang, Shutao Li

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) Intelligent Game and Decision Lab (IGDL)(智能游戏与决策实验室) Yuelushan Center for Industrial Innovation(岳麓山工业创新中心)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 本文针对遥感图像理解的多模态大语言模型展开研究,通过系统调查和评估,比较其与通用模型在不同任务上的表现,发现当前模型存在局限,进而给出未来方向,为开发相关模型提供系统参考。

Comments 27 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17397 2026-07-21 physics.soc-ph 新提交 88%

The unintended consequences of large language models as a labor-augmenting technology in science

大语言模型作为科学领域劳动力增强技术的意外后果

Eamon Duede, Kevin Gross, M. J. Crockett, Carl Bergstrom

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 研究大语言模型作为科学领域劳动力增强技术的意外后果,用简单数学模型说明,指出其改变研究精力分配平衡,使研究人员对发表内容选择性改变,还提高时间机会成本,让论文打磨不那么彻底,降温了相关美好期望。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20002 2026-06-19 cs.LG cs.AI cs.CL 新提交 88%

Connect the Dots: Training LLMs for Long-Lifecycle Agents with Cross-Domain Generalization Via Reinforcement Learning

Connect the Dots:通过强化学习训练具备跨域泛化能力的长期生命周期智能体

Yanxi Chen, Weijie Shi, Yuexiang Xie, Boyi Hu, Yaliang Li, Bolin Ding, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出Connect the Dots框架,通过端到端强化学习训练LLM在长期任务中自我更新上下文并泛化到新领域,实验验证了跨域泛化能力。

Comments Work in progress; we will continuously update the codebase and arXiv version

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20220 2026-08-21 cs.AI 新提交 87%

InsufficiencyBench: Evaluating LLM legal advice on underspecified user queries

InsufficiencyBench:评估大型语言模型(LLM)在信息不足的用户查询下的法律建议

Samuel J. Vincent, Daniel Calloway, Fangyi Yu, Andrew M. Bean, Nabeel Seedat

机构 * Thomson Reuters Foundational Research(汤姆森路透基础研究机构) Imperial College London(帝国理工学院)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本研究构建了首个针对查询端信息不足的法律基准InsufficiencyBench,评估前沿LLM在信息不足的法律查询中识别缺失要素、避免过早结论的能力,发现现有模型表现不佳。

Comments 10 pages, Best Paper Honorable Mention at ICML AI4Law 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16407 2026-08-18 cs.IR cs.LG 新提交 87%

POI Recommendation with LLM-Augmented Multi-Graph Learning and Contrastive Alignment

结合大语言模型增强多图学习与对比对齐的兴趣点推荐

Burak Tamer, Wolfram Höpken, Zehui Wang

专题命中 领域大模型 :LLM(title,summary_cn);分类 cs.LG

AI总结 该研究针对POI推荐的物品冷启动问题,提出LLM-MGCL模型,结合语义、地理与交互多图及对比学习,在Yelp数据集上显著优于基线模型,缓解了冷启动问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09818 2026-08-11 cs.CV cs.AI 新提交 87%

MedPixel: A Unified Pixel-Language Model for Medical Reasoning and Segmentation

MedPixel:用于医学推理与分割的统一像素-语言模型

Haoyu Yang, Meixing Shi, Zengjie Chen, Haoran Sun, Haitao Leng, Xiaoming Shi, Yuxiang Cai, Yankai Jiang

专题命中 领域大模型 :language model(title,abstract);LLM(abstract,abstract_cn);preference optimization(abstract);分类 cs.AI

AI总结 该研究提出统一医学像素-语言模型MedPixel,引入44万样本的MedPLG-440K数据集,通过联合多任务微调与像素级偏好优化训练,支持多类医学任务,性能优异且具备零样本迁移与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27944 2026-07-31 cs.IR cs.AI 新提交 87%

Interpretable Representation via LLM-Driven Generative Disentanglement for Local-Life Service Recommendation

面向本地生活服务推荐的、基于大语言模型驱动的生成式解缠的可解释表示

Long Zhang, Hao Jiang, Sheng Yu, Fei Pan, Peng Jiang, Kun Gai

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对现有语义ID生成框架的语义纠缠与黑箱问题,提出LGRID模型,通过生成式解缠范式提升本地生活服务推荐的性能与可解释性,在公开数据集上取得显著效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24793 2026-07-29 cs.IR cs.CL 新提交 87%

Retrieval, not hallucinations, will be the limiting factor for LLM-based clinical AI tools

检索而非幻觉将成为基于大语言模型的临床人工智能工具的限制因素

Kirk Roberts, Steven Bedrick, Kurt Miller, William R. Hersh, Hongfang Liu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 探讨临床人工智能中基于大语言模型的错误,将讨论重点从精度错误转向召回错误,特别是患者级数据检索方面,概述错误类型、缓解策略及研究方向,提供检索评估概述。

Comments Perspective piece

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17653 2026-07-21 cs.CV cs.LG cs.MM 新提交 87%

LFM: Leveraging Foundation Models for Source-Free Universal Domain Adaptation

LFM:利用基础模型进行无源通用域适应

Jing Li, Pan Liu, Meng Zhao, Wanli Xue, Yanhong Yang, Xu Cheng, Fan Shi, Jianhua Zhang, Qinghua Hu, Shengyong Chen

机构 * School of Computer Science and Engineering, Tianjin University of Technology(天津理工大学计算机科学与工程学院) Engineering Research Center of Learning-Based Intelligent System, Ministry of Education of the People’s Republic of China, Tianjin University of Technology(中华人民共和国教育部基于学习的智能系统工程研究中心,天津理工大学) School of Artificial Intelligence, Tianjin University(天津大学人工智能学院) Engineering Research Center of City Intelligence and Digital Governance, Ministry of Education of the People’s Republic of China, Tianjin University(中华人民共和国教育部城市智能与数字治理工程研究中心,天津大学)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究在无源数据时将预训练源模型适应到目标域的问题,提出LFM框架,利用视觉语言模型计算相似度确定标签转移类型、识别未知样本,通过共识策略精炼伪标签训练目标模型,实验验证了该框架的有效性和优越性。

Comments Accepted by IEEE Transactions on Multimedia (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14659 2026-07-17 cs.SE cs.AI 新提交 87%

LLM-Driven Approach to Modeling Tool Interoperability in Automotive Domain

汽车领域中基于大语言模型驱动的建模工具互操作性方法

Nenad Petrovic, Jiajie Zhang, Vahid Zolfaghari, Alois Knoll

机构 * European Chips Joint Undertaking(欧洲芯片联合体) Federal Ministry of Research, Technology and Space of Germany(德国联邦研究、科技与航天部)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究汽车领域异构建模工具互操作性难题,提出基于大语言模型驱动的方法,涉及模型实例到目标元模型的映射及元模型合并,经案例验证该方法可行,能减少手动转换工作量并生成有效目标模型促进跨工具互操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10871 2026-07-14 cs.AI cs.HC 新提交 87%

Toward Contemplative LLM: A Modular Framework for Evaluating and Enhancing LLM Alignment in Mental Health

迈向沉思型大语言模型:心理健康领域中评估与增强大语言模型对齐性的模块化框架

Asher Sprigler, Yang-Yang Feng, Iftach Amir, Jonathan E. Bogard, Todd S Braver, Yi Ding, David Kinney, Yixue Zhao

机构 * Purdue University(普渡大学) Washington University in St. Louis(圣路易斯华盛顿大学) Yixue Research Institute(易学研究所)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 针对新模型等涌现使评估沉思原则增强大语言模型对齐性具挑战的问题,提出模块化可扩展评估框架,能集成新元素并重现先进结果,支持交叉评估,其提示模块便于纳入伦理视角,为跨学科研究及有益人机生态系统奠定基础。

Comments Accepted as an oral presentation at HARMONY 2026 (Human-centered AI Research for Mental Health, an Open Networking Symposium), co-located with IEEE/ACM Conference on Connected Health: Applications, Systems, and Engineering Technologies (CHASE 2026) held in Pittsburgh, August 6, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18181 2026-07-08 cs.IR cs.AI cs.CY 新提交 87%

IUU+DB: Tracking Illegal, Unreported, and Unregulated Fishing, Seafood Fraud, and Labor Abuse through LLM-driven Information Extraction

IUU+DB:通过LLM驱动的信息提取追踪非法、不报告和不管制捕捞、海鲜欺诈和劳工虐待

Henry Bodwell, Hong Yang, John C. Simeone, Kelvin Gorospe, Bella Sullivan, Lana Huang, Jessica Gephart, Sandy Aylesworth, Molly Masterton, Naren Ramakrishnan

机构 * University Of Washington(华盛顿大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出IUU+概念扩展非法捕捞定义,并构建基于大语言模型的IUU+DB系统,从异构文档中自动提取事件关键信息,支持去重和趋势分析,为渔业监管和研究提供数据支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04579 2026-07-07 cs.SE cs.AI 新提交 87%

LLM-Driven CI-CD Workflow Intelligence for Cyber Systems Engineering

面向网络系统工程的由大语言模型驱动的持续集成与持续交付工作流智能

Bonan Shen, Jiazhou Gao, Tao Ning, Wei-Jung Huang, Xin Liu

机构 * Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究面向网络系统工程的CI/CD工作流智能,通过基于大语言模型的分析管道,结合多种方法处理大量GitHub库数据,发现问题并得出结果,强调CI/CD可观测性应结合诊断、上下文和人工审查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00003 2026-07-02 cs.IR cs.AI 新提交 87%

From "Strings" to "Things" for Personal Knowledge Graphs: Evaluating LLM Triple Extraction for Recommendation Systems

从“字符串”到“事物”:面向个人知识图谱的LLM三元组提取在推荐系统中的应用评估

Abhirup Dasgupta, Fernando Spadea, Oshani Seneviratne

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种可复现的流水线,利用轻量级大语言模型从对话数据中提取结构化用户偏好三元组,构建个人知识图谱,并评估其在推荐任务中的效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24331 2026-06-24 cs.CL cs.ET 新提交 87%

Transformer-Based Language Models Across Domain Verticals: Architectures, Applications and Critical Assessment

基于Transformer的语言模型在垂直领域中的应用:架构、应用与批判性评估

Guruprakash J, Krithika L. B

机构 * SCOPE, VIT-AP University(VIT-AP大学SCOPE学院) SCORE, VIT(VIT大学SCORE学院)

专题命中 领域大模型 :language model(title,abstract);RLHF(summary_cn);instruction tuning(abstract);分类 cs.CL

AI总结 本文系统梳理Transformer架构变体(编码器、解码器、长上下文等)及后2023年进展(指令微调、RLHF、MoE等),评估其在医疗、金融等领域的部署,并批判性分析模型选择、参数-能耗权衡及“SOTA”含义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22586 2026-06-23 cs.AI cs.SE 新提交 87%

Text2DSL: LLM-Based Code Generation for Domain-Specific Languages

Text2DSL:基于大语言模型的领域特定语言代码生成

Alexander V. Kozachok, Alexander M. Nazimov, Shamil G. Magomedov

机构 * RTU MIREA --- Russian Technological University(俄罗斯技术大学) Academy of the Federal Guard Service of the Russian Federation(俄罗斯联邦警卫局学院)

专题命中 领域大模型 :LLM(title,summary_cn);分类 cs.AI

AI总结 提出Text2DSL任务,将自然语言描述自动转换为领域特定语言(DSL)代码;构建PolkitBench数据集,通过结构化上下文(BNF语法、API规范等)显著提升LLM生成代码的语法和结构有效性。

Comments 14 pages, 4 figures, 5 tables. Accepted at KES 2026 (Knowledge-Based Intelligent Information and Engineering Systems), Procedia Computer Science, Elsevier

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16905 2026-06-16 cs.CL 新提交 87%

Speaking the Language of Science: Toward a General-Purpose Generative Foundation Model for the Natural Sciences

说科学的语言:面向自然科学的通用生成基础模型

Mingyang Li, Yurou Liu, Jieping Ye, Bing Su, Ji-Rong Wen, Zheng Wang

机构 * Alibaba Group(阿里巴巴集团) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出LOGOS模型,通过统一科学语法将异构任务转化为自回归框架中的下一个词预测,在多个科学任务上匹配或超越领域专用基线,验证了“一模型适用于所有”的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12702 2026-06-12 cs.AI 新提交 87%

Deployment-Centered Evaluation: Predicting Query-Level Rejection Risk in a Clinical LLM System

以部署为中心的评估:预测临床大语言模型系统中的查询级拒绝风险

Alyssa Unell, Miguel Fuentes, Brenna Li, Bridget Lin, Meena Jagadeesan, Sanmi Koyejo, Nigam Shah

机构 * Department of Computer Science(计算机科学系) Department of Medicine(医学系) Department of Biomedical Data Science(生物医学数据科学系)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对临床大语言模型系统,提出基于部署上下文(如提供者类型、科室名称)的预响应分类器,预测用户拒绝风险,AUROC达0.719,并展示其在触发护栏和弃权中的效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19206 2026-08-21 cs.CL cs.AI cs.MA 新提交 87%

Hallucination as a Feature, not a Defect: Evaluating a multi-agent architecture to transform speculative language-model outputs into testable scientific hypotheses

幻觉作为特征而非缺陷:评估一种将推测性语言模型输出转化为可检验科学假说的多智能体架构

Nicolas Rodriguez-Alvarez

机构 * IES Parquesol(帕尔奎索尔学院)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 该研究提出基于Rust的多智能体架构,通过生成与评估智能体的认识论摩擦循环将LLM的推测性输出转化为可检验假说,实验显示该架构在需经受严格约束时更具优势,且各架构在原创性等维度的平衡表现不同。

Comments 25 pages. Bilingual: full English version followed by the complete Spanish version. Includes an exploratory paired baseline and ablation study (6 conditions). Code and data: https://doi.org/10.5281/zenodo.20649714

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13786 2026-08-17 cs.IR cs.AI cs.CL 新提交 87%

Do AI chatbots find what experts would? Effects of model, user role, and sample size on study retrieval for medical questions

AI聊天机器人能否找到专家会选择的研究?模型、用户角色和样本量对医学问题研究检索的影响

Qingfang Liu, Qiao Jin, Joe D. Menke, Thorsten Kahnt, Zhiyong Lu

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究评估Claude Sonnet 5、Gemini 3.1 Pro、ChatGPT GPT-5.5三款LLM聊天机器人在模拟三种用户角色下的医学研究检索表现,发现其召回率因模型、角色差异显著,且存在偏向大样本临床试验的偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05375 2026-08-07 cs.AI cs.LG cs.MA 新提交 87%

DoctorAgents: an agentic framework to iteratively refine AutoML pipeline for small clinical temporal data

DoctorAgents:用于针对小型临床时序数据迭代优化自动机器学习流水线的智能体框架

Ruilin Wang, Bo-Hong Wang, Elizabeth Kourbatski, Jun Bai, Hegang Chen, Ziyang Song, Gilles Boire, Marie Hudson, Yue Li

机构 * McGill University(麦吉尔大学) Mila – Quebec AI Institute(米拉-魁北克人工智能研究所) CIUSSSE-CHUS(谢布鲁克大学医学中心综合大学健康和社会服务中心) University of Sherbrooke(谢布鲁克大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 DoctorAgents是一种用于小型临床时序数据的智能体框架,通过LLM智能体以推理驱动方式迭代优化AutoML流水线,在多种临床任务上性能优于现有AutoML基线且可解释性更强。

Comments 34 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05151 2026-08-07 cs.CL cs.AI 新提交 87%

Simulator-Grounded Large Language Models for Industrial Causal Reasoning: Tool-Use, Structured Injection, and Plant-Portable Retrieval for Wastewater Treatment Decision Support

面向工业因果推理的模拟器驱动大语言模型:用于污水处理决策支持的工具使用、结构化注入及工厂可迁移检索

Gary Simethy, Daniel Ortiz Arroyo, Petar Durdevic

机构 * Aalborg University(奥尔堡大学)

专题命中 领域大模型 :large language model(title);language model(title);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 该研究对比三种适配Qwen2.5-32B-Instruct模型的方法,在污水处理因果问答任务中,DRR检索器兼具高准确率、跨工厂迁移能力及训练高效性,优于其他方法与基线。

Comments 20 pages, 2 figures, 8 tables. Preprint submitted to Elsevier

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28692 2026-08-03 cs.AI cs.CL 新提交 87%

SciToolAgent-Evo: An Ontology-Aware Self-Evolving Agent for Open-World Scientific Tool Acquisition

SciToolAgent-Evo:一种面向开放世界科学工具获取的本体感知自进化智能体

Yuqi Tang, Chenyi Zhou, Libin Wang, Keyan Ding, Qiang Zhang, Huajun Chen

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对LLM智能体依赖静态工具空间难以适配开放世界科学工作流的问题,提出SciToolAgent-Evo本体感知自进化智能体,结合进化记忆与本体化工具图,利用LinUCB平衡探索利用,推出OpenSciToolBench基准并取得最优性能。

Comments 19 pages, 4 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24817 2026-07-29 cs.IR cs.AI cs.CL 新提交 87%

Retrieval-Augmented Generation in LLMs for Mental Health: Quantifying the Incremental Contribution of Retrieval Within a Layered Safety Architecture

大语言模型在心理健康领域的检索增强生成:量化分层安全架构中检索的增量贡献

Anand Gupta, Akshat Surolia, Shubham Mishra, Shakil Imtiaz, Chaitali Sinha

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究数字心理健康干预中,通过在名为Wysa的DMHI里对比启用和禁用检索增强生成(RAG)模式,评估六个大语言模型,计算相关指标并测试差异,发现RAG虽致误报增加,但符合安全原则,是提升LLM驱动的DMHIs相关性能的有前景方法。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15380 2026-07-20 cs.CL cs.AI 新提交 87%

Large Language Models as Unified Multimodal Learners for Clinical Prediction

作为临床预测统一多模态学习者的大语言模型

Ajay Madhavan Ravichandran, Bilgin Osmandoja, Klemens Budde, Klaus Netter, Tobias Strapatsas, Aljoscha Burchardt, Sebastian Möller, Roland Roller

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI)) Charité Universitätsmedizin Berlin(柏林夏里特大学医学中心) DNC Information Management GmbH(DNC信息管理有限公司) Klinik für Akut- und Notfallmedizin, Asklepios Klinikum Harburg(哈堡阿斯克勒庇俄斯医院急性与急诊医学科) Technical University Berlin(柏林工业大学)

专题命中 领域大模型 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

AI总结 研究探讨利用大语言模型进行临床预测,提出将不同模态患者数据转为自然语言序列,端到端微调预训练语言模型的方法,经三个临床任务评估,该方法匹配或超越多模态基线,优于临床梯度提升系统,降低系统复杂性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19710 2026-06-19 cs.CL cs.AI 新提交 87%

FineREX: Fine-Tuned NER-RE for Human Smuggling Knowledge Graphs

FineREX: 面向人口走私知识图谱的微调NER-RE

Elijah Feldman, Dipak Meher, Carlotta Domeniconi

机构 * Thomas Jefferson High School for Science and Technology(托马斯·杰斐逊科技高中)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出FineREX,一个基于微调LLM的流水线,用于从法律文档中提取实体和关系构建知识图谱,在F1分数上分别提升15.50%和31.46%,并减少50%处理时间。

Comments Code available at https://github.com/ElijahFeldman7/FineREX

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19640 2026-06-19 cs.CL cs.AI cs.HC 新提交 87%

Creating Multilingual Mental Health Dialogue Datasets: Limits of Persona-Based Localization via Nationality and Language

创建多语言心理健康对话数据集:基于国籍和语言的人物角色本地化方法的局限性

Yunkai Xu, Saeed Abdullah

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过修改人物角色中的国籍和语言参数生成中文、孟加拉语和印地语临床对话,发现仅添加这些参数会导致跨语言临床不一致,且LLM评估非英语文本的抑郁严重度时存在不准确性。

Comments 15 pages, 4 figures. Accepted to the 2026 Workshop on Computational Linguistics and Clinical Psychology (CLPsych 2026), co-located with ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏