arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2603.23057 2026-03-25 eess.AS cs.LG 83%

Prompt Amplification and Zero-Shot Late Fusion in Audio-Language Models for Speech Emotion Recognition

提示放大与零样本晚期融合在音频-语言模型中的语音情感识别应用

Saurabh Kataria, Xiao Hu

机构 * School of Nursing Emory University Atlanta, USA(埃默里大学护理学院,美国亚特兰大)

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract);分类 cs.LG

AI总结 本文提出ZS-Fuse方法,结合双编码器音频-语言模型与领域专家模型,通过提示放大技术提升零样本语音情感识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20537 2026-03-24 cs.AI 83%

LLM-Driven Heuristic Synthesis for Industrial Process Control: Lessons from Hot Steel Rolling

基于大语言模型的启发式合成在工业过程控制中的应用:来自热轧的启示

Nima H. Siboni, Seyedreza Kiamousavi, Emad Scharifi

机构 * Institute of Metal Forming, RWTH Aachen(RWTH亚琛大学金属成形研究所)

专题命中 领域大模型 :LLM(title,abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种基于大语言模型的启发式合成框架,用于热轧过程控制,通过可解释的Python控制器生成和自动审计流程,结合结构化战略构思和可执行代码生成,实现对轧制高度、间歇时间和轧制速度的控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19544 2026-03-23 cs.LG 83%

Scalable Cross-Facility Federated Learning for Scientific Foundation Models on Multiple Supercomputers

可扩展的跨设施联邦学习用于多超级计算机上的科学基础模型

Yijiang Li, Zilinghan Li, Kyle Chard, Ian Foster, Todd Munson, Ravi Madduri, Kibaek Kim

机构 * Mathematics and Computer Science Division, Argonne National Laboratory(阿贡国家实验室数学与计算机科学 division) Data Science and Learning Division, Argonne National Laboratory(阿贡国家实验室数据科学与学习 division) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种跨设施联邦学习框架,用于异构HPC环境,通过Globus Compute和Transfer orchestration实现大规模模型训练,验证了在HPC设施上进行联邦学习的可行性,并指出了调度器感知算法设计的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13323 2026-03-20 cs.LG 83%

GeoReg: Weight-Constrained Few-Shot Regression for Socio-Economic Estimation using LLM

GeoReg: 基于LLM的带权重少样本回归用于社会经济估计

Kyeongjin Ahn, Sungwon Han, Seungeon Lee, Donghyun Ahn, Hyoshin Kim, Jungwon Kim, Jihee Kim, Sangyoon Park, Meeyoung Cha

机构 * School of Computing, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院计算机科学学院) College of Business, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院商学院) Graduate School of Data Science, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院数据科学研究生院) Division of Social Science, Hong Kong University of Science and Technology (HKUST)(香港科学与技术大学社会科学系) Max Planck Institute for Software Systems (MPI-SWS)(马克斯·普朗克软件系统研究所) Max Planck Institute for Security and Privacy (MPI-SP)(马克斯·普朗克安全与隐私研究所)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 GeoReg通过整合卫星图像和网络地理信息等数据源,利用大语言模型的先验知识,在数据稀缺地区实现社会经济指标的少样本回归估计,实验表明其在不同发展水平国家均优于基线模型。

Comments 10 pages, 9 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10492 2026-03-19 cs.CL 83%

Human-AI Co-reasoning for Clinical Diagnosis with Evidence-Integrated Language Agent

人机协同推理用于临床诊断:证据整合语言代理

Zhongzhen Huang, Yan Ling, Hong Chen, Ye Feng, Li Wu, Linjie Mu, Shaoting Zhang, Xiaofan Zhang, Kun Qian, Xiaomu Li

专题命中 领域大模型 :language agent(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出PULSE,结合领域调优的大语言模型与文献检索,支持复杂病例的诊断决策。实验显示PULSE在专家级准确度上表现优异,且在罕见病病例中保持稳定性能,揭示了语言模型在临床诊断中的潜力与局限。

Comments After further evaluation, we have decided to withdraw the current version of this manuscript for further revision. We plan to add new experiments, improve the writing and overall presentation for greater clarity and coherence, and re-examine the dataset and related descriptions to ensure rigor and reliability before submitting an updated version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17533 2026-03-19 cs.IR cs.LG 83%

A Unified Language Model for Large Scale Search, Recommendation, and Reasoning

大规模检索、推荐与推理的统一语言模型

Marco De Nadai, Edoardo D'Amico, Max Lefarov, Alexandre Tamborrino, Divita Vohra, Mark VanMiddlesworth, Shawn Lin, Jacqueline Wood, Jan Stypka, Eliza Klyce, Keshi Dai, Timothy Christopher Heath, Martin D. Gould, Yves Raimond, Sandeep Ghael, Tony Jebara, Andreas Damianou, Vladan Radosavljevic, Paul N. Bennett, Mounia Lalmas, Praveen Chandar

机构 * Spotify

专题命中 领域大模型 :language model(title);LLM(abstract);instruction tuning(abstract);分类 cs.LG

AI总结 本文提出NEO框架,通过将预训练解码器模型适应为工具无关的生成器,实现多领域实体、用户和语言的联合推理,展示了在大规模目录上的推荐、搜索和用户理解任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16910 2026-03-19 cs.MA cs.AI physics.soc-ph 83%

TerraLingua: Emergence and Analysis of Open-endedness in LLM Ecologies

TerraLingua:LLM生态中开放性涌现与分析

Giuseppe Paolo, Jamieson Warner, Hormoz Shahrzad, Babak Hodjat, Risto Miikkulainen, Elliot Meyerson

机构 * Cognizant AI Lab(Cognizant AI实验室) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究LLM生态中开放性动态,通过TerraLingua平台分析协作规范、分工劳动及文化积累机制,揭示人工智能社会结构的形成过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16622 2026-03-18 cs.CL 83%

Domain Mixture Design via Log-Likelihood Differences for Aligning Language Models with a Target Model

通过对数似然差异设计领域混合以对齐语言模型与目标模型

Ryo Kishino, Riku Shiomi, Hiroaki Yamagiwa, Momose Oyama, Hidetoshi Shimodaira

机构 * Kyoto University(京都大学) RIKEN(理化学研究所)

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL

AI总结 本文通过设计训练数据的领域混合,利用对数似然空间对齐模型方向,减少KL散度并提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13370 2026-03-17 cs.CV cs.LG 83%

GraphVLM: Benchmarking Vision Language Models for Multimodal Graph Learning

GraphVLM:多模态图学习的视觉语言模型基准测试

Jiajin Liu, Dongzhe Fan, Chuanhao Ji, Daochen Zha, Qiaoyu Tan

机构 * NYU Shanghai(纽约大学上海分校) New York University(纽约大学) Rice University(休斯顿大学) East China Normal University(华东师范大学)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 GraphVLM通过三种范式评估视觉语言模型在多模态图学习中的能力,发现VLM-as-Predictor在性能上表现最佳,展示了其在多模态图学习中的潜力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12694 2026-03-16 cs.LG q-bio.QM 83%

RXNRECer Enables Fine-grained Enzymatic Function Annotation through Active Learning and Protein Language Models

RXNRECer 通过主动学习和蛋白质语言模型实现细粒度酶功能注释

Zhenkun Shi, Jun Zhu, Dehang Wang, BoYu Chen, Qianqian Yuan, Zhitao Mao, Fan Wei, Weining Wu, Xiaoping Liao, Hongwu Ma

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.LG

AI总结 RXNRECer利用主动学习和蛋白质语言模型直接预测酶促反应,克服传统EC编号方法的局限,提升预测精度和应用灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10828 2026-03-12 cs.CV cs.AI 83%

BALD-SAM: Disagreement-based Active Prompting in Interactive Segmentation

BALD-SAM:基于分歧的交互分割主动提示

Prithwijit Chowdhury, Mohit Prabhushankar, Ghassan AlRegib

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :prompting(title,abstract);foundation model(abstract);分类 cs.AI

AI总结 BALD-SAM通过引入贝叶斯主动学习与分歧方法,提升交互分割的自动化和准确性,实现跨领域高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07599 2026-03-10 cs.CL 83%

StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control

StyleBench: 评估语音语言模型在对话说话风格控制中的表现

Haishu Zhao, Aokai Hao, Yuan Ge, Zhenqiang Hong, Tong Xiao, Jingbo Zhu

机构 * NLP Lab, School of Computer Science and Engineering, Northeastern University, Shenyang, China(计算机科学与工程学院自然语言处理实验室,东北大学,沈阳,中国) NiuTrans Research, Shenyang, China(尼乌透研究,沈阳,中国)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 StyleBench是一个多轮对话基准测试,用于评估语音语言模型在情感、速度、音量和音调四个维度上的风格强度控制能力,并揭示了SLMs与通用语言模型之间的性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01780 2026-03-03 cs.LG q-bio.GN 83%

D3LM: A Discrete DNA Diffusion Language Model for Bidirectional DNA Understanding and Generation

D3LM:一种用于双向DNA理解和生成的离散DNA扩散语言模型

Zhao Yang, Hengchang Liu, Chuan Cao, Bing Su

机构 * Gaoling School of Artificial Intelligence(人工智能学院)

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract);分类 cs.LG

AI总结 D3LM通过掩码扩散统一双向DNA理解和生成,实现优于现有模型的性能。

Comments Accepted as a workshop paper at MLGenX 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01124 2026-03-03 cs.CV cs.AI 83%

ClinCoT: Clinical-Aware Visual Chain-of-Thought for Medical Vision Language Models

ClinCoT:面向医学视觉语言模型的临床感知视觉推理链

Xiwei Liu, Yulong Li, Xinlin Zhuang, Xuhui Li, Jianxu Chen, Haolin Yang, Imran Razzak, Yutong Xie

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) East China Normal University(东华大学)

专题命中 领域大模型 :language model(title,abstract);preference optimization(abstract);分类 cs.AI

AI总结 ClinCoT通过引入临床感知的视觉推理链框架,提升医学视觉语言模型在临床决策中的事实性支撑与多模态推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03906 2026-03-03 cs.AI 83%

Toward Clinically Explainable AI for Medical Diagnosis: A Foundation Model with Human-Compatible Reasoning via Reinforcement Learning

迈向临床可解释的AI:通过强化学习实现人友好的推理基础模型

Qika Lin, Yifan Zhu, Bin Pu, Ling Huang, Haoran Luo, Jingying Ma, Feng Wu, Kai He, Jiaxing Xu, Zhen Peng, Tianzhe Zhao, Fangzhi Xu, Jian Zhang, Zhonghong Ou, Erik Cambria, Swapnil Mishra, Mengling Feng

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 DeepMedix-R1通过强化学习实现临床可解释的AI,生成透明推理过程,优于现有模型,提升医学诊断的可解释性和实用性。

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00355 2026-03-03 cs.LG cs.SD eess.AS 83%

StethoLM: Audio Language Model for Cardiopulmonary Analysis Across Clinical Tasks

StethoLM:用于跨临床任务的心肺分析的音频语言模型

Yishan Wang, Tsai-Ning Wang, Mathias Funk, Aaqib Saeed

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 领域大模型 :language model(title,abstract);preference optimization(abstract);分类 cs.LG

AI总结 StethoLM是首个用于心肺听诊的音频语言模型,能执行多种临床任务,通过多阶段训练提升性能和鲁棒性,为临床听诊提供新的AI解决方案。

Comments To be published in TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07172 2026-02-25 cs.AI 83%

NewtonBench: Benchmarking Generalizable Scientific Law Discovery in LLM Agents

NewtonBench: 在LLM代理中评估可推广的科学定律发现

Tianshi Zheng, Kelvin Kiu-Wai Tam, Newt Hue-Nam K. Nguyen, Baixuan Xu, Zhaowei Wang, Jiayang Cheng, Hong Ting Tsang, Weiqi Wang, Jiaxin Bai, Tianqing Fang, Yangqiu Song, Ginny Y. Wong, Simon See

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) NVIDIA(英伟达)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 NewtonBench通过反事实定律变化生成科学定律发现任务,评估LLM代理在复杂系统中发现隐藏原理的能力,并揭示其在系统复杂性和观测噪声下的脆弱性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05598 2026-02-25 cs.IR cs.AI 83%

AgentDR: Dynamic Recommendation with Implicit Item-Item Relations via LLM-based Agents

AgentDR: 通过基于LLM的代理进行动态推荐:利用隐式物品-物品关系

Mingdai Yang, Nurendra Choudhary, Jiangshu Du, Edward W. Huang, Philip S. Yu, Karthik Subbian, Danai Koutra

机构 * Amazon(亚马逊) University of Michigan(密歇根大学)

专题命中 领域大模型 :LLM(title,abstract);prompting(abstract);分类 cs.AI

AI总结 AgentDR通过基于LLM的代理利用隐式物品-物品关系,结合记忆机制和提示策略,提升动态推荐的全排名性能和相关性。

Comments 12 pages, accepted by WWW'26 as long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02164 2026-02-05 cs.LG cs.CR 83%

Co-RedTeam: Orchestrated Security Discovery and Exploitation with LLM Agents

Co-RedTeam: 基于LLM代理的协同安全发现与利用

Pengfei He, Ash Fox, Lesly Miculicich, Stefan Friedli, Daniel Fabian, Burak Gokturk, Jiliang Tang, Chen-Yu Lee, Tomas Pfister, Long T. Le

机构 * Google(谷歌) Google Cloud AI Research(谷歌云人工智能研究) Michigan State University(密歇根州立大学)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Co-RedTeam通过整合安全知识、代码分析和执行反馈,提升漏洞发现与利用的自动化水平,实现超过60%的漏洞利用成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22754 2026-02-02 cs.CV cs.AI 83%

Procedural Knowledge Extraction from Industrial Troubleshooting Guides Using Vision Language Models

从工业故障排除指南中提取程序性知识:使用视觉语言模型

Guillermo Gil de Avalle, Laura Maruster, Christos Emmanouilidis

机构 * University of Groningen(Groningen大学)

专题命中 领域大模型 :language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 本文研究如何利用视觉语言模型从工业故障排除指南中提取结构化知识,通过对比两种提示策略评估模型性能,揭示布局敏感性与语义稳健性的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20845 2026-01-29 cs.LG eess.SP 83%

PatchFormer: A Patch-Based Time Series Foundation Model with Hierarchical Masked Reconstruction and Cross-Domain Transfer Learning for Zero-Shot Multi-Horizon Forecasting

PatchFormer: 一种基于补丁的时间序列基础模型,具有层次化掩码重建和跨域迁移学习,用于零样本多时间跨度预测

Olaf Yunus Laitinen Imanov, Derya Umut Kulali, Taner Yilmaz

机构 * Department of Applied Mathematics and Computer Science (DTU Compute), Technical University of Denmark(应用数学与计算机科学系(DTU Compute),丹麦技术大学) Department of Engineering, Eskisehir Technical University(工程系,埃斯基谢普大学) Department of Computer Engineering, Afyon Kocatepe University(计算机工程系,阿菲昂卡奥卡佩大学)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

AI总结 PatchFormer通过层次化掩码重建和跨域迁移学习,实现零样本多时间跨度预测,显著提升预测精度并减少训练数据需求。

Comments 5 pages; 2 figures; 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17048 2026-01-28 eess.AS cs.CL cs.SD 83%

Why Do Speech Language Models Fail to Generate Semantically Coherent Outputs? A Modality Evolving Perspective

为何语音语言模型无法生成语义连贯的输出?一种模态演化的视角

Hankun Wang, Haoran Wang, Yiwei Guo, Zhihan Li, Chenpeng Du, Kai Yu

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文从模态演化的角度分析语音语言模型生成语义不连贯的原因,发现语音信息的复杂性和长度对模型性能有显著影响,提出改进端到端SLMs的路径。

Comments 5 pages, 3 figures, 4 tables. Accepted to IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18942 2026-01-28 cs.CY cs.CL cs.DL 83%

Language Models Should be Used to Surface the Unwritten Code of Science and Society

语言模型应用于揭示科学与社会的

Honglin Bao, Siyang Wu, Jiwoong Choi, Yingrong Mao, James A. Evans

机构 * University of Chicago(芝加哥大学)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文提出利用语言模型揭示科学与社会中的隐含规则,通过生成自洽假设揭示同行评审中的隐藏因素,并探讨其在社会价值观公开讨论中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18261 2026-01-26 cs.IR cs.AI 83%

LLM Reasoning for Cold-Start Item Recommendation

基于大语言模型的冷启动物品推荐

Shijun Li, Yu Wang, Jin Wang, Ying Li, Joydeep Ghosh, Anne Cocos

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型的推理能力,改进冷启动物品推荐,通过多种微调方法提升推荐性能,在Netflix数据上取得8%的提升。

Comments Published on Proceedings of the ACM on Web Conference 2026 (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09147 2026-01-21 cs.CV cs.AI 83%

SSVP: Synergistic Semantic-Visual Prompting for Industrial Zero-Shot Anomaly Detection

SSVP:协同语义-视觉提示用于工业零样本异常检测

Chenhao Fu, Han Fang, Xiuzheng Zheng, Wenbo Wei, Yonghua Li, Hao Sun, Xuelong Li

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)

专题命中 领域大模型 :prompting(title,abstract);language model(abstract);分类 cs.AI

AI总结 SSVP通过协同语义-视觉提示机制,提升工业零样本异常检测的细粒度感知能力,实现93.0%的图像AUROC和92.2%的像素AUROC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11866 2026-01-21 cs.CL 83%

Advances in LLM Reasoning Enable Flexibility in Clinical Problem-Solving

大语言模型推理能力的进步促进了临床问题解决的灵活性

Kie Shidara, Preethi Prem, Jonathan Kim, Anna Podlasek, Feng Liu, Ahmed Alaa, Danilo Bernardo

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 大语言模型推理能力的提升增强了其在临床问题解决中的灵活性,使其在医学推理任务中表现接近人类水平。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10880 2026-01-19 cs.CV cs.AI 83%

Medical SAM3: A Foundation Model for Universal Prompt-Driven Medical Image Segmentation

医学SAM3:一种通用提示驱动的医学图像分割基础模型

Chongcong Jiang, Tianxingjian Ding, Chuhan Song, Jiachen Tu, Ziyang Yan, Yihua Shao, Zhenyi Wang, Yuzhang Shang, Tianyu Han, Yu Tian

机构 * University of Central Florida, Orlando, USA(佛罗里达大学) University College London, London, UK(伦敦大学学院) University of Illinois Urbana-Champaign, Champaign, USA(伊利诺伊大学厄巴纳-香槟分校) University of Trento, Trento, Italy(特伦托大学) The Hong Kong Polytechnic University, China(香港理工大学) University of Pennsylvania, Philadelphia, USA(宾夕法尼亚大学)

专题命中 领域大模型 :foundation model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 Medical SAM3通过微调SAM3模型,提升医学图像分割的通用提示驱动能力,解决领域偏移和复杂结构推理问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04209 2026-01-09 cs.CL 83%

Leveraging Language Models and RAG for Efficient Knowledge Discovery in Clinical Environments

利用语言模型和RAG实现临床环境中的高效知识发现

Seokhwan Ko, Donghyeon Lee, Jaewoo Chun, Hyungsoo Han, Junghwan Cho

机构 * Clinical Omics Institute, Kyungpook National University(临床组学研究所,庆北国立大学) Department of Biomedical Science, School of Medicine Kyungpook National University(生物医学科学系,庆北国立大学医学院) Department of Physiology, School of Medicine Kyungpook National University(生理学系,庆北国立大学医学院)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本研究提出一种基于RAG的系统,利用本地部署的LLaMA3和PubMedBERT,在临床环境中实现高效生物医学知识发现。

Comments 11pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04163 2026-01-08 eess.IV cs.CV cs.LG 83%

Scanner-Induced Domain Shifts Undermine the Robustness of Pathology Foundation Models

扫描诱导的域偏移损害病理基础模型的鲁棒性

Erik Thiringer, Fredrik K. Gustafsson, Kajsa Ledesma Eriksson, Mattias Rantalainen

机构 * Department of Medical Epidemiology and Biostatistics, Karolinska Institutet(卡罗林斯卡研究所医学流行病学与生物统计学系) Department of Engineering Science, University of Oxford(牛津大学工程科学系)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了扫描诱导的域偏移对病理基础模型鲁棒性的影响,发现现有模型在面对扫描设备变异性时存在显著偏差,需改进嵌入稳定性和校准以提升临床可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02364 2026-01-07 cs.IR cs.AI 83%

Towards Trustworthy LLM-Based Recommendation via Rationale Integration

通过推理整合实现可信的基于大语言模型的推荐

Chung Park, Taesan Kim, Hyeongjun Yun, Dongjoon Hong, Junui Hong, Kijung Park, MinCheol Cho, Mira Myong, Jihoon Oh, Min sung Choi

机构 * SK Telecom(SK电信)

专题命中 领域大模型 :LLM(title,abstract);instruction tuning(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的推荐系统,通过生成逻辑严谨的理由提升推荐的可解释性和性能。

Comments Accepted at RS4SD'25 (CIKM'25 Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏