arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-25 至 2026-08-25 共收录 61 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 61 篇

2608.22797 2026-08-25 cs.AI 新提交 92%

Performance of a domain-specific large language model in answering patient questions in psychiatry

面向精神病学领域的专用大语言模型在回答患者问题时的性能表现

Alexander J. Hish, Arjun Nagendran, Scott N. Compton

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究开发了专用LLM MIND,对比ChatGPT、OpenEvidence回答患者关于艾司西酞普兰的问题,发现MIND评分更高但医生更偏好ChatGPT,为构建精神病学安全LLM提供了进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17443 2026-08-25 cs.AI cs.CL cs.CY 版本更新 92%

Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems

在位优势:LLM推荐系统中的品牌偏见与认知操纵动态

Xi Chu, Yupeng Hou

机构 * Trine University(特莱恩大学) Texas A&M University(德克萨斯农工大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究LLM推荐中的品牌动态,发现知名品牌在同等规格下获100%推荐(IAI=10.0),但微弱评分优势可打破垄断;权威营销语言(如虚假临床证据)以+0.17评分点的偏差剩余价值打破垄断;多品牌GEO竞争存在社会困境,集体优化降低个体收益。

Comments 16 pages, 4 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10257 2026-08-25 cs.IR 版本更新 91%

GenRec: An LLM-Backed Recommendation Ranker at Netflix

GenRec:Netflix 一款基于大语言模型的推荐排序器

Ying Li, Shradha Sehgal, Arjun Rao, Rein Houthooft, Yaochen Zhu, Ashish Rastogi

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 Netflix 提出基于 LLM 的推荐排序器 GenRec,通过两阶段后训练实现,在大规模 A/B 测试中,其用更少标注数据即可取得显著指标提升,推动推荐范式转变并总结了部署经验。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20067 2026-08-25 cs.AI 版本更新 91%

MACD: Multi-Agent Clinical Diagnosis with Self-Learned Knowledge for LLM

MACD: 基于自学习知识的多智能体临床诊断

Wenliang Li, Rui Yan, Xu Zhang, Li Chen, Hongji Zhu, Jing Zhao, Junjun Li, Mengru Li, Wei Cao, Zihang Jiang, Wei Wei, Kun Zhang, Shaohua Kevin Zhou

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 MACD通过多智能体框架实现LLM自学习临床知识,提升诊断准确率,与医生单独诊断相比表现更优,展示人机协作的协同潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22833 2026-08-25 cs.MA cs.AI 新提交 90%

Minimal Local Simulation Foundations for LLM- and VLM-Driven Agents in 2D and 3D Environments

用于二维和三维环境中大型语言模型(LLM)与视觉语言模型(VLM)驱动智能体的极简局部仿真基础

Ryuki Hyodo

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出SD-AgentFoundry-2D和3D两款极简仿真基础,可在多系统本地运行,用于教育与快速原型设计,为学习生成式社会仿真及构建特定领域扩展提供便捷起点。

Comments GitHub Repositories: this https URL (https://github.com/ryukih/SD-AgentFoundry-2D) and this https URL (https://github.com/ryukih/SD-AgentFoundry-3D)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22135 2026-08-25 cs.IR 新提交 89%

GrOIL: Graph-Grounded Domain Ontology Induction with Constrained LLM Mediation

GrOIL:基于图的领域本体归纳与受限大语言模型调解

Maruf Ahmed Mridul, Abid Talukder, Oshani Seneviratne

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究提出GrOIL流程,以受限LLM调解的七阶段图基方法构建可审计OWL TBox,在人寿保险领域的基准测试中,其CQ覆盖率等指标优于LLM基线,可生成稳定领域表示。

Comments 12 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23028 2026-08-25 cs.AI 新提交 89%

PsychJail: Exploring Psychological Jailbreaks via Multi-Turn Persuasion of LLM Policies

PsychJail:通过对大语言模型策略的多轮说服探索心理越狱

Zeyu Feng, Qingyu Wu, Yuzhe Luo, Hua Cheng

机构 * The Defense Innovation Institute, Academy of Military Sciences(军事科学院国防创新研究院)

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出PsychJail框架,利用社会心理学技术构建攻击策略,通过轨迹级强化学习优化,在四个对齐LLM上实现87.3%平均攻击成功率,揭示了不同模型的心理画像指纹,为LLM安全红队提供了新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12484 2026-08-25 eess.SY cs.AI 版本更新 89%

One Request, Multiple Experts: LLM Orchestrates Domain Specific Models via Adaptive Task Routing

一个请求,多个专家:大语言模型通过自适应任务路由调度领域特定模型

Xu Yang, Chenhui Lin, Haotian Liu, Qi Wang, Yue Yang, Wenchuan Wu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)

AI总结 针对主动配电网运行的复杂调度难题,本文提出ADN-Agent架构,利用大语言模型协调领域特定模型,通过自适应任务路由等机制提升问题解决能力,性能优于现有大语言模型应用范式。

Comments Accepted by CSEE Journal of Power and Energy Systems in June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22176 2026-08-25 cs.AI cs.LG 新提交 88%

Role-Specialized Mixture-of-Agents with Open-Weight LLMs for Clinical Prediction

采用开源权重大语言模型的角色专业化智能体混合架构用于临床预测

Jun Hou, Yi Fang, Xuan Wang

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 该研究提出角色专业化的开源权重智能体混合架构,结合医学知识检索与相似患者推理,在死亡率预测上媲美闭源模型且标记更多高危患者,为隐私约束下的临床LLM预测提供关键角色设计思路。

Comments COLM 2026 DAIH Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22615 2026-08-25 cs.AI 新提交 88%

DeepSAGE: Stage-Aware Reinforcement Learning for Structured CBT Counseling Dialogue

DeepSAGE:用于结构化CBT咨询对话的阶段感知强化学习

Qi Zhang, Heajun An, Prakriti Dumaru, Sang Won Lee, Lifu Huang, Pamela J. Wisniewski, Jin-Hee Cho

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 DeepSAGE是融合LLM与DRL的阶段感知咨询对话框架,经评估在阶段目标完成与对话效率上优于6种替代方案,为AI咨询提供了有前景的新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.08786 2026-08-25 cs.CY cs.AI 版本更新 88%

Why we need an AI-resilient society- Profiling Large Language Models

为什么我们需要一个AI韧性社会

Thomas Bartz-Beielstein, Eva Bartz

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文探讨AI对社会的影响,提出通过认知主权、可测量控制和部分自主性构建AI韧性框架,以应对AI带来的系统性风险。

Comments Version 4. 36 pages. For associated TEDx video, see this https URL (https://youtu.be/f6c2ngp7rqY)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23104 2026-08-25 cs.CL cs.AI 新提交 88%

Molecular LLM Agents: From Architectural Design to Scientific Autonomy

分子大语言模型智能体:从架构设计到科学自主性

Jiatong Li, Wengyu Zhang, Weida Wang, Yuxuan Ren, Wei Liu, Chenyang Mao, Yuqiang Li, Yatao Bian, Changmeng Zheng, Xiaoyong Wei, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Shanghai AI Lab(上海人工智能实验室) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 领域大模型 :LLM(title,summary_cn);分类 cs.CL、cs.AI

AI总结 该研究提出分子LLM智能体的概念框架,从架构设计和科学自主性阶梯两方面展开,为分子领域LLM智能体的比较、设计评估及部署提供指导。

Comments 25pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23158 2026-08-25 cs.SE 新提交 88%

LLMCrater: Lifecycle-Aware FAIR Metadata Generation using Large Language Models

LLMCrater:基于大语言模型的生命周期感知型FAIR元数据生成框架

Dani Termaat, Nafiseh Soveizi, Zhiming Zhao, Marios Avgeris

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 该研究提出生命周期感知型元数据生成框架LLMCrater,结合LLMs与RO-Crate元数据概要,在科研生命周期四阶段逐步生成符合规范的元数据,经两个用例验证可生成有效RO-Crate。

Comments 2 pages, 1 figure. Accepted at the 22nd IEEE International Conference on e-Science (eScience 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14644 2026-08-25 cs.SE cs.AI 版本更新 86%

LSem2Vec: A Simple yet Effective Two-Stage Approach for Source Code Embedding

LSem2Vec:一种简单且有效的源代码嵌入两阶段方法

Zixiang Xian, Chenhui Cui, Rubing Huang, Chunrong Fang, Zhenyu Chen

机构 * Macau University of Science and Technology(澳门科学技术大学) Macau University of Science and Technology Zhuhai MUST Science and Technology Research Institute(澳门科学技术大学珠海 MUST 科技研究院) Nanjing University(南京大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 LSem2Vec是结合LLM与句子嵌入模型的两阶段源代码嵌入方法,无需特定任务训练,在三个多语言数据集上优于五种无监督基线,可推进软件工程领域发展。

Comments The article has been accepted by Frontiers ofComputer Science (FCS), with the DOI:{ https://doi.org/10.1007/s11704-026-61288-0 )

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23131 2026-08-25 cs.IR 新提交 86%

A Dual-Expert Strategy Integrating LLMs to Mitigate Negative Transfer in Cross-Domain Sequential Recommendation

一种集成大语言模型的双专家策略以缓解跨域序列推荐中的负迁移

Hyeongjun Yun, Kihyuk Song, Jaegul Choo, Chung Park

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于LLM的CDSR模型DuELRec,通过域门控双专家框架与双采样对比学习缓解跨域序列推荐的负迁移,在10个域的2个数据集上优于26种SOTA方法。

Comments Accepted at CIKM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21547 2026-08-25 cs.CR 新提交 86%

Enhancing User Resilience Against AI-Augmented Phishing: A Two-Stage Framework for Detection and Personalized Training

增强用户抵御AI增强型钓鱼攻击的能力:一种用于检测和个性化训练的两阶段框架

Weihao Qu, Gurmeet Singh, Daniel Crawford, Bingjun Li, Jalen Smith

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对AI增强型钓鱼攻击带来的新威胁,研究人员提出两阶段反钓鱼框架CyberGLA,结合EmailKnight检测工具与LLM安全教练,实现技术防御与个性化用户训练,以提升用户抵御此类攻击的能力。

Comments 7 pages, 2 figures, 2 tables. Published in the Journal of The Colloquium for Information Systems Security Education

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22967 2026-08-25 cs.CL 新提交 85%

Closed-Loop Bayesian Molecular Inverse Design with Semantic LLM Surrogates

基于语义大语言模型代理的闭环贝叶斯分子逆设计

Yaoyao Xu, Xinjian Zhao, Xiaozhuang Song, Lei Bai, Tianshu Yu

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 该研究提出基于语义大语言模型代理的闭环贝叶斯分子逆设计框架,在MolQA任务上优于一次性提示,与GP-based BO基线相当或更优,且揭示了领域依赖的参考转移与摘要添加的接口

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10358 2026-08-25 cs.CV cs.AI 版本更新 85%

Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift

在域转移下对用于乳腺钼靶成像的基础模型的稳健性进行基准测试

Giang Nguyen, Raghav Mehta, Emma A.M. Stanley, Tian Xia, Thi Hao Nguyen, Hieu Pham, Ben Glocker

机构 * College of Engineering and Computer Science, VinUniversity(工程与计算机科学学院,文大大学) Imperial College London(伦敦帝国理工学院) Radiology Department, Vietnam National Cancer Hospital(越南国家癌症医院放射科) VinUni-Illinois Smart Health Center, VinUniversity(文大大学 - 伊利诺伊智能健康中心,文大大学) The Computer Vision and Medical AI Lab, VinUniversity(计算机视觉与医学人工智能实验室,文大大学)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);pretraining(abstract);分类 cs.AI

AI总结 研究在域转移下乳腺钼靶成像基础模型的稳健性,用统一协议在多数据集上训练评估15种模型主干,发现特定视觉语言模型性能强,DINOv3是有竞争力基线,适应预训练未持续提升泛化,强调数据集级OOD评估是核心标准。

Comments Accepted at Deep-Brea3th 2026 workshop in conjunction with MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22622 2026-08-25 cs.CL cs.AI 新提交 85%

Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains

通过OMOP对齐检索教导大型语言模型(LLM)采用ICU医师的临床推理方式可提升跨临床领域的推理能力

Miguel Contreras, Scott Siegel, Subhash Nerella, Jessica Sena, Jiaqing Zhang, Heng Sun, Hruday Tej Akkaladevi, Peiyu Lu, Jordan Rosen, Sumit Kapoor, Sasank Desaraju, Grace R. Thompson, Jacob Purcell, Michael Petrauskis, Philip KW. Hong, Meghan Brennan, Sarah Chrabaszcz, Tierra Smith, Ronnie Ren, Michel S. Kabbash, Ceyhun Haziroglu, Rushi Patel, Gabriel Gomez, Charlotte Chaiklin, Randy Leung, Kenneth N. John, Whitman Wiggins, Philip Kayser, Vincent Bird, Maria Bruzzone, Tyler J. Loftus, Azra Bihorac, Parisa Rashidi

机构 * University of Florida(佛罗里达大学)

专题命中 领域大模型 :LLM(title_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究开发ICU-REACT推理数据集并微调Clin-REACT模型,使其学习ICU医师的临床推理方式,该模型在五个临床推理基准中表现优于多款模型,可提升跨领域临床推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22242 2026-08-25 cs.CY 新提交 83%

Unfolding the Interdisciplinary Complexities of Climate Science: Fuxi-Climate Foundational Model

解析气候科学的跨学科复杂性:伏羲气候基础模型

Zhengyu Shi, Shaojie Shi, Rui Xu, Bohao Lv, Zhichao Chen, Jiaran Hao, Zijian Chen, Weiqi Tang, Yuan Qi, Yinghui Xu, Libo Wu

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 该研究提出气候专用大型语言模型Fuxi-Climate基础模型,其在跨学科气候推理中性能更稳定,能实现高权衡覆盖度与不确定性感知推理,可为气候风险分析及智能体决策系统提供支撑。

Comments 28 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22754 2026-08-25 cs.CV cs.AI 版本更新 83%

Procedural Knowledge Extraction from Industrial Troubleshooting Guides Using Vision Language Models

从工业故障排除指南中提取程序性知识:使用视觉语言模型

Guillermo Gil de Avalle, Laura Maruster, Christos Emmanouilidis

机构 * University of Groningen(Groningen大学)

专题命中 领域大模型 :language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 本文研究如何利用视觉语言模型从工业故障排除指南中提取结构化知识,通过对比两种提示策略评估模型性能,揭示布局敏感性与语义稳健性的权衡。

Comments Accepted to the 23rd IFAC World Congress (IFAC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22724 2026-08-25 cs.CE 新提交 82%

Frontiers in FinTech: Multimodal Foundation Models for Financial Reporting and Decision Science

金融科技前沿:面向财务报告与决策科学的多模态基础模型

Yulu Huang, Niannian Yu, Yaxin Yang, Yong Huang

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract)

AI总结 针对异构财务数据对会计信息系统的挑战,本研究提出多模态大语言模型FinVision,经200家上市公司验证可降低19%估值误差,48名专业用户测试缩短51%任务时间,助力审计自动化与财务分析民主化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22089 2026-08-25 cs.CR cs.AI 新提交 81%

On Predicting Vulnerability Severity Using In-Context Learning: An Industrial Case Study

利用上下文学习预测漏洞严重性:一项工业案例研究

Daniel Rodriguez-Cardenas, David Nader Palacio, Anna Schmedding, Yiyang Lu, Aadil Mallick, Bill Hudson, Chris Gourley, Michael Roytman, Chris Shenefiel, Evgenia Smirni, Denys Poshyvanyk

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本研究通过工业案例,用可本地部署的开源LLM的上下文学习从C/C++代码片段预测CVSS v3.1评分,发现CodeLlama2-7B在轻量输出约束提示下可接近云服务性能,且Big-Vul可作为工业数据代理。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21381 2026-08-25 cs.CY cs.CL 新提交 81%

PersonaMem-v3: Toward Omni-Platform Personal Intelligence for Holistic User Understanding, Recommendation, and Agentic Tasks

PersonaMem-v3:面向全平台个人智能以实现全面的用户理解、推荐及智能体任务

Bowen Jiang, Yuan Yuan, Zhuoqun Hao, Yuchen Liu, Maohao Shen, Sihao Chen, Gregory Wornell, Chris Callison-Burch, Lyle Ungar, Dan Roth, Qi Guo, Xiangjun Fan, Camillo J. Taylor, Hanchao Yu

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 该研究提出PersonaMem-v3基准,用于评估全平台个人智能,助力开发兼具跨场景用户理解、可控推荐及合理个性化能力的LLM驱动智能体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23146 2026-08-25 cs.SE 新提交 80%

An AI-Assisted Migration Framework for Transforming Legacy Scientific Applications into Reusable Cloud-Based Workflows

一种将遗留科学应用转换为可重用云工作流的AI辅助迁移框架

Nafiseh Soveizi, Sven Tesselaar, Hero Robinson Brouwer, Zhiming Zhao

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 该研究提出结合RM-ODP、LLMs和DSM分析的AI辅助迁移框架,成功将两个不同领域的遗留科学应用转换为保留原功能的可重用云工作流,为遗留科学软件现代化提供可行方案。

Comments 8 pages, 2 figures, 5 tables. Accepted at the 22nd IEEE International Conference on e-Science (eScience 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23484 2026-08-25 cs.AI 新提交 79%

Multi-Modal Semantic Expansion with Constrained LLM Reranking for Conversational Music Recommendation

结合约束大语言模型重排序的多模态语义扩展用于对话式音乐推荐

Naman Garg, Sarika Jain, George Fazekas

机构 * National Institute of Technology Kurukshetra(库鲁克谢特拉国家技术学院) Queen Mary University of London(伦敦玛丽女王大学)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

AI总结 该研究针对ACM RecSys 2026挑战赛提出三阶段多模态对话音乐推荐系统,经优化后在Blind B获0.3213综合分,发现约束大语言模型注入的会话数量对Blind A的nDCG有显著影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22968 2026-08-25 cs.LG 新提交 79%

Do Time-Series Foundation Models Pay Off for Industrial Monitoring? A Cost-Aware Empirical Study

时间序列基础模型对工业监测是否有效?一项感知成本的实证研究

Guan-Hua Wen, Kuan-Yu Chen

机构 * National Taiwan University of Science and Technology(台湾科技大学)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 本研究通过三类工业监测场景对比评估时间序列基础模型与轻量基线的性能及成本,发现TSFMs并非拟合轻量模型的默认替代,而是任务依赖的部署选项。

Comments Accepted for poster presentation at CIF26 (2026), Poster P01013. 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22802 2026-08-25 cs.CL cs.AI 新提交 79%

SDoH-Aware Narrative Anchoring Bias in Medical LLMs for Trustworthy Clinical Decision Support

面向可信临床决策支持的、关注社会决定健康因素(SDoH)的医学大语言模型叙事锚定偏差

Ahnaf Atef Choudhury, Ramkrishna Saha

机构 * George Mason University(乔治梅森大学) The University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对医学大语言模型的叙事锚定偏差问题,以Qwen2.5系列模型为对象开展实验,发现7B模型仍存在较高叙事敏感性误差,提出需结合正确率与叙事稳定性评估临床决策支持模型。

Comments Accepted for publication at 10th International Artificial Intelligence and Data Processing Symposium (IDAP'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22167 2026-08-25 cs.AI cs.LG 新提交 79%

MCP-Universe RL: A Framework for Training MCP Tool-Use Agents via Reinforcement Learning

MCP-Universe RL:一种通过强化学习训练MCP工具使用智能体的框架

Ziyang Luo, Yan Yang, Xiangru Jian, Ziji Shi, Xiaoqiang Lin, Jun Hao Liew, Silvio Savarese, Junnan Li

机构 * Salesforce AI Research(Salesforce AI研究院)

专题命中 领域大模型 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出MCP-U RL开源框架,依托MCP协议解决RL训练中环境搭建与GPU利用率问题,在gpt-oss-20b上训练三类工具使用智能体并提升了任务奖励。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21612 2026-08-25 physics.optics 新提交 78%

Machine Learning to Foundation Models: Artificial Intelligence for Nanophotonic Modeling and Scientific Discovery

从机器学习到基础模型:用于纳米光子学建模与科学发现的人工智能

Chaobin Yang, Xueqing Liu, Yiqun Fu, Fengbo Zhou, Krzysztof Kempa, Stefano Anzellotti, Michael J. Naughton

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 本综述梳理了纳米光子学领域AI从机器学习到基础模型的发展,介绍了相关平台、问题与方法,分析了当前基础模型的局限并展望了多模态模型的未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏