arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-09 至 2026-02-09 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 14 篇

2602.06190 2026-02-09 cs.HC cs.AI cs.CL 90%

Generics in science communication: Misaligned interpretations across laypeople, scientists, and large language models

科学传播中的泛化:面向非专业人士、科学家和大型语言模型的解释差异

Uwe Peters, Andrea Bertazzoli, Jasmine M. DeJesus, Gisela J. van der Velden, Benjamin Chin-Yee

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究揭示了科学传播中泛化陈述在不同受众间的解释差异,指出非专业人士和LLM对泛化陈述的高可推广性评分可能带来风险,强调需重视语言选择以提升科学传播效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06449 2026-02-09 cs.CL 89%

Evaluating an evidence-guided reinforcement learning framework in aligning light-parameter large language models with decision-making cognition in psychiatric clinical reasoning

评估一种证据引导的强化学习框架在对齐光参数大语言模型与精神科临床推理决策认知中的作用

Xinxin Lin, Guangxin Dai, Yi Zhong, Xiang Li, Xue Xiao, Yixin Zhang, Zhengdong Wu, Yongbo Zheng, Runchuan Zhu, Ming Zhao, Huizi Yu, Shuo Wu, Jun Zhao, Lingming Hu, Yumei Wang, Ping Yin, Joey W. Y. Chan, Ngan Yin Chan, Sijing Chen, Yun Kwok Wing, Lin Lu, Xin Ma, Lizhou Fan

机构 * The Chinese University of Hong Kong, Shatin, N.T., Hong Kong SAR, China(香港中文大学) Shandong University, Jinan, China(山东大学) Peking University Sixth Hospital, Beijing, China(北京大学第六医院) Inspur Cloud Information Technology Co., Ltd., Jinan, China(Inspur 云技术有限公司) Fudan University, Shanghai, China(复旦大学) Shandong Provincial Hospital Affiliated to Shandong First Medical University, Jinan, China(山东第一医科大学附属山东省人民医院) Jilin University, Changchun, China(吉林大学) Hong Kong ICI Cloud Service Limited, Hong Kong SAR, China(香港ICI云服务有限公司) Shandong First Medical University, Jinan, China(山东第一医科大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究提出ClinMPO框架,通过证据引导的强化学习使轻量LLM在复杂精神病学推理任务中达到超越人类的准确率。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20975 2026-02-09 cs.LG cs.AI 88%

Knowledgeable Language Models as Black-Box Optimizers for Personalized Medicine

具备知识的语言模型作为个性化医疗的黑盒优化器

Michael S. Yao, Osbert Bastani, Alma Andersson, Tommaso Biancalani, Aïcha Bentaieb, Claudia Iriondo

机构 * University of Pennsylvania(宾夕法尼亚大学) Genentech(基因泰克)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

AI总结 本文提出LEON方法,利用大语言模型作为黑盒优化器,结合领域知识提升个性化医疗治疗方案的优化效果。

Comments 63 pages, Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06402 2026-02-09 cs.CV 82%

MeDocVL: A Visual Language Model for Medical Document Understanding and Parsing

MeDocVL:一种用于医疗文档理解与解析的视觉语言模型

Wenjie Wang, Wei Wu, Ying Liu, Yuan Zhao, Xiaole Lv, Liang Diao, Zengjian Fan, Wenfeng Xie, Ziling Lin, De Shi, Lin Huang, Kaihe Xu, Hong Li

机构 * Visual Computing Group (VCG)(视觉计算组)

专题命中 领域大模型 :language model(title,abstract);post-training(abstract)

AI总结 MeDocVL通过训练驱动的标签细化和噪声意识的混合后训练策略,实现了对医疗文档的高精度解析,优于现有OCR和VLM方法。

Comments 20 pages, 8 figures. Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04210 2026-02-09 cs.AI cs.LG 79%

Steering LLMs via Scalable Interactive Oversight

通过可扩展的交互监督引导大语言模型

Enyu Zhou, Zhiheng Xi, Long Ma, Zhihao Zhang, Shihan Dou, Zhikai Lei, Guoteng Wang, Rui Zheng, Hang Yan, Tao Gui, Qi Zhang, Xuanjing Huang

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

AI总结 本文提出可扩展的交互监督框架,通过递归决策树提升人类对AI任务的引导能力,实现非专家生成高质量产品需求文档,并通过强化学习优化

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06619 2026-02-09 cs.CV 78%

CauCLIP: Bridging the Sim-to-Real Gap in Surgical Video Understanding via Causality-Inspired Vision-Language Modeling

CauCLIP:通过因果启发的视觉-语言模型弥合手术视频理解的仿真到现实差距

Yuxin He, An Li, Cheng Xue

专题命中 领域大模型 :language model(title,abstract)

AI总结 CauCLIP通过因果启发的视觉-语言模型,在不访问目标领域数据的情况下,提升手术视频理解的领域泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00169 2026-02-09 cond-mat.mtrl-sci cs.AI 77%

Towards Agentic Intelligence for Materials Science

迈向材料科学的代理智能

Huan Zhang, Yizhan Li, Wenhao Huang, Ziyu Hou, Yu Song, Xuye Liu, Farshid Effaty, Jinya Jiang, Sifan Wu, Qianggang Ding, Izumi Takahara, Leonard R. MacGillivray, Teruyasu Mizoguchi, Tianshu Yu, Lizi Liao, Yuyu Luo, Yu Rong, Jia Li, Ying Diao, Heng Ji, Bang Liu

机构 * DIRO & Institut Courtois, Université de Montréal(蒙特利尔大学DIRO与Courtois研究所) Mila – Quebec AI Institute(魁北克AI研究所) University of Waterloo(滑铁卢大学) Université de Sherbrooke(Sherbrooke大学) University of California, San Diego(加州大学圣地亚哥分校) The University of Tokyo, Institute of Industrial Science(东京大学工业科学研究所) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Singapore Management University(新加坡管理学院) The Hong Kong University of Science and Technology, Guangzhou(香港科学与技术大学(广州)) Alibaba DAMO Academy(阿里巴巴达摩院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) CIFAR AI Chair(CIFAR人工智能主席)

专题命中 领域大模型 :LLM(abstract);instruction tuning(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出以流程为中心的代理系统框架,通过整合人工智能与材料科学,推动材料发现的自主化与智能化。

Comments 81 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12091 2026-02-09 cs.AI cond-mat.mtrl-sci cond-mat.soft 77%

ToPolyAgent: AI Agents for Coarse-Grained Topological Polymer Simulations

ToPolyAgent:用于拓扑聚合物粗粒化拓扑模拟的AI代理

Lijie Ding, Jan-Michael Carrillo, Changwoo Do

机构 * Neutron Scattering Division, Oak Ridge National Laboratory(中子散射部,橡树岭国家实验室) Center for Nanophase Materials Sciences, Oak Ridge National Laboratory(纳米相材料科学中心,橡树岭国家实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ToPolyAgent通过自然语言指令实现拓扑聚合物粗粒化模拟,结合多代理AI框架提升聚合物科学计算效率。

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06359 2026-02-09 cs.LG cs.AI 73%

Training Data Selection with Gradient Orthogonality for Efficient Domain Adaptation

基于梯度正交性的训练数据选择用于高效的领域适应

Xiyang Zhang, Yuanhe Tian, Hongzhi Wang, Yan Song

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出OGS方法,通过梯度正交性选择训练数据,提升领域适应的效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06268 2026-02-09 cs.CL cs.LG 73%

MPIB: A Benchmark for Medical Prompt Injection Attacks and Clinical Safety in LLMs

MPIB:用于医疗提示注入攻击和大语言模型临床安全性的基准

Junhyeok Lee, Han Jang, Kyu Sung Choi

机构 * Seoul National University College of Medicine(首尔国立大学医学院) Seoul National University(首尔国立大学) Seoul National University College of Medicine, Seoul National University Hospital(首尔国立大学医学院、首尔国立大学医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 MPIB是一个用于评估医疗提示注入攻击和大语言模型临床安全性的基准,通过测量临床危害事件率和攻击成功率来评估模型的安全性。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06570 2026-02-09 cs.CL 70%

Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making

Baichuan-M3:用于可靠医疗决策的临床查询建模

M3 Team, Chengfeng Dou, Fan Yang, Fei Li, Jiyuan Jia, Qiang Ju, Shuai Wang, Tianpeng Li, Xiangrong Zeng, Yijie Zhou, Hongda Zhang, Jinyang Tai, Linzhuang Sun, Peidong Guo, Yichuan Mo, Xiaochuan Wang, Hengfu Cui, Zhishou Zhang

机构 * Baichuan-M3 Team(Baichuan-M3团队)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Baichuan-M3通过建模临床查询流程,实现了医疗决策支持的可靠性和准确性,优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02071 2026-02-09 cs.AI 70%

Human-AI Co-Embodied Intelligence for Scientific Experimentation and Manufacturing

人类-人工智能协同具身智能用于科学实验与制造

Xinyi Lin, Yuyang Zhang, Yuanhang Gan, Juntao Chen, Hao Shen, Yichun He, Lijun Li, Ze Yuan, Shuang Wang, Chaohao Wang, Rui Zhang, Na Li, Jia Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出人类-人工智能协同具身智能,通过智能体-物理实验系统提升科学实验与制造的精度与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06496 2026-02-09 hep-ph 67%

CoLLM: AI engineering toolbox for end-to-end deep learning in collider analyses

CoLLM:用于碰撞分析中端到端深度学习的AI工程工具包

W. Esmail, A. Hammad, M. Nojiri

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 CoLLM通过预训练语言模型生成物理一致的分析代码,结合图形界面实现端到端碰撞分析自动化,降低编程复杂度。

Comments 43 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15867 2026-02-09 cs.HC 67%

FAIR: Framing AIs Role in Programming Competitions -- Understanding How LLMs Are Changing the Game in Competitive Programming

FAIR: 人工智能在编程竞赛中的角色框架——理解LLMs如何改变竞赛游戏

Dongyijie Primo Pan, Lan Luo, Ji Zhu, Zhiqi Gao, Xin Tong, Pan Hui

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文研究LLMs对编程竞赛的影响,通过访谈和数据调查,分析工作流程变化和公平规范,并提出治理方法以遏制AI滥用。

Comments 23 pages, 5 figures. In Proceedings of the 44th ACM Conference on Human Factors in Computing Systems (CHI '26), Barcelona, Spain, April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏