arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-15 至 2025-12-15 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 15 篇

2512.10996 2025-12-15 cs.CL cs.AI 90%

MedBioRAG: Semantic Search and Retrieval-Augmented Generation with Large Language Models for Medical and Biological QA

MedBioRAG: 基于大语言模型的语义搜索与检索增强生成用于医学和生物学问答

Seonok Kim

机构 * Seonok Kim(独立研究者)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 MedBioRAG通过结合语义搜索、文档检索和监督微调,提升医学和生物学问答任务的性能。

Comments Submitted to ACL 2025. 9 pages, 4 figures, 5 tables (including 2 appendix tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11544 2025-12-15 cs.AI 88%

AI-MASLD Metabolic Dysfunction and Information Steatosis of Large Language Models in Unstructured Clinical Narratives

AI-MASLD 大语言模型在无结构临床叙述中的代谢功能障碍与信息脂肪变

Yuan Shen, Xiaojun Wu, Linghua Yu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究首次实证表明大语言模型在处理临床信息时表现出类似代谢功能障碍的特征,提出AI-MASLD概念,强调需在人类监督下使用LLMs作为辅助工具。

Comments 47 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10206 2025-12-15 cs.AI 88%

CP-Env: Evaluating Large Language Models on Clinical Pathways in a Controllable Hospital Environment

CP-Env:在可控医院环境中评估大型语言模型在临床路径中的表现

Yakun Zhu, Zhongzhen Huang, Qianhan Feng, Linjie Mu, Yannian Gu, Shaoting Zhang, Qi Dou, Xiaofan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) The Chinese University of Hong Kong(香港中文大学) SenseTime Research(商汤科技研究院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 CP-Env通过可控医院环境评估大型语言模型在复杂临床路径中的表现,揭示其在决策和伦理方面的挑战,并推动医疗AI的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00679 2025-12-15 cs.IR 88%

ProEx: A Unified Framework Leveraging Large Language Model with Profile Extrapolation for Recommendation

ProEx:一种利用大语言模型与特征外推的统一框架用于推荐

Yi Zhang, Yiwen Zhang, Yu Wang, Tong Chen, Hongzhi Yin

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 ProEx通过多维度资料外推提升推荐系统性能,利用链式推理构建多样化的用户和物品资料,以增强推荐效果。

Comments Accepted by KDD 2026 (First Cycle)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11573 2025-12-15 cs.CL cs.LG 86%

Visualizing token importance for black-box language models

对黑盒语言模型的令牌重要性可视化

Paulius Rauba, Qiyao Wei, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出DBSA方法,用于可视化黑盒语言模型中各输入令牌的重要性,以评估模型输出对输入的依赖性。

Journal ref Proceedings of the 28th International Conference on Artifi- cial Intelligence and Statistics (AISTATS) 2025, Mai Khao, Thailand. PMLR: Volume 258

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11661 2025-12-15 cs.HC cs.AI 85%

From Verification Burden to Trusted Collaboration: Design Goals for LLM-Assisted Literature Reviews

从验证负担到可信协作:LLM辅助文献综述的设计目标

Brenda Nogueira, Werner Geyer, Andrew Anderson, Toby Jia-Jun Li, Dongwhi Kim, Nuno Moniz, Nitesh V. Chawla

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文针对LLM辅助文献综述中的信任和协作问题,提出六个设计目标和框架,通过可视化、验证和反馈对齐提升可信度与协作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11502 2025-12-15 cs.CL 81%

Building Patient Journeys in Hebrew: A Language Model for Clinical Timeline Extraction

用希伯来语构建患者旅程:一种用于临床时间线提取的语言模型

Kai Golan Hashiloni, Brenda Kasabe Nokai, Michal Shevach, Esthy Shemesh, Ronit Bartin, Anna Bergrin, Liran Harel, Nachum Dershowitz, Liat Nadai Arad, Kfir Bar

机构 * Efi Arazi School of Computer Science, Reichman University, Herzilya, Israel(Reichman大学埃菲·阿拉兹计算机科学学院) Tel Aviv Sourasky Medical Center, Israel(特拉维夫 Sourasky 医院) School of Computer Science and AI, Tel Aviv University, Israel(特拉维夫大学计算机科学与人工智能学院)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL;large language model(comments)

AI总结 本文提出一种希伯来语医学语言模型,用于从电子健康记录中提取结构化临床时间线,以构建患者旅程,并通过两个新数据集验证了其有效性。

Comments In Proceedings of the Workshop on Large Language Models and Generative AI for Health Informatics 2025, IJCAI 2025, Montreal, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11202 2025-12-15 astro-ph.IM cs.AI cs.DL cs.LG 79%

amc: The Automated Mission Classifier for Telescope Bibliographies

amc:望远镜文献的自动任务分类器

John F. Wu, Joshua E. G. Peek, Sophie J. Miller, Jenny Novacescu, Achu J. Usha, Christopher A. Wilkinson

机构 * Space Telescope Science Institute(空间望远镜科学研究所)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 amc利用大型语言模型自动分类望远镜文献,有效提升天文文献处理效率,适用于历史数据检查与标签错误识别。

Comments Accepted to IJCNLP-AACL WASP 2025 workshop. Code available at: https://github.com/jwuphysics/automated-mission-classifier

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10867 2025-12-15 cs.CV 78%

From Macro to Micro: Benchmarking Microscopic Spatial Intelligence on Molecules via Vision-Language Models

从宏观到微观:通过视觉-语言模型在分子上基准测试微观空间智能

Zongzhao Li, Xiangzhe Kong, Jiahui Su, Zongyang Ma, Mingze Li, Songyou Li, Yuelin Zhang, Yu Rong, Tingyang Xu, Deli Zhao, Wenbing Huang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程研究中心) Dept. of Comp. Sci. & Tech., Tsinghua University(清华大学计算机科学与技术系) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) SKL-ESPC & SEPKL-AERM, College of Environmental Sciences and Engineering, Peking University(环境科学与工程学院,北京大学) MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院) DAMO Academy, Alibaba Group, Hangzhou, China(阿里巴巴集团 DAMO Academy,中国杭州) Hupan Lab, Hangzhou, China(杭州实验室)

专题命中 领域大模型 :language model(title,abstract)

AI总结 本文提出MiSI-Bench基准测试框架,评估视觉-语言模型在分子微观空间智能任务中的表现,发现微调模型在空间转换任务上超越人类,但需整合领域知识以推动科学AGI发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11474 2025-12-15 cs.AI cs.CY cs.IR 77%

General-purpose AI models can generate actionable knowledge on agroecological crop protection

通用人工智能模型可为生态农业作物保护生成可操作的知识

Kris A. G. Wyckhuys

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 通用人工智能模型在生态农业作物保护中生成可操作知识,通过对比DeepSeek与ChatGPT的性能,展示其在科学知识生成和决策支持中的潜力。

Comments 33 pages, 3 figures, 3 tables, 1 supplementary table

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10991 2025-12-15 cs.LG cs.AI physics.chem-ph q-bio.QM 62%

MolSculpt: Sculpting 3D Molecular Geometries from Chemical Syntax

MolSculpt:从化学语法雕刻3D分子几何

Zhanpeng Chen, Weihao Gao, Shunyu Wang, Yanan Zhu, Hong Meng, Yuexian Zou

机构 * AI for Science (AI4S)-Preferred Program, Peking University Shenzhen Graduate School, China(人工智能科学(AI4S)优选计划,北京大学深圳研究生院,中国) Faculty of Materials Science, Shenzhen MSU-BIT University, Shenzhen, China(材料科学学院,深圳MSU-BIT大学,中国)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 MolSculpt通过整合1D化学知识与3D生成过程,实现了从化学语法到精确3D分子几何的高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11251 2025-12-15 cs.LG 57%

Insight Miner: A Time Series Analysis Dataset for Cross-Domain Alignment with Natural Language

Insight Miner: 一个用于跨领域对齐的时间序列分析数据集与自然语言

Yunkai Zhang, Yawen Zhang, Ming Zheng, Kezhen Chen, Chongyang Gao, Ruian Ge, Siyuan Teng, Amine Jelloul, Jinmeng Rao, Xiaoyuan Guo, Chiang-Wei Fang, Zeyu Zheng, Jie Yang

机构 * UC Berkeley(加州大学伯克利分校) Mineral(矿石) Northwestern University(西北大学)

专题命中 领域大模型 :instruction tuning(abstract);分类 cs.LG

AI总结 Insight Miner 是一个大规模多模态模型,通过代理工作流生成高质量时间序列描述,提升跨领域时间序列分析能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16979 2025-12-15 cs.CV cs.AI 57%

The Finer the Better: Towards Granular-aware Open-set Domain Generalization

更细的更好:面向粒度感知的开集域泛化

Yunyun Wang, Zheng Duan, Xinyue Liao, Ke-Jia Chen, Songcan Chen

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 SeeCLIP通过细粒度语义增强解决开集域泛化中的结构风险与开放空间风险困境,提升模型对难区分未知类别的判别能力。

Comments 9 pages,3 figures,aaai2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11183 2025-12-15 cs.LG 57%

Progress over Points: Reframing LM Benchmarks Around Scientific Objectives

基于点的进展:围绕科学目标重新构建语言模型基准测试

Alwin Jin, Sean M. Hendryx, Vaskar Nath

机构 * Georgia Institute of Technology(佐治亚理工学院) Scale AI

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 本文提出以科学目标为导向的语言模型基准测试环境,通过标准化数据集和训练框架,推动语言模型领域的科学进步。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11548 2025-12-15 cs.CV 50%

SSL-MedSAM2: A Semi-supervised Medical Image Segmentation Framework Powered by Few-shot Learning of SAM2

SSL-MedSAM2: 一种由SAM2少样本学习驱动的半监督医学图像分割框架

Zhendi Gong, Xin Chen

机构 * School of Computer Science, University of Nottingham, UK(Nottingham大学计算机科学学院)

专题命中 领域大模型 :foundation model(abstract)

AI总结 SSL-MedSAM2通过SAM2的少样本学习和nnUNet的迭代监督学习,在肝脏分割任务中实现了高精度的半监督医学图像分割。

Comments Accepted by MICCAI 2025 CARE Challenge, waiting for publication

详情

展开后加载摘要…

URL PDF HTML 收藏