arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-18 至 2025-12-18 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 13 篇

2506.07400 2025-12-18 cs.MA cs.AI cs.CV cs.LG 90%

MedChat: A Multi-Agent Framework for Multimodal Diagnosis with Large Language Models

MedChat: 一种基于大语言模型的多智能体多模态诊断框架

Philip R. Liu, Sparsh Bansal, Jimmy Dinh, Aditya Pawar, Ramani Satishkumar, Shail Desai, Neeraj Gupta, Xin Wang, Shu Hu

机构 * University at Albany, State University of New York(纽约州立大学阿布扎克分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 MedChat通过多智能体框架结合专用视觉模型和角色特定LLM代理,提升多模态诊断的可靠性与交互性。

Journal ref Proc. 2025 IEEE 8th International Conference on Multimedia Information Processing and Retrieval (MIPR), pp. 456-462, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05688 2025-12-18 cs.IR 88%

LLM4ES: Learning User Embeddings from Event Sequences via Large Language Models

LLM4ES: 通过大语言模型学习事件序列中的用户嵌入

Aleksei Shestov, Omar Zoloev, Maksim Makarenko, Mikhail Orlov, Egor Fadeev, Ivan Kireev, Andrey Savchenko

专题命中 领域大模型 :language model(title,abstract);large language model(title);LLM(abstract)

AI总结 LLM4ES通过大语言模型学习事件序列中的用户嵌入,实现金融等领域用户分类任务的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15312 2025-12-18 cs.CL cs.AI 86%

Evaluating LLMs for Zeolite Synthesis Event Extraction (ZSEE): A Systematic Analysis of Prompting Strategies

评估用于沸石合成事件提取(ZSEE)的LLM:对提示策略的系统分析

Charan Prakash Rathore, Saumi Ray, Dhruv Kumar

机构 * Birla Institute of Technology and Science, Pilani, India(巴尔·印度技术科学学院,比兰利,印度)

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文评估了不同提示策略在沸石合成事件提取中的效果,发现零样本方法在事件分类上表现优异,但细粒度提取任务需领域适应模型。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15365 2025-12-18 cs.DB cs.IR 85%

ArcBERT: An LLM-based Search Engine for Exploring Integrated Multi-Omics Metadata

ArcBERT: 一个基于大语言模型的集成多组学元数据探索搜索引擎

Gajendra Doniparthi, Shashank Balu Pandhare, Stefan Deßloch, Timo Mühlhaus

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ArcBERT是一种基于大语言模型的搜索引擎,通过语义匹配和元数据结构理解,提升多组学数据的探索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01398 2025-12-18 cs.AI 77%

The Need for Verification in AI-Driven Scientific Discovery

人工智能驱动科学发现中的验证需求

Cristina Cornelio, Takuya Ito, Ryan Cory-Wright, Sanjeeb Dash, Lior Horesh

机构 * Samsung AI, Cambridge, UK(三星人工智能,英国坎布里奇) IBM Research, Yorktown Heights, USA(IBM研究院,美国尤里茨山) Imperial Business School, London, UK(帝国商业学院,英国伦敦)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了人工智能驱动科学发现中验证的重要性,指出验证机制是确保科学进步的关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15384 2025-12-18 cs.IR 75%

MedNuggetizer: Confidence-Based Information Nugget Extraction from Medical Documents

MedNuggetizer: 基于置信度的信息 nugget 从医学文档中提取

Gregor Donabauer, Samy Ateia, Udo Kruschwitz, Maximilian Burger, Matthias May, Christian Gilfrich, Maximilian Haas, Julio Ruben Rodas Garzaro, Christoph Eckl

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 MedNuggetizer 通过大型语言模型提取和聚类医学文档中的信息 nugget,帮助临床医生高效获取可靠的医学证据。

Comments Preprint accepted at ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18828 2025-12-18 math.ST cs.AI cs.LG stat.TH 73%

Solving a Research Problem in Mathematical Statistics with AI Assistance

利用人工智能辅助解决数学统计学中的研究问题

Edgar Dobriban

机构 * Department of Statistics and Data Science, University of Pennsylvania(统计与数据科学系,宾夕法尼亚大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 利用GPT-5辅助解决数学统计学中稳健密度估计的未解决问题,推导出最小最大最优误差率。

Comments added references

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15298 2025-12-18 cs.AI cs.CL cs.CY 73%

ChatGPT and Gemini participated in the Korean College Scholastic Ability Test -- Earth Science I

ChatGPT 和 Gemini 参与韩国大学入学考试——地球科学I

Seok-Hyun Ga, Chun-Yen Chang

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究分析了ChatGPT和Gemini在地球科学I考试中的多模态推理能力,发现模型在感知与认知之间存在差距,揭示了AI在科学评估中的局限性。

Comments 23 pages, 9 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15126 2025-12-18 cs.AI cs.CL 73%

aiXiv: A Next-Generation Open Access Ecosystem for Scientific Discovery Generated by AI Scientists

aiXiv:一个由AI科学家生成的下一代开放获取生态系统

Pengsong Zhang, Xiang Hu, Guowei Huang, Yang Qi, Heng Zhang, Xiuxu Li, Jiaxing Song, Jiabin Luo, Yijiang Li, Shuo Yin, Chengxiao Dai, Eric Hanchen Jiang, Xiaoyan Zhou, Zhenfei Yin, Boqin Yuan, Jing Dong, Guinan Su, Guanren Qiao, Haiming Tang, Anghong Du, Lili Pan, Zhenzhong Lan, Xinyu Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 aiXiv是一个由AI科学家生成的下一代开放获取生态系统,通过多代理架构和API接口,实现人类与AI科学家的协同,提升AI生成科研内容的质量和传播效率。

Comments Preprint under review. Code is available at https://github.com/aixiv-org. Website is available at https://aixiv.science

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15614 2025-12-18 cs.LG 70%

Behavior Tokens Speak Louder: Disentangled Explainable Recommendation with Behavior Vocabulary

行为令牌发声更大:解耦可解释推荐与行为词汇

Xinshun Feng, Mingzhe Liu, Yi Qiao, Tongyu Zhu, Leilei Sun, Shuai Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 BEAT通过解耦行为词汇与语义,提升推荐系统的可解释性和零样本性能。

Comments accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11734 2025-12-18 eess.IV cs.CV 67%

MedicoSAM: Robust Improvement of SAM for Medical Imaging

MedicoSAM:医疗影像的SAM鲁棒性改进

Anwai Archit, Luca Freckmann, Constantin Pape

机构 * Institute of Computer Science, University of Göttingen(计算机科学研究所,哥廷根大学)

专题命中 领域大模型 :foundation model(abstract);pretraining(abstract)

AI总结 MedicoSAM通过改进Segment Anything模型,提升医疗影像交互式分割性能,但未提升语义分割效果,模型已公开提供。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15148 2025-12-18 cs.SE 67%

Aligning Academia with Industry: An Empirical Study of Industrial Needs and Academic Capabilities in AI-Driven Software Engineering

将学术与产业对齐:一项关于工业需求和学术能力的AI驱动软件工程实证研究

Hang Yu, Yuzhou Lai, Li Zhang, Xiaoli Lian, Fang Liu, Yanrui Dong, Ting Zhang, Zhi Jin, David Lo

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文通过分析学术研究与工业需求的差距,揭示AI驱动软件工程中的关键挑战,旨在引导未来研究更贴近实际应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15229 2025-12-18 cs.RO math.OC 50%

New Location Science Models with Applications to UAV-Based Disaster Relief

新的位置科学模型及其在无人机灾害救援中的应用

Sina Kazemdehbashi, Yanchao Liu, Boris S. Mordukhovich

专题命中 领域大模型 :SFT(abstract)

AI总结 本文提出了一种新的数学框架,用于确定无人机救援任务中移动基站的最佳位置,考虑风影响和无人机异质性,以提高灾害响应效率。

详情

展开后加载摘要…

URL PDF HTML 收藏