arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12706 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12706 篇

2603.28393 2026-03-31 cs.HC 75%

Within the MDT Room: Situated in Multidisciplinary Team-Grounded Agent Debate for Clinical Diagnosis

在MDT房间内:多学科团队基础的智能体辩论用于临床诊断

Peng Kuai, Yukun Yang, Shaolun Ruan, Junchi Xu, Yanjie Zhang, Lin Zhang, Min Zhu, Rui Sheng

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出MDTRoom系统,通过将多智能体讨论转化为结构化可查看的工作空间,帮助医生与智能体协作,提升罕见病诊断效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26060 2026-03-30 cond-mat.mtrl-sci 75%

ZEBRA-Prop: A Zero-Shot Embedding-Based Rapid and Accessible Regression Model for Materials Properties

ZEBRA-Prop:一种基于零样本嵌入的快速且易用的材料属性回归模型

Ryoma Yamamoto, Akira Takahashi, Kei Terayama, Yu Kumagai, Fumiyasu Oba

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出ZEBRA-Prop模型,利用领域专用LLM和文本嵌入技术,无需微调即可实现材料属性预测,训练时间减少95%,提升预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16057 2026-03-30 cs.GR cs.HC cs.SE 75%

Toward Reliable Scientific Visualization Pipeline Construction with Structure-Aware Retrieval-Augmented LLMs

迈向可靠科学可视化管道构建的结构感知检索增强型大语言模型

Guanghui Zhao, Zhe Wang, Yu Dong, Guan Li, GuiHua Shan

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出结构感知检索增强型大语言模型,用于生成可执行的科学可视化管道,通过提供 vtk.js 代码示例提高模块选择和执行顺序的准确性,降低人工修正成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25984 2026-03-30 astro-ph.IM astro-ph.GA physics.ed-ph 75%

Can LLMs Produce Original Astronomy Research in a Semester? A Graduate Class Experiment

大语言模型能否在一学期内完成原创天文研究?一门研究生课程实验

Ann Zabludoff, Chen-Yu Chuang, Parker Thomas Johnson, Yichen Liu, Brina Bianca Martinez, Neev Shah, Lucille Steffes, Gabriel Glen Weible

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究探讨了大语言模型在 unfamiliar 领域进行原创天文研究的能力,发现尽管学生普遍认为模型节省时间,但模型在复杂代码生成、数据检索和准确性方面存在不足,同时学生担忧模型可能抑制创造力。

Comments 17 pages; white paper about a graduate class experiment on using LLMs for scientific research in Fall 2025 at the University of Arizona

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23953 2026-03-27 cs.CV cs.ET 75%

VOLMO: Versatile and Open Large Models for Ophthalmology

VOLMO:面向眼科学的多功能和开放型大模型

Zhenyue Qin, Younjoon Chung, Elijah Lee, Wanyue Feng, Xuguang Ai, Serina Applebaum, Minjie Zou, Yang Liu, Pan Xiao, Mac Singer, Amisha Dave, Aidan Gilson, Tiarnan D. L. Keenan, Emily Y. Chew, Zhiyong Lu, Yih-Chung Tham, Ron Adelman, Luciano V. Del Priore, Qingyu Chen

机构 * Department of Biomedical Informatics & Data Science, Yale University(耶鲁大学生物医学信息学与数据科学系) Ray and Stephanie Lane Computational Biology Department, Carnegie Mellon University(卡内基梅隆大学雷和斯蒂芬妮·兰德计算生物学系) Yong Loo Lin School of Medicine, National University of Singapore(新加坡国立大学杨洛林医学院) Department of Radiology, Washington University in Saint Louis(圣路易斯华盛顿大学放射科) National Eye Institute, National Institutes of Health(国家卫生研究院眼科研究所) National Library of Medicine, National Institutes of Health(国家卫生研究院国家医学图书馆)

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 VOLMO提出了一种通用框架,用于开发专门的眼科多模态大语言模型,通过预训练、微调和临床推理三个阶段,提升了眼科疾病筛查和诊断的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04964 2026-03-26 cs.HC 75%

Scientific judgment drifts over time in AI ideation

人工智能构想中的科学判断随时间漂移

Lingyu Zhang, Mitchell Wang, Boyuan Chen

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究发现专家对科学构想的评估并非稳定,尽管内部结构保持稳定,但随时间变化的评估漂移影响了AI生成构想的评估效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22612 2026-03-25 cs.CR cs.HC 75%

BioShield: A Context-Aware Firewall for Securing Bio-LLMs

BioShield: 一种面向生物大语言模型的上下文感知防火墙

Protiva Das, Sovon Chakraborty, Sidhant Narula, Lucas Potter, Xavier-Lewis Palmer, Pratip Rana, Daniel Takabi, Mohammad Ghasemigol

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 BioShield通过上下文感知的提示扫描和响应验证,为生物领域大语言模型提供多层次安全防护,有效防止双重用途攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19008 2026-03-20 cs.CL cs.AI cs.LG 75%

Hypothesis-Conditioned Query Rewriting for Decision-Useful Retrieval

基于假设的查询重写用于决策有用的检索

Hangeol Chang, Changsun Lee, Seungjoon Rho, Junho Yeo, Jong Chul Ye

机构 * Graduate School of AI, KAIST, Republic of Korea(韩国科学技术院人工智能研究生院) School of Electrical Engineering, KAIST, Republic of Korea(韩国科学技术院电气工程学院) Department of Industrial Engineering, Yonsei University, Republic of Korea(延世大学工业工程系)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出HCQR框架,通过重写查询获取证据支持假设、区分替代方案和验证关键线索,提升检索与答案选择的对齐度,实验表明在MedQA和MMLU-Med上优于传统RAG方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18235 2026-03-20 cs.CR cs.CV 75%

Toward Reliable, Safe, and Secure LLMs for Scientific Applications

迈向科学应用中可靠、安全和安全的LLM

Saket Sanjeev Chaturvedi, Joshua Bergerson, Tanwi Mallick

机构 * Argonne National Laboratory(阿贡国家实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了科学应用中LLM代理的安全与安全挑战,提出通过多代理系统生成领域特定对抗性安全基准,构建多层次防御框架以提升LLM可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16372 2026-03-18 cs.CV 75%

InViC: Intent-aware Visual Cues for Medical Visual Question Answering

InViC:面向医疗视觉问答的意图感知视觉线索

Zhisong Wang, Ziyang Chen, Zanting Ye, Hongze Zhu, Yefeng Zheng, Yong Xia

机构 * National Engineering Laboratory for Integrated Aero-Space-Ground-Ocean Big Data Application Technology, School of Computer Science and Engineering, Northwestern Polytechnical University, Xi’an 710072, China(集成空天地海大数据应用技术国家工程实验室,计算机科学与工程学院,西北工业大学,西安710072,中国) Westlake University(西湖大学) Southern Medical University(南方医科大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出InViC框架,通过引入Cue Tokens Extraction模块和两阶段微调策略,提升医疗视觉问答中意图对齐的视觉证据利用,验证了瓶颈化训练在提高可信度上的有效性。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15538 2026-03-17 quant-ph 75%

QiboAgent: a practitioner's guideline to open source assistants for Quantum Computing code development

QiboAgent:量子计算代码开发开源助手的实践指南

Lorenzo Esposito, Andrea Papaluca, Stefano Carrazza

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出QiboAgent,通过轻量级开源大语言模型与定制工作流架构,提升量子计算中间件代码生成的准确性和自动化能力,实现90.2%的高精度代码生成。

Comments 13 pages, 9 figures, 1 table. Source code and deployment instructions are publicly available at https://github.com/qiboteam/qiboagent

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13743 2026-03-17 cs.CY 75%

Six Interventions for the Responsible and Ethical Implementation of Medical AI Agents

为医疗AI代理的负责任和伦理实施提出的六种干预措施

Tom Bisson, Henriette Voelker, Sanddhya Jayabalan, A John Iafrate, Jakob N Kather, Jochen K Lennerz

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出六种干预措施,旨在通过伦理设计框架确保医疗AI代理在自主系统中维持医疗伦理核心原则。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11303 2026-03-13 cs.HC 75%

Bridging the Cognitive Gap: Co-Designing and Evaluating a Voice-Enabled Community Chatbot for Older Adults

弥合认知鸿沟:为老年人设计和评估一个语音启用的社区聊天机器人

Feng Chen, Luna Xingyu Li, Ray-Yuan Chung, Wenyu Zeng, Yein Jeon, Yizhou Hu, Oleg Zaslavsky

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种语音启用的社区聊天机器人,通过共设计和教育工作坊,提升老年人对AI的认知和透明度,同时探索零触控导航对年龄包容性AI的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09596 2026-03-13 cs.DL 75%

How much are LLMs changing the language of academic papers after ChatGPT? A multi-database and full text analysis

大型语言模型如何改变学术论文的语言?——多数据库和全文分析

Kayvan Kousha, Mike Thelwall

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究通过多数据库分析发现,大型语言模型相关术语在学术论文中的使用显著增加,尤其在STEM领域,且术语间关联性增强,为非英语学者提供了更便捷的学术出版途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09733 2026-03-11 cs.CV cs.MA 75%

FetalAgents: A Multi-Agent System for Fetal Ultrasound Image and Video Analysis

FetalAgents:一种用于胎儿超声图像和视频分析的多智能体系统

Xiaotian Hu, Junwei Huang, Mingxuan Liu, Kasidit Anmahapong, Yifei Chen, Yitong Luo, Yiming Huang, Xuguang Bai, Zihan Li, Yi Liao, Haibo Qu, Qiyuan Tian

机构 * Tsinghua University(清华大学) University of California San Diego(加州大学圣地亚哥分校) West China Second University Hospital, Sichuan University(四川大学华西第二医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 FetalAgents是一种多智能体系统,通过动态协调视觉专家,实现胎儿超声图像和视频的端到端分析与报告,提供高准确性和流程对齐的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18315 2026-03-11 cs.NI 75%

CovertComBench: A First Domain-Specific Testbed for LLMs in Wireless Covert Communication

CovertComBench: 一个用于无线隐蔽通信中LLM的首个领域特定测试平台

Zhaozhi Liu, Jiaxin Chen, Yuanai Xie, Yuna Jiang, Minrui Xu, Xiao Zhang, Pan Lai, Zan Zhou

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 CovertComBench是首个用于评估LLM在无线隐蔽通信中安全约束优化能力的领域特定测试平台,揭示了LLM在高阶数学推导上的不足,强调需通过外部工具增强构建可信无线AI系统。

Comments 6 pages, corrected a typo: "DeepSeek-R1:70B" was previously incorrectly written as "DeepSeek-V3.2:70B"

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07372 2026-03-10 cs.CL cs.AI cs.LG 75%

Domain-Specific Quality Estimation for Machine Translation in Low-Resource Scenarios

领域特定机器翻译低资源场景下的质量估计

Namrata Patil Gurav, Akashdeep Ranu, Archchana Sindhujan, Diptesh Kanojia

专题命中 领域大模型 :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ALOPE框架,通过低秩适应提升领域特定机器翻译低资源场景下的质量估计性能,尤其在语义复杂领域表现更优。

Comments 21 pages, 7 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03126 2026-03-04 cs.DL cs.DB cs.IR cs.SI 75%

The Science Data Lake: A Unified Open Infrastructure Integrating 293 Million Papers Across Eight Scholarly Sources with Embedding-Based Ontology Alignment

科学数据湖:整合29300万篇论文的统一开放基础设施

Jonas Wilinski

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 科学数据湖通过整合29300万篇论文,利用嵌入本体对齐技术实现跨来源数据统一,提升学术数据整合与分析效率。

Comments 18 pages, 8 figures, 7 tables. Dataset DOI: 10.57967/hf/7850. Code: https://github.com/J0nasW/science-datalake

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23363 2026-02-27 cs.CV 75%

MediX-R1: Open Ended Medical Reinforcement Learning

MediX-R1:开放端医疗强化学习

Sahal Shaji Mullappilly, Mohammed Irfan Kurpath, Omair Mohamed, Mohamed Zidan, Fahad Khan, Salman Khan, Rao Anwer, Hisham Cholakkal

机构 * Mohamed Bin Zayed University of Artificial Intelligence (MBZUAI)(迈赫迈德·本·扎耶德人工智能大学) Jubilee Mission Medical College(jubilee mission 医学院) Research Institute(研究院) JJM Medical College(JJM 医学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 MediX-R1通过综合奖励信号和LLM评估,实现医疗多模态模型的开放端强化学习,提升临床推理可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22276 2026-02-27 cs.SE cs.DL 75%

EmpiRE-Compass: A Neuro-Symbolic Dashboard for Sustainable and Dynamic Knowledge Exploration, Synthesis, and Reuse

EmpiRE-Compass:一个用于可持续和动态知识探索、综合与重用的神经符号仪表盘

Oliver Karras, Amirreza Alasti, Lena John, Sushant Aggarwal, Yücel Celik

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 EmpiRE-Compass通过神经符号仪表盘实现可持续的文献综述,提供可视化分析、神经符号综合和可重用知识,促进透明和可重复性。

Comments 7 pages, 1 figure, Accepted at 32nd International Working Conference on Requirements Engineering: Foundations for Software Quality

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10606 2026-02-26 cs.IR 75%

S-GRec: Personalized Semantic-Aware Generative Recommendation with Asymmetric Advantage

S-GRec: 基于非对称优势的个性化语义感知生成推荐

Jie Jiang, Hongbo Tang, Wenjie Wu, Yangru Huang, Zhenmao Li, Qian Li, Changping Wang, Jun Zhang, Huan Yu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 S-GRec通过非对称优势策略优化,结合轻量级生成器和LLM语义判断器,实现个性化语义感知推荐,提升CTR和GMV效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19183 2026-02-24 cs.IR 75%

SIDEKICK: A Semantically Integrated Resource for Drug Effects, Indications, and Contraindications

SIDEKICK: 一种集成语义的药物效应、适应症和禁忌症资源

Mohammad Ashhad, Olga Mashkova, Ricardo Henao, Robert Hoehndorf

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SIDEKICK通过语义集成药物效应、适应症和禁忌症,提升药物再利用中的副作用相似性分析能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18461 2026-02-24 cs.CY 75%

Toward Self-Driving Universities: Can Universities Drive Themselves with Agentic AI?

迈向自动驾驶大学:大学能否通过代理AI实现自我驱动?

Anis Koubaa

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出通过代理AI实现高等教育机构的自主性框架,旨在自动化行政、学术和质量保证流程,减少教师文书工作时间,提升教育质量和研究生产力。

Journal ref Springer Book: Next Generation AI-Driven Education - 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11211 2026-02-13 cs.CR 75%

TRACE: Timely Retrieval and Alignment for Cybersecurity Knowledge Graph Construction and Expansion

TRACE: 信息安全知识图谱构建与扩展中的及时检索与对齐

Zijing Xu, Ziwei Ning, Tiancheng Hu, Jianwei Zhuge, Yangyang Wang, Jiahao Cao, Mingwei Xu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 TRACE通过整合结构化和非结构化数据,利用LLMs提升网络安全知识图谱的实时更新与实体对齐效率,实现节点覆盖和提取精度的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10143 2026-02-12 cs.CV 75%

MPA: Multimodal Prototype Augmentation for Few-Shot Learning

MPA: 多模态原型增强用于少样本学习

Liwen Wu, Wei Wang, Lei Zhao, Zhan Gao, Qika Lin, Shaowen Yao, Zuozhu Liu, Bin Pu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 MPA通过多模态原型增强方法,在少样本学习中实现更优性能,通过语义增强、多视图增强和不确定类吸收器提升模型表现。

Comments This paper has been accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08559 2026-02-10 cs.IR 75%

QARM V2: Quantitative Alignment Multi-Modal Recommendation for Reasoning User Sequence Modeling

QARM V2:量化对齐多模态推荐用于推理用户序列建模

Tian Xia, Jiaqi Zhang, Yueyang Liu, Hongjian Dou, Tingya Yin, Jiangxia Cao, Xulei Liang, Tianlu Xie, Lihao Liu, Xiang Chen, Shen Wang, Changxin Lao, Haixiang Gan, Jinkai Yu, Keting Cen, Lu Hao, Xu Zhang, Qiqiang Zhong, Zhongbo Sun, Yiyu Wang, Shuang Yang, Mingxin Wen, Xiangyu Wu, Shaoguo Liu, Tingting Gao, Zhaojie Liu, Han Li, Kun Gai

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 QARM V2通过量化对齐多模态推荐方法,解决推荐系统中用户序列建模的语义理解与业务需求不匹配问题。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05506 2026-02-06 cs.HC 75%

Relying on LLMs: Student Practices and Instructor Norms are Changing in Computer Science Education

依赖大语言模型:计算机科学教育中学生实践与教师规范正在发生变化

Xinrui Lin, Heyan Huang, Shumin Shi, John Vines

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了计算机科学教育中学生与LLMs的互动,发现学生实践与教师规范存在不同程度的冲突,并提出了LLMs设计指南以促进学习。

Comments 25 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03531 2026-02-06 cs.CL cs.AI cs.LG 75%

Real-Time Detection of Hallucinated Entities in Long-Form Generation

长文本生成中hallucinated实体的实时检测

Oscar Obeso, Andy Arditi, Javier Ferrando, Joshua Freeman, Cameron Holmes, Neel Nanda

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种廉价且可扩展的方法,用于实时检测长文本生成中的幻觉实体,通过网络搜索标注数据集训练高效分类器,并在多个模型家族上实现了优于基线的检测效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03849 2026-02-05 cs.HC cs.AI cs.CL cs.LG 75%

HybridQuestion: Human-AI Collaboration for Identifying High-Impact Research Questions

HybridQuestion: 人机协作识别高影响力研究问题

Keyu Zhao, Fengli Xu, Yong Li, Tie-Yan Liu

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系、北京理工大学、清华大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 HybridQuestion通过人机协作识别高影响力研究问题,利用AI处理数据与人类判断结合,验证了在科学突破和未来问题预测中的有效性。

Comments 16 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22414 2026-02-03 cs.SE 75%

AutoCodeSherpa: Symbolic Explanations in AI Coding Agents

AutoCodeSherpa: AI 编程代理中的符号解释

Sungmin Kang, Haifeng Ruan, Abhik Roychoudhury

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 AutoCodeSherpa通过符号公式提供软件问题解释,提升自动化修复和程序分析的准确性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏