arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12706 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12706 篇

2602.00337 2026-02-03 cs.DL 75%

Smarter AI Through Prompt Engineering: Insights and Case Studies from Data Science Application

通过提示工程实现更智能的AI:来自数据科学应用的洞察与案例研究

Snehasish Paul, Rohit Kumar, Laxman Das

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文通过提示工程在不同领域的应用案例,展示其提升AI性能的潜力及方法论有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16416 2026-01-30 cond-mat.mtrl-sci physics.comp-ph 75%

A Multi-agent Framework for Physical Laws Discovery

发现物理定律的多智能体框架

Bo Hu, Siyu Liu, Beilin Ye, Yun Hao, Yanhui Liu, Yang Lu, Ju Li, David J. Srolovitz, Tongqi Wen

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出基于大语言模型的多智能体框架,用于发现物理定律,通过整合文献引导的变量选择、假设形成、符号回归等技术,实现了对金属玻璃形成能力、化合物硬度和多组分合金杨氏模量的高精度预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20833 2026-01-29 cs.CE 75%

Idea2Story: An Automated Pipeline for Transforming Research Concepts into Complete Scientific Narratives

Idea2Story: 一种将研究概念转化为完整科学叙述的自动化流程

Tengyue Xu, Zhuoyang Qian, Gaoge Liu, Li Ling, Zhentao Zhang, Biao Wu, Shuo Zhang, Ke Lu, Wei Shi, Ziqi Wang, Zheng Feng, Yan Luo, Shu Xu, Yongjin Chen, Zhibo Feng, Zhuo Chen, Bruce Yuan, Harry Wang, Kris Chen

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 Idea2Story通过离线知识构建实现自主科学发现,提升研究效率与可靠性。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17903 2026-01-27 cs.SE 75%

Prompt-Based REST API Test Amplification in Industry: An Experience Report

基于提示的REST API测试放大在工业中的应用:经验报告

Tolgahan Bardakci, Andreas Faes, Mutlu Beyazit, Serge Demeyr

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文通过在工业环境中应用基于提示的REST API测试放大技术,验证了其在提高测试覆盖率和发现异常方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14275 2026-01-27 cs.CR cs.AI cs.CL cs.LG 75%

FedMentor: Domain-Aware Differential Privacy for Heterogeneous Federated LLMs in Mental Health

FedMentor: 域感知差分隐私用于心理健康领域异构联邦大语言模型

Nobin Sarwar, Shubhashis Roy Dipta

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 FedMentor通过整合LoRA和域感知差分隐私,实现对心理健康领域异构联邦大语言模型的隐私保护微调,提升安全性并保持模型效用。

Comments NeurIPS 2025 GenAI4Health Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12883 2026-01-21 cs.CR cs.CY 75%

Generative AI Misuse Potential in Cyber Security Education: A Case Study of a UK Degree Program

生成式AI在网络安全教育中的潜在滥用:一项英国学位项目的案例研究

Carlton Shepherd

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了生成式AI在网络安全教育中的潜在滥用问题,提出了一种评估框架以量化项目暴露风险,并提出LLM抗性评估策略以维护学术标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06774 2026-01-13 cs.HC 75%

ImmuniFraug: A Metacognitive Intervention Anti-Fraud Approach to Enhance Undergraduate Students' Cyber Fraud Awareness

ImmuniFraug:一种基于元认知干预的反欺诈方法,以提高本科生的网络欺诈意识

Xiangzhe Yuan, Jiajun Wang, Huanchen Wang, Qian Wan, Siying Hu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 ImmuniFraug通过基于LLM的多模态欺诈模拟,提升本科生网络欺诈意识和自我效能感,提供更有效的反欺诈教育方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00742 2026-01-12 physics.comp-ph 75%

Materials Informatics: Emergence To Autonomous Discovery In The Age Of AI

材料信息学:在人工智能时代的涌现与自主发现

Turab Lookman, YuJie Liu, Zhibin Gao

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了材料信息学在人工智能时代的发展,从基础理论到AI驱动的自主发现,强调其作为不断演进的生态系统,通过反向设计和自主实验室推动材料科学的变革。

Comments 44 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04878 2026-01-09 cs.AI cond-mat.mtrl-sci cs.CL cs.LG 75%

Higher-Order Knowledge Representations for Agentic Scientific Reasoning

高阶知识表示用于代理科学推理

Isabella A. Stewart, Markus J. Buehler

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出基于超图的知识表示方法,用于代理科学推理,通过高阶路径生成机理假设,提升科学发现效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10230 2026-01-09 eess.IV cs.CV 75%

Leveraging Clinical Text and Class Conditioning for 3D Prostate MRI Generation

利用临床文本和类别条件化生成3D前列腺MRI

Emerson P. Grabke, Babak Taati, Masoom A. Haider

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文提出CCELLA方法,通过结合临床文本和类别条件化,提升3D前列腺MRI生成质量及下游分类器性能。

Comments Accepted for publication in IEEE Transactions on Biomedical Engineering, 2025. This is the accepted author version. The final published version is available at https://doi.org/10.1109/TBME.2025.3648426

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04199 2026-01-09 cs.LG cs.AI cs.CL 75%

The Forgotten Shield: Safety Grafting in Parameter-Space for Medical MLLMs

被遗忘的盾牌:参数空间中的医疗大语言模型安全性移植

Jiale Zhao, Xing Mou, Jinlin Wu, Hongyuan Yu, Mingrui Sun, Yang Shi, Xuanwu Yin, Zhen Chen, Zhen Lei, Yaohua Wang

机构 * National University of Defense Technology(国防科技大学) Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统(MAIS)) Multimedia Department, Xiaomi Inc(小米公司多媒体部门) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences, Hong Kong(香港科学院人工智能与机器人中心) School of Artificial Intelligence, University of Chinese Academy of Sciences, UCAS(中国科学院大学人工智能学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出参数空间干预方法,通过提取原始模型的安全知识并注入目标模型,提升医疗大语言模型的安全性,同时保持医疗性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02381 2026-01-07 cs.IR 75%

TAG-HGT: A Scalable and Cost-Effective Framework for Inductive Cold-Start Academic Recommendation

TAG-HGT:一种可扩展且成本效益高的诱导冷启动学术推荐框架

Zhexiang Li

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 TAG-HGT通过神经符号框架实现高效冷启动学术推荐,提升召回率并大幅降低推理成本。

Comments 8pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22795 2025-12-30 cs.CL cs.AI cs.LG 75%

CNSight: Evaluation of Clinical Note Segmentation Tools

CNSight:临床笔记分段工具评估

Risha Surana, Adrian Law, Sunwoo Kim, Rishab Sridhar, Angxiao Han, Peiyu Hong

机构 * University of Southern California(南加州大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 CNSight评估了多种临床笔记分段工具,发现大型API模型在分段任务中表现最佳,尤其在句子级和自由文本分段上取得了较高的F1值,为后续的信息提取和自动化摘要等任务提供了基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17838 2025-12-22 cs.CV 75%

ReX-MLE: The Autonomous Agent Benchmark for Medical Imaging Challenges

ReX-MLE:医疗影像挑战的自主代理基准

Roshan Kenia, Xiaoman Zhang, Pranav Rajpurkar

机构 * Harvard Medical School(哈佛医学院) Department of Biomedical Informatics(生物医学信息学系)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 ReX-MLE是一个针对医学影像挑战的自主代理基准,通过评估端到端工作流程,揭示了现有代理在领域知识和工程能力上的不足。

Comments https://github.com/rajpurkarlab/ReX-MLE

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17154 2025-12-22 cs.SD 75%

InstructDubber: Instruction-based Alignment for Zero-shot Movie Dubbing

InstructDubber:基于指令的零样本电影配音对齐

Zhedong Zhang, Liang Li, Gaoxiang Cong, Chunshan Liu, Yuhan Gao, Xiaowan Wang, Tao Gu, Yuankai Qi

机构 * VIPL group, ICT, CAS(中国科学院信息科技研究所VIPL小组)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 InstructDubber通过指令生成和持续时间蒸馏模块,实现鲁棒的领域内和零样本电影配音对齐。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15384 2025-12-18 cs.IR 75%

MedNuggetizer: Confidence-Based Information Nugget Extraction from Medical Documents

MedNuggetizer: 基于置信度的信息 nugget 从医学文档中提取

Gregor Donabauer, Samy Ateia, Udo Kruschwitz, Maximilian Burger, Matthias May, Christian Gilfrich, Maximilian Haas, Julio Ruben Rodas Garzaro, Christoph Eckl

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 MedNuggetizer 通过大型语言模型提取和聚类医学文档中的信息 nugget,帮助临床医生高效获取可靠的医学证据。

Comments Preprint accepted at ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12371 2025-12-16 cs.CY 75%

AI Sprints: Towards a Critical Method for Human-AI Collaboration

AI冲刺:迈向人类-人工智能协作的批判性方法

David M. Berry

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出'AI冲刺'方法,结合批判反思与生成AI迭代对话,旨在发展人类-人工智能协作的批判性研究方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12240 2025-12-16 cs.HC 75%

System X: A Mobile Voice-Based AI System for EMR Generation and Clinical Decision Support in Low-Resource Maternal Healthcare

System X:一种基于语音的移动AI系统,用于低资源产科医疗中的电子病历生成和临床决策支持

Maryam Mustafa, Umme Ammara, Amna Shahnawaz, Moaiz Abrar, Bakhtawar Ahtisham, Fozia Umber Qurashi, Mostafa Shahin, Beena Ahmed

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 System X通过语音识别和大语言模型生成电子病历并标记临床风险,适用于低资源环境中的产科医疗

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01788 2025-12-08 cs.HC cs.CY 75%

Exploring ChatGPT's Capabilities, Stability, Potential and Risks in Conducting Psychological Counseling through Simulations in School Counseling

探索ChatGPT在模拟学校咨询中的能力、稳定性、潜力与风险

Yang Ni, Yanzhuo Cao

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究评估ChatGPT在模拟学校咨询中的应用,探讨其作为培训工具的潜力及伦理风险,提出使用指南。

Journal ref Mental Health and Digital Technologies, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09414 2025-12-05 cs.SE 75%

Multi-agent Assisted Automatic Test Generation for Java JSON Libraries

多智能体辅助的Java JSON库自动测试生成

Sinan Wang, Zhiyuan Zhong, Shaojin Wen, Yepang Liu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 JsonATG通过多智能体系统生成Java JSON库的多样化测试用例,有效提升测试覆盖率并发现多个bug。

Comments In the 32nd Asia-Pacific Software Engineering Conference (APSEC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03694 2025-12-04 cs.MA 75%

SRPG: Semantically Reconstructed Privacy Guard for Zero-Trust Privacy in Educational Multi-Agent Systems

SRPG:用于教育多智能体系统的语义重建隐私保护

Shuang Guo, Zihui Li

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SRPG通过双流重建机制在教育多智能体系统中实现零PII泄露,提升教学效果与隐私保护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01690 2025-12-02 cs.SE 75%

Generating REST API Tests With Descriptive Names

生成具有描述性名称的REST API测试

Philip Garrett, Juan P. Galeotti, Andrea Arcuri, Alexander Poth, Olsi Rrjolli

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出三种确定性技术生成REST API测试的描述性名称,并通过实验验证其有效性,证明轻量级方法可作为替代LLM方法的实用方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20773 2025-11-26 cs.IR 75%

Adaptive Candidate Retrieval with Dynamic Knowledge Graph Construction for Cold-Start Recommendation

基于动态知识图谱构建的自适应候选检索用于冷启动推荐

Wooseong Yang, Weizhi Zhang, Yuqing Liu, Yuwei Han, Yu Wang, Junhyun Lee, Philip S. Yu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 ColdRAG通过动态构建知识图谱和LLM引导的多跳推理,提升冷启动推荐性能。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10011 2025-11-18 cs.CY 75%

Reinforcing Trustworthiness in Multimodal Emotional Support Systems

Huy M. Le, Dat Tien Nguyen, Ngan T. T. Vo, Tuan D. Q. Nguyen, Nguyen Binh Le, Duy Minh Ho Nguyen, Daniel Sonntag, Lizi Liao, Binh T. Nguyen

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10950 2025-11-18 cs.DB 75%

Unveiling Challenges for LLMs in Enterprise Data Engineering

Jan-Micha Bodensohn, Ulf Brackmann, Liane Vogel, Anupam Sanghi, Carsten Binnig

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07529 2025-11-18 cs.HC 75%

Automating the Path: An R&D Agenda for Human-Centered AI and Visualization

Niklas Elmqvist, Clemens Nylandsted Klokmose

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08006 2025-11-18 cs.IR 75%

From IDs to Semantics: A Generative Framework for Cross-Domain Recommendation with Adaptive Semantic Tokenization

Peiyu Hu, Wayne Lu, Jia Wang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12503 2025-11-13 cs.CY 75%

Qualitative Research in an Era of AI: A Pragmatic Approach to Data Analysis, Workflow, and Computation

Corey M. Abramson, Tara Prendergast, Zhuofan Li, Daniel Dohan

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

Comments FORTHCOMING: Abramson, Corey M., Tara Prendergast, Zhuofan Li, Daniel Dohan. 2026 (forthcoming). "Qualitative Research in an Era of AI: A Pragmatic Approach to Data Analysis, Workflow, and Computation". Annual Review of Sociology. pre-print, methodology, workflow article

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11639 2025-11-12 cs.IR 75%

OneRec-Think: In-Text Reasoning for Generative Recommendation

Zhanyu Liu, Shiyao Wang, Xingmei Wang, Rongzhou Zhang, Jiaxin Deng, Honghui Bao, Jinghao Zhang, Wuchao Li, Pengfei Zheng, Xiangyu Wu, Yifei Hu, Qigen Hu, Xinchen Luo, Lejian Ren, Zixing Zhang, Qianqian Wang, Kuo Cai, Yunfan Wu, Hongtao Cheng, Zexuan Cheng, Lu Ren, Huanjie Wang, Yi Su, Ruiming Tang, Kun Gai, Guorui Zhou

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12104 2025-11-11 cs.LG cs.AI cs.CL 75%

Generative Medical Event Models Improve with Scale

Shane Waxler, Paul Blazek, Davis White, Daniel Sneider, Kevin Chung, Mani Nagarathnam, Patrick Williams, Hank Voeller, Karen Wong, Matthew Swanhorst, Sheng Zhang, Naoto Usuyama, Cliff Wong, Tristan Naumann, Hoifung Poon, Andrew Loza, Daniella Meeker, Seth Hain, Rahul Shah

机构 * Epic Systems(Epic系统) Microsoft Research(微软研究院) Yale School of Medicine(耶鲁医学院) Cosmos Governing Council(Cosmos管理委员会)

专题命中 领域大模型 :foundation model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏