arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-27 至 2026-01-27 共收录 404 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 35 篇

2511.18413 2026-01-27 cs.CL cs.IR 77%

Multi-Agent Collaborative Filtering: Orchestrating Users and Items for Agentic Recommendations

多智能体协同过滤:为智能推荐 orchestrate 用户和物品

Yu Xia, Sungchul Kim, Tong Yu, Ryan A. Rossi, Julian McAuley

机构 * University of California, San Diego(加州大学圣地亚哥分校) Adobe Research(Adobe研究)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出多智能体协同过滤框架,通过动态协作机制提升智能推荐效果。

Comments WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01054 2026-01-27 cs.CR cs.AI cs.CY 77%

Autonomous Penetration Testing: Solving Capture-the-Flag Challenges with LLMs

自主渗透测试:利用大语言模型解决夺旗挑战

Isabelle Bakker, John Hastings

机构 * The Beacom College of Computer and Cyber Sciences(计算机与网络安全科学学院) Dakota State University(达科他州立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 利用大语言模型自主解决初级渗透测试任务,展示其在自动化简单攻击流程中的潜力,同时揭示安全环境对LLM攻击的挑战。

Comments 6 pages, 2 figures, 3 tables

Journal ref 2025 IEEE Cyber Awareness and Research Symposium (CARS'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00086 2026-01-27 cs.CL 77%

Do LLMs produce texts with "human-like" lexical diversity?

大语言模型生成的文本是否具有“人类般的”词汇多样性?

Kelly Kendro, Jeffrey Maloney, Scott Jarvis

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究发现,ChatGPT模型生成的文本在词汇多样性上与人类写作存在显著差异,新模型的文本比旧模型更不具有人类般的多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00003 2026-01-27 cs.CL 77%

A Review of Incorporating Psychological Theories in LLMs

对将心理理论纳入大语言模型的综述

Zizhou Liu, Ziwei Gong, Lin Ai, Zheng Hui, Run Chen, Colin Wayne Leach, Michelle R. Greene, Julia Hirschberg

机构 * Department of Computer Science, Columbia University(哥伦比亚大学计算机科学系) Department of Psychology, Barnard College(巴纳德学院心理学系) The Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文综述了心理学理论如何指导和增强大语言模型开发,整合了六个心理学子领域,旨在促进心理学更深入地融入NLP研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09715 2026-01-27 cs.CL cs.AI cs.HC cs.IR 76%

Introducing Axlerod: An LLM-based Chatbot for Assisting Independent Insurance Agents

引入Axlerod:一种基于大语言模型的聊天机器人,用于协助独立保险代理

Adam Bradley, John Hastings, Khandaker Mamun Ahmed

机构 * The Beacom College of Computer and Cyber Sciences, Dakota State University(计算机与网络安全学院,达科他州立大学)

专题命中 领域大模型 :LLM(title);分类 cs.CL、cs.AI

AI总结 Axlerod是一种基于大语言模型的聊天机器人,旨在通过自然语言处理、检索增强生成和领域知识整合,提高独立保险代理的工作效率。

Comments 6 pages, 2 figures, 1 table

Journal ref 2025 IEEE Cyber Awareness and Research Symposium (CARS'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17903 2026-01-27 cs.SE 75%

Prompt-Based REST API Test Amplification in Industry: An Experience Report

基于提示的REST API测试放大在工业中的应用:经验报告

Tolgahan Bardakci, Andreas Faes, Mutlu Beyazit, Serge Demeyr

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文通过在工业环境中应用基于提示的REST API测试放大技术,验证了其在提高测试覆盖率和发现异常方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14275 2026-01-27 cs.CR cs.AI cs.CL cs.LG 75%

FedMentor: Domain-Aware Differential Privacy for Heterogeneous Federated LLMs in Mental Health

FedMentor: 域感知差分隐私用于心理健康领域异构联邦大语言模型

Nobin Sarwar, Shubhashis Roy Dipta

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 FedMentor通过整合LoRA和域感知差分隐私,实现对心理健康领域异构联邦大语言模型的隐私保护微调,提升安全性并保持模型效用。

Comments NeurIPS 2025 GenAI4Health Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18308 2026-01-27 cs.AI cs.SI cs.SY eess.SY 70%

A Generative AI-Driven Reliability Layer for Action-Oriented Disaster Resilience

一种生成式AI驱动的可靠性层用于面向行动的灾害韧性

Geunsik Lim

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于生成式AI的可靠性层,旨在提升灾害预警系统中行动执行的效率与公平性。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17807 2026-01-27 cond-mat.mtrl-sci cs.LG 70%

An autonomous living database for perovskite photovoltaics

一种用于钙钛矿光伏的自主生活数据库

Sherjeel Shabih, Hampus Näsström, Sharat Patil, Asmin Askin, Keely Dodd-Clements, Jessica Helisa Hautrive Rossato, Hugo Gajardoni de Lemos, Yuxin Liu, Florian Mathies, Natalia Maticiuc, Rico Meitzner, Edgar Nandayapa, Juan José Patiño López, Yaru Wang, Lauri Himanen, Eva Unger, T. Jesper Jacobsson, José A. Márquez, Kevin Maik Jablonka

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 PERLA通过整合大语言模型与物理验证,实现自主更新的钙钛矿光伏数据库,揭示了2021年后研究的进化趋势和持续电压损失减少轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18207 2026-01-27 cs.LG cs.AI cs.CL cs.IR 67%

PaperSearchQA: Learning to Search and Reason over Scientific Papers with RLVR

PaperSearchQA: 基于强化学习与验证奖励的学习科学论文搜索与推理

James Burgess, Jan N. Hansen, Duo Peng, Yuhui Zhang, Alejandro Lozano, Min Woo Sun, Emma Lundberg, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学) Chan Zuckerberg Biohub Network(查纳·泽克拜尔生物枢纽网络) KTH Royal Institute of Technology(皇家理工学院)

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 PaperSearchQA通过训练搜索代理在科学论文中进行搜索与推理,提升技术问答能力,为未来的人工智能科学家系统奠定基础。

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18179 2026-01-27 cs.HC 67%

Exploring Customizable Interactive Tools for Therapeutic Homework Support in Mental Health Counseling

探索用于心理健康辅导中治疗作业支持的可定制交互工具

Yimeng Wang, Liabette Escamilla, Yinzhou Wang, Bianca R. Augustine, Yixuan Zhang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 TheraTrack是一款可定制的治疗师工具,利用大型语言模型整合多维数据,优化治疗作业跟踪,减少认知负荷并提高数据验证效率。

Comments 22 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00555 2026-01-27 cs.LG cs.AI cs.CL cs.CV 67%

MMedAgent-RL: Optimizing Multi-Agent Collaboration for Multimodal Medical Reasoning

MMedAgent-RL: 优化多智能体协作以实现多模态医疗推理

Peng Xia, Jinglu Wang, Yibo Peng, Kaide Zeng, Zihan Dong, Xian Wu, Xiangru Tang, Hongtu Zhu, Yun Li, Linjun Zhang, Shujie Liu, Yan Lu, Huaxiu Yao

机构 * UNC-Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft Research(微软研究院) CMU(卡内基梅隆大学) Rutgers University(罗格斯大学) Yale University(耶鲁大学)

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MMedAgent-RL通过强化学习优化多智能体协作,提升多模态医疗推理性能,实现23.6%的性能提升。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17796 2026-01-27 q-bio.NC 67%

AI and World Models

人工智能与世界模型

Robert Worden

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文探讨了人工智能系统中世界模型的必要性,强调其在预测和控制人工智能行为后果中的关键作用,以及构建可靠世界模型的挑战。

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17844 2026-01-27 cs.HC cs.AI cs.LG 62%

RAICL: Retrieval-Augmented In-Context Learning for Vision-Language-Model Based EEG Seizure Detection

RAICL:基于视觉-语言模型的EEG癫痫检测的检索增强上下文学习

Siyang Li, Zhuoya Wang, Xiyan Gui, Xiaoqing Chen, Ziwei Wang, Yaozhi Wen, Dongrui Wu

机构 * Ministry of Education Key Laboratory of Image Processing and Intelligent Control, School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(教育部图像处理与智能控制重点实验室,人工智能与自动化学院,华中科技大学) State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Institute of Automation, Chinese Academy of Sciences(脑认知与脑启发智能技术国家重点实验室,自动化研究所,中国科学院)

专题命中 领域大模型 :language model(abstract);分类 cs.AI、cs.LG

AI总结 RAICL通过利用视觉-语言模型分析EEG波形图,实现了更高效的癫痫检测,无需重新训练,具有广泛临床应用前景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17588 2026-01-27 cs.AI cs.CL 62%

Intelligence Requires Grounding But Not Embodiment

智能需要具身但不需要身体

Marcus Ma, Shrikanth Narayanan

机构 * University of Southern California(南加州大学)

专题命中 领域大模型 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出智能需要基础性而非具身,通过定义智能的四个属性并论证非具身智能体可实现这些属性,从而得出结论:基础性是智能的必要条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00662 2026-01-27 cs.CV cs.CL cs.LG 62%

Mitigating the Modality Gap: Few-Shot Out-of-Distribution Detection with Multi-modal Prototypes and Image Bias Estimation

弥合模态差距:基于多模态原型和图像偏差估计的少样本分布外检测

Yimu Wang, Evelien Riddell, Adrian Chow, Sean Sedwards, Krzysztof Czarnecki

机构 * University of Waterloo(滑铁卢大学)

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出SUPREME框架,通过引入多模态原型和图像偏差估计,有效缓解图像与文本之间的模态差距,提升少样本分布外检测性能。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17093 2026-01-27 cs.LG cs.AI 62%

The Triangle of Similarity: A Multi-Faceted Framework for Comparing Neural Network Representations

相似性的三角形:一种多维框架用于比较神经网络表示

Olha Sirikova, Alvin Chan

专题命中 领域大模型 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出相似性三角形框架,通过静态、功能和稀疏性三个视角比较神经网络表示,揭示架构对表示相似性的影响及剪枝对模型核心的影响。

Comments Accepted to AAAI 2026 Workshop on AI for Scientific Research (AI4Research)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18102 2026-01-27 cs.CL 57%

CHiRPE: A Step Towards Real-World Clinical NLP with Clinician-Oriented Model Explanations

CHiRPE:迈向真实世界临床NLP的一步:面向临床医生的模型解释

Stephanie Fong, Zimu Wang, Guilherme C. Oliveira, Xiangyu Zhao, Yiwen Jiang, Jiahe Liu, Beau-Luke Colton, Scott Woods, Martha E. Shenton, Barnaby Nelson, Zongyuan Ge, Dominic Dwyer

机构 * Orygen and The University of Melbourne(Orygen和墨尔本大学) AIM for Health Lab, Monash University(AIM for Health实验室,墨尔本大学) University of Liverpool(利物浦大学) Yale School of Medicine, Yale University(耶鲁医学院,耶鲁大学) Brigham and Women’s Hospital, Harvard Medical School(哈佛医学院布里奇沃特医院)

专题命中 领域大模型 :LLM(abstract);分类 cs.CL

AI总结 CHiRPE通过临床医生共同开发的新型SHAP解释格式,实现了高准确率的临床风险预测,并展示了临床指导的模型开发在真实世界中的应用潜力。

Comments This paper is accepted at EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13588 2026-01-27 cs.AI cs.CE cs.CY 57%

CoBRA: Programming Cognitive Bias in Social Agents Using Classic Social Science Experiments

CoBRA:利用经典社会科学实验编程社会代理中的认知偏差

Xuan Liu, Haoyang Shang, Haojian Jin

机构 * University of California San Diego(加州大学圣地亚哥分校) Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(abstract);分类 cs.AI

AI总结 CoBRA通过经典社会科学实验设计,为社会代理提供了一种可编程的认知偏差控制方法,实现一致的行为模拟与可重用的AI训练环境。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18092 2026-01-27 cs.HC 50%

From Struggle to Success: Context-Aware Guidance for Screen Reader Users in Computer Use

从挣扎到成功:面向屏幕阅读用户的情境感知指导计算机使用

Nan Chen, Jing Lu, Zilong Wang, Luna K. Qiu, Siming Chen, Yuqing Yang

专题命中 领域大模型 :LLM(abstract)

AI总结 AskEase通过情境感知的AI助手为视障用户提供了逐步指导,提升计算机使用成功率并减少工作负荷。

Comments Conditionally accepted to ACM CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17368 2026-01-27 cs.HC 50%

A Scoping Review and Guidelines on Privacy Policy's Visualization from an HCI Perspective

从人机交互视角审视隐私政策可视化:综述与指南

Shuning Zhang, Eve He, Sixing Tao, Yuting Yang, Ying Ma, Ailei Wang, Xin Yi, Hewu Li

专题命中 领域大模型 :LLM(abstract)

AI总结 从人机交互视角审视隐私政策可视化,揭示信息负荷与决策效果的权衡、设计与自动化的共进化、一般性与特定性的张力以及利益相关者意见的平衡,提出未来研究的四个关键挑战。

Comments Accepted by CHI'26: 10.1145/3772318.3790320

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17228 2026-01-27 cs.CV q-bio.QM 50%

Semi-Supervised Domain Adaptation with Latent Diffusion for Pathology Image Classification

半监督域适应与潜在扩散用于病理图像分类

Tengyue Zhang, Ruiwen Ding, Luoting Zhuang, Yuxiao Wu, Erika F. Rodriguez, William Hsu

机构 * Medical & Imaging Informatics, Department of Radiological Sciences, David Geffen School of Medicine, University of California, Los Angeles(医学与影像信息学系,放射科学系,大卫·盖弗医学院,加州大学洛杉矶分校) Bioengineering Department, Henry Samueli School of Engineering, UCLA(生物工程系,亨利·萨缪尔西工程学院,UCLA) Department of Pathology & Laboratory Sciences, David Geffen School of Medicine, UCLA(病理学与实验室科学系,大卫·盖弗医学院,UCLA)

专题命中 领域大模型 :foundation model(abstract)

AI总结 本研究提出利用潜在扩散模型生成目标领域意识的合成数据,提升计算病理学中的域泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17102 2026-01-27 q-bio.QM 50%

Domain-Aware Geometric Multimodal Learning for Multi-Domain Protein-Ligand Affinity Prediction

领域感知的几何多模态学习用于多领域蛋白质-配体亲和力预测

Shuo Zhang, Jian K. Liu

专题命中 领域大模型 :language model(abstract)

AI总结 DAGML通过领域感知的几何多模态学习框架,有效提升多领域蛋白质-配体亲和力预测的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识编辑与模型理解 18 篇

2508.06030 2026-01-27 cs.CL cs.LG 90%

Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings

通过适应预训练嵌入高效探测大语言模型的知识

Kartik Sharma, Yiqiao Jin, Rakshit Trivedi, Srijan Kumar

机构 * Georgia Institute of Technology(佐治亚理工学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

AI总结 PEEK通过适应预训练嵌入模型,高效探测大语言模型的知识,准确率达90%,揭示了事实表示的底层结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04058 2026-01-27 cs.GR cs.CV 86%

SMooGPT: Stylized Motion Generation using Large Language Models

SMooGPT:利用大语言模型进行风格化动作生成

Lei Zhong, Yi Yang, Changjian Li

机构 * University of Edinburgh(爱丁堡大学)

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract)

AI总结 SMooGPT通过利用大语言模型的推理、组合和生成能力,实现风格化动作生成,提升动作控制和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18483 2026-01-27 cs.CL cs.AI 79%

Funny or Persuasive, but Not Both: Evaluating Fine-Grained Multi-Concept Control in LLMs

幽默或有说服力,但不是两者:评估LLM中细粒度多概念控制

Arya Labroo, Ivaxi Sheth, Vyas Raina, Amaani Ahmed, Mario Fritz

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究评估了LLM中多概念控制的细粒度可控性,发现双概念设置下性能下降,揭示了模型在组合性上的局限性。

Comments Accepted for publication at EACL main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17284 2026-01-27 cs.CL cs.AI 79%

Mind the Ambiguity: Aleatoric Uncertainty Quantification in LLMs for Safe Medical Question Answering

注意模糊性:在LLMs中进行偶然不确定性量化以实现安全的医疗问答

Yaokun Liu, Yifan Liu, Phoebe Mbuvi, Zelin Li, Ruichen Yao, Gawon Lim, Dong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出AU-Probe框架,通过检测输入模糊性提升医疗问答的安全性与准确性。

Comments Accepted at The Web Conference 2026 (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23077 2026-01-27 cs.RO 78%

Embodied Learning of Reward for Musculoskeletal Control with Vision Language Models

具身学习奖励以实现肌肉骨骼控制与视觉语言模型

Saraswati Soedarmadji, Yunyue Wei, Chen Zhang, Yisong Yue, Yanan Sui

机构 * Tsinghua University(清华大学) California Institute of Technology(加州理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 本文提出MoVLR框架,利用视觉语言模型实现高维肌肉骨骼系统的具身学习,通过迭代交互发现和改进奖励函数。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17343 2026-01-27 cs.AI 74%

Are We Evaluating the Edit Locality of LLM Model Editing Properly?

我们是否正确评估了LLM模型编辑的编辑局部性?

Wei Liu, Haomei Xu, Hongkai Liu, Zhiying Deng, Ruixuan Li, Heng Huang, Yee Whye Teh, Wee Sun Lee

机构 * National University of Singapore(新加坡国立大学) Huazhong University of Science(华中科技大学) Central China Normal University University of Maryland, College Park(马里兰大学学院市分校)

专题命中 知识编辑与模型理解 :LLM(title);分类 cs.AI

AI总结 本文提出了一种改进的LLM模型编辑特异性评估协议,以更准确地衡量知识保留能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17086 2026-01-27 cs.SD cs.AI eess.AS 74%

SonoEdit: Null-Space Constrained Knowledge Editing for Pronunciation Correction in LLM-Based TTS

SonoEdit:基于空域约束的知识编辑用于LLM基于TTS的发音纠正

Ayush Pratap Singh, Harshit Singh, Nityanand Mathur, Akshat Mandloi, Sudarshan Kamath

机构 * TU Darmstadt(图宾根大学) UMD(马里兰大学) Smallest AI(最小AI)

专题命中 知识编辑与模型理解 :LLM(title);分类 cs.AI

AI总结 SonoEdit通过空域约束编辑技术,无需重新训练即可修正预训练TTS模型中特定词汇的发音错误,同时保持其他行为不变。

详情

展开后加载摘要…

URL PDF HTML 收藏