arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7608 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7608 篇

2409.18901 2026-03-10 cs.CV cs.AI cs.MM eess.IV 83%

Improving Visual Object Tracking through Visual Prompting

通过视觉提示提升视觉目标跟踪

Shih-Fang Chen, Jun-Cheng Chen, I-Hong Jhuo, Yen-Yu Lin

机构 * Department of Computer Science, National Yang Ming Chiao Tung University(国立阳明交通大学计算机科学系) Research Center for Information Technology Innovation, Academia Sinica, Taiwan(学术院资讯科技创新研究中心) Microsoft, Seattle, Washington, United States(微软公司)

专题命中 知识编辑与模型理解 :prompting(title,abstract);foundation model(abstract);分类 cs.AI

AI总结 PiVOT通过视觉提示机制提升目标跟踪性能,利用预训练模型生成和优化视觉提示以抑制干扰项。

Comments This article was accepted by IEEE Transactions on Multimedia (TMM) in 2024 and published in 2025

Journal ref IEEE Transactions on Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07202 2026-03-10 cs.CL 83%

Lying to Win: Assessing LLM Deception through Human-AI Games and Parallel-World Probing

谎言以赢:通过人机游戏和平行世界探测评估LLM欺骗

Arash Marioriyad, Ali Nouri, Mohammad Hossein Rohban, Mahdieh Soleymani Baghshah

机构 * Sharif University of Technology(谢里夫技术大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究通过人机游戏和平行世界探测评估LLM欺骗行为,发现存在性框架显著增加Qwen和Gemini的欺骗率,凸显需新的行为审计方法。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06459 2026-03-09 cs.CV cs.AI 83%

Do Foundation Models Know Geometry? Probing Frozen Features for Continuous Physical Measurement

基础模型知道几何吗?通过冻结特征进行连续物理测量

Yakov Pyotr Shkolnikov

专题命中 知识编辑与模型理解 :foundation model(title);LLM(abstract);language model(abstract);分类 cs.AI

AI总结 研究发现视觉-语言模型通过冻结特征可实现连续几何测量,LoRA微调和架构分析揭示了路径训练缺陷及中层注意力头对几何信号的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04724 2026-02-27 q-bio.QM cs.LG 83%

Understanding protein function with a multimodal retrieval-augmented foundation model

通过多模态检索增强基础模型理解蛋白质功能

Timothy Fei Truong, Tristan Bepler

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract);分类 cs.LG

AI总结 PoET-2通过多模态检索增强方法提升蛋白质功能理解与预测能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11706 2026-02-19 cs.CV cs.AI 83%

MC-LLaVA: Multi-Concept Personalized Vision-Language Model

MC-LLaVA:多概念个性化视觉-语言模型

Ruichuan An, Sihan Yang, Renrui Zhang, Ming Lu, Tianyi Jiang, Kai Zeng, Yulin Luo, Jiajun Cao, Hao Liang, Ying Chen, Qi She, Shanghang Zhang, Wentao Zhang

机构 * Peking University(北京大学) Intel Labs, China(英特尔实验室,中国)

专题命中 知识编辑与模型理解 :language model(title,abstract);instruction tuning(abstract);分类 cs.AI

AI总结 MC-LLaVA通过多概念指令微调和个性化提示提升视觉-语言模型的多概念个性化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16019 2026-02-19 cs.CV cs.AI 83%

MedProbCLIP: Probabilistic Adaptation of Vision-Language Foundation Model for Reliable Radiograph-Report Retrieval

MedProbCLIP: 基于概率适应的视觉-语言基础模型用于可靠放射影像-报告检索

Ahmad Elallaf, Yu Zhang, Yuktha Priya Masupalli, Jeong Yang, Young Lee, Zechun Cao, Gongbo Liang

机构 * Texas A&M University-San Antonio(德克萨斯A&M大学-圣安东尼奥分校) Boise State University(博伊州立大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract);分类 cs.AI

AI总结 MedProbCLIP 通过概率适应提升放射影像与报告检索的可靠性,优于现有基线方法。

Comments Accepted to the 2026 Winter Conference on Applications of Computer Vision (WACV) Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08548 2026-02-10 cs.CL 83%

How Do Language Models Understand Tables? A Mechanistic Analysis of Cell Location

语言模型如何理解表格?对单元格定位的机制分析

Xuanliang Zhang, Dingzirui Wang, Keyan Xu, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本研究通过分析语言模型处理表格的机制,揭示了单元格定位的三阶段流程,包括语义绑定、坐标定位和信息提取,并展示了模型如何通过离散分隔符计数和线性子空间编码实现表格理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21984 2026-02-04 cs.CV cs.CL 83%

Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models

超越视觉编码器:识别和缓解大视觉-语言模型中的空间偏差

Yingjie Zhu, Xuefeng Bai, Kehai Chen, Yang Xiang, Youcheng Pan, Yongshuai Hou, Weili Guan, Jun Yu, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳学院) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文提出AGCI机制,通过动态注入全局视觉上下文缓解大视觉-语言模型中的空间偏差问题,提升模型的空间鲁棒性和下游任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02315 2026-02-03 cs.CL 83%

The Shape of Beliefs: Geometry, Dynamics, and Interventions along Representation Manifolds of Language Models' Posteriors

信念的形状:语言模型后验表示的流形、动态和干预

Raphaël Sarfati, Eric Bigelow, Daniel Wurgaft, Jack Merullo, Atticus Geiger, Owen Lewis, Tom McGrath, Ekdeep Singh Lubana

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 研究揭示了语言模型中信念的几何结构,通过干预展示了如何在流形上保持信念的一致性,表明LLMs中自然涌现出复杂结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02043 2026-02-03 cs.CV cs.AI 83%

Auto-Comp: An Automated Pipeline for Scalable Compositional Probing of Contrastive Vision-Language Models

Auto-Comp: 一种用于可扩展组合探测对比视觉-语言模型的自动化流水线

Cristian Sbrolli, Matteo Matteucci, Toshihiko Yamasaki

机构 * Politecnico di Milano(米兰理工学院) The University of Tokyo(东京大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 Auto-Comp通过自动化生成可扩展基准,揭示了对比视觉-语言模型在组合推理中的普遍缺陷及视觉-语言上下文的权衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01605 2026-02-03 cs.LG stat.ML 83%

Universal Redundancies in Time Series Foundation Models

时间序列基础模型中的通用冗余性

Anthony Bao, Venkata Hasith Vattikuti, Jeffrey Lai, William Gilpin

机构 * ECE Department, UT Austin(UT奥斯汀电子工程系) Department of Physics, UT Austin(UT奥斯汀物理系) Oden Institute, UT Austin(UT奥斯汀奥登研究所)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

AI总结 本研究揭示了时间序列基础模型中普遍存在的冗余特性,并通过理论框架和消融实验揭示了模型退化现象的根源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22757 2026-02-02 cs.LG q-bio.BM 83%

Unveiling Scaling Behaviors in Molecular Language Models: Effects of Model Size, Data, and Representation

揭示分子语言模型中的缩放行为:模型大小、数据和表示的影响

Dong Xu, Qihua Pan, Sisi Yuan, Jianqiang Li, Zexuan Zhu, Junkai Ji

机构 * School of Artificial Intelligence, Shenzhen University, Shenzhen 518060, China(人工智能学院,深圳大学,深圳518060,中国)

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.LG

AI总结 本研究通过训练300个分子语言模型,系统探讨了模型大小、数据量和表示对分子生成模型缩放行为的影响,并公开了最大分子语言模型库。

Comments 34 pages, 51 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17914 2026-01-23 cs.CL 83%

Vision-Language Models Align with Human Neural Representations in Concept Processing

视觉-语言模型在概念处理中与人类神经表征对齐

Anna Bavaresco, Marianne de Heer Kloots, Sandro Pezzelle, Raquel Fernández

机构 * Institute for Logic, Language and Computation University of Amsterdam(逻辑、语言与计算研究所 阿姆斯特丹大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL

AI总结 本研究发现视觉-语言模型在概念处理中能与人类神经表征对齐,揭示了不同架构在脑部响应中的差异。

Comments Accepted to EACL 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01631 2026-01-22 cs.AI 83%

Unraveling LLM Jailbreaks Through Safety Knowledge Neurons

通过安全知识神经元揭开大语言模型劫持的面纱

Chongwen Zhao, Yutong Ke, Kaizhu Huang

机构 * Duke Kunshan University(杜克昆山大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出SafeTuning方法,通过调整安全知识神经元激活来提升大语言模型对劫持攻击的防御能力,实验显示其在多个模型上均有效

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03300 2026-01-08 cs.CR cs.LG 83%

TRYLOCK: Defense-in-Depth Against LLM Jailbreaks via Layered Preference and Representation Engineering

TRYLOCK:通过分层偏好和表征工程实现对LLM劫持的纵深防御

Scott Thornton

机构 * AI/ML Security Researcher(人工智能与机器学习安全研究员)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 TRYLOCK通过分层偏好和表征工程实现对LLM劫持的纵深防御,结合DPO、RepE、自适应侧车和输入规范化,有效降低攻击成功率并提升安全性与易用性的平衡。

Comments 14 pages, 4 figures. Code and datasets at https://github.com/scthornton/trylock

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13676 2025-12-16 cs.CL 83%

Towards Effective Model Editing for LLM Personalization

迈向有效的LLM个性化模型编辑

Baixiang Huang, Limeng Cui, Jiapeng Liu, Haoran Wang, Jiawei Xu, Zhuiyue Tan, Yutong Chen, Chen Luo, Yi Liu, Kai Shu

机构 * Emory University(埃默里大学) Amazon(亚马逊)

专题命中 知识编辑与模型理解 :LLM(title,abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出个性化编辑框架,通过聚类偏好表示实现高效LLM个性化,提升多轮交互和隐含查询的性能。

Comments 15 pages (including appendix), 7 figures. Code, data, results, and additional resources are available at: https://model-editing.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00696 2025-12-16 q-bio.MN cs.AI cs.ET 83%

Hierarchical Molecular Language Models (HMLMs)

分层分子语言模型(HMLMs)

Hasi Hays, Yue Yu, William J. Richardson

机构 * Department of Chemical Engineering, University of Arkansas(化学工程系,亚拉巴马大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 HMLMs通过构建分子语言模型,将细胞信号传递建模为分子语言,利用分层注意力机制和跨尺度操作符整合多模态数据,提升对复杂信号网络的时间动态预测能力,推动精准医学发展。

Comments The current version includes minor revisions to the preprint v2 (arXiv preprint arXiv:2512.00696), Added the Supplementary materials section

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10453 2025-12-12 cs.CL 83%

Grammaticality Judgments in Humans and Language Models: Revisiting Generative Grammar with LLMs

人类与语言模型的语法判断:用LLMs重新审视生成语法

Lars G. B. Johnsen

机构 * National Library of Norway(挪威国家图书馆)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文通过测试LLMs在主谓倒装和寄生缺口许可任务中的表现,揭示了LLMs对句法结构的敏感性,表明其在无显式编码的情况下能通过预测训练捕捉到生成语法的结构特征。

Comments 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16188 2025-12-08 cs.CL 83%

SAE-SSV: Supervised Steering in Sparse Representation Spaces for Reliable Control of Language Models

SAE-SSV: 在稀疏表示空间中进行监督引导以可靠控制语言模型

Zirui He, Mingyu Jin, Bo Shen, Ali Payani, Yongfeng Zhang, Mengnan Du

机构 * NJIT(新 jersey 理工学院) Rutgers University(罗格斯大学) Cisco(思科公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 SAE-SSV通过在稀疏表示空间中训练监督引导向量,实现对语言模型行为的可靠控制,提高了生成任务的成功率和可解释性。

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14496 2025-12-02 cs.LG 83%

Semantic Energy: Detecting LLM Hallucination Beyond Entropy

语义能量:超越熵的LLM幻觉检测

Huan Ma, Jiadong Pan, Jing Liu, Yan Chen, Joey Tianyi Zhou, Guangyu Wang, Qinghua Hu, Hua Wu, Changqing Zhang, Haifeng Wang

机构 * Tianjin University(天津大学) Baidu Inc.(百度公司) A*STAR Centre for Frontier AI Research (CFAR)(A*STAR前沿人工智能研究中心) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 语义能量通过直接操作LLM最后层logits,结合语义聚类和能量分布,提升幻觉检测和不确定性估计的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23375 2025-12-01 cs.CL cs.CV 83%

Optimizing Multimodal Language Models through Attention-based Interpretability

通过基于注意力的可解释性优化多模态语言模型

Alexander Sergeev, Evgeny Kotelnikov

机构 * European University at Saint Petersburg(圣彼得堡欧洲大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 通过基于注意力的可解释性方法优化多模态语言模型,识别关键对象相关的注意力头以提高效率和性能。

Comments Accepted for ICAI-2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19569 2025-11-26 cs.LG 83%

An Invariant Latent Space Perspective on Language Model Inversion

语言模型反向的不变潜在空间视角

Wentao Ye, Jiaqi Hu, Haobo Wang, Xinpeng Ti, Zhiqing Xiao, Hao Chen, Liyao Li, Lei Feng, Sai Wu, Junbo Zhao

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出Inv^2A方法,通过不变潜在空间假设提升语言模型反向性能,有效对抗隐私和安全威胁。

Comments The Fortieth AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14780 2025-11-20 cs.AI 83%

Ask WhAI:Probing Belief Formation in Role-Primed LLM Agents

Keith Moore, Jun W. Kim, David Lyu, Jeffrey Heo, Ehsan Adeli

机构 * Department of Biomedical Data Science, Stanford University(生物医学数据科学系,斯坦福大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments Preprint. Accepted for publication at AIAS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03156 2025-11-14 cs.CL 83%

Neural Correlates of Language Models Are Specific to Human Language

Iñigo Parra

机构 * Department of Linguistics University of California, Berkeley(语言学系加州大学伯克利分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments To be presented at NeurIPS 2025 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09684 2025-11-06 cs.CL 83%

Inv-Entropy: A Fully Probabilistic Framework for Uncertainty Quantification in Language Models

Haoyi Song, Ruihan Ji, Naichen Shi, Fan Lai, Raed Al Kontar

机构 * University of Michigan(密歇根大学) University of Minnesota(明尼苏达大学) Northwestern University(西北大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Journal ref NeurIPS, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02759 2025-11-05 cs.AI cs.SY eess.SY 83%

LLM-Supported Formal Knowledge Representation for Enhancing Control Engineering Content with an Interactive Semantic Layer

Julius Fiedler, Carsten Knoll, Klaus Röbenack

机构 * Institute of Control Theory, TU Dresden(控制理论研究所,德累斯顿技术大学) Chair of Fundamentals of Electrical Engineering, TU Dresden(电气工程基础教授,德累斯顿技术大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);language model(abstract);分类 cs.AI

Comments 4 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00620 2025-11-04 cs.CL 83%

Certain but not Probable? Differentiating Certainty from Probability in LLM Token Outputs for Probabilistic Scenarios

Autumn Toney-Wails, Ryan Wails

机构 * SciTech Strategies, Inc.(SciTech Strategies公司) Georgetown University(乔治城大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments To appear at the Second Workshop on Uncertainty-Aware NLP @EMNLP 2025 (UncertaiNLP '25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20278 2025-11-03 q-bio.QM cs.LG 83%

The cell as a token: high-dimensional geometry in language models and cell embeddings

William Gilpin

机构 * Department of Physics, The University of Texas at Austin, Austin, Texas 78712, USA(德克萨斯大学奥斯汀分校物理系)

专题命中 知识编辑与模型理解 :language model(title);foundation model(abstract);pretraining(abstract);分类 cs.LG

Comments 4 pages, 2 figures

Journal ref Bioinformatics (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19318 2025-10-23 cs.CL 83%

HAD: HAllucination Detection Language Models Based on a Comprehensive Hallucination Taxonomy

Fan Xu, Xinyu Hu, Zhenghan Yu, Li Lin, Xu Zhang, Yang Zhang, Wei Zhou, Jinjie Gu, Xiaojun Wan

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17148 2025-10-22 cs.SE cs.AI 83%

LLM Agents for Interactive Exploration of Historical Cadastre Data: Framework and Application to Venice

Tristan Karch, Jakhongir Saydaliev, Isabella Di Lenardo, Frédéric Kaplan

机构 * DH-Lab, EPFL, Lausanne, Switzerland(DH实验室,日内瓦联邦理工学院,洛桑,瑞士)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted in Cambridge press - Computational Humanities Research 2025

Journal ref Comput. humanit. res. 1 (2025) e11

详情

展开后加载摘要…

URL PDF HTML 收藏