arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2603.06317 2026-03-09 cs.LG cs.AI 86%

From Entropy to Calibrated Uncertainty: Training Language Models to Reason About Uncertainty

从熵到校准的不确定性:训练语言模型以推理不确定性

Azza Jenane, Nassim Walha, Lukas Kuhn, Florian Buettner

机构 * German Cancer Research Center (DKFZ)(德国癌症研究中心(DKFZ)) German Cancer Consortium (DKTK)(德国癌症联盟(DKTK)) Goethe University Frankfurt, Germany(法兰克福歌德大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种三阶段流程,通过训练语言模型以在测试时高效推断校准的不确定性,提升模型在高风险领域的可靠性与泛化能力。

Comments 4 pages, submitted to AISTATS Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21158 2026-02-26 cs.LG cs.CL 86%

SELAUR: Self Evolving LLM Agent via Uncertainty-aware Rewards

通过不确定性感知奖励实现的自进化大语言模型代理

Dengjia Zhang, Xiaoou Liu, Lu Cheng, Yaqing Wang, Kenton Murray, Hua Wei

机构 * Johns Hopkins University(约翰霍普金斯大学) Arizona State University(亚利桑那州立大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Purdue University(普渡大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 SELAUR通过将不确定性直接融入奖励设计,提升大语言模型在多步决策中的探索效率和学习稳定性。

Comments Accepted by PAKDD'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20300 2026-02-25 cs.CL cs.AI 86%

What Makes a Good Query? Measuring the Impact of Human-Confusing Linguistic Features on LLM Performance

什么让一个查询良好?测量人类困惑语言特征对LLM性能的影响

William Watson, Nicole Cho, Sumitra Ganesh, Manuela Veloso

机构 * J.P. Morgan AI Research(摩根大通人工智能研究)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过分析查询特征对LLM幻觉的影响,揭示了特定语言特征与幻觉风险的关系,为优化查询设计提供依据。

Comments EACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11167 2026-02-13 cs.CL cs.AI 86%

Visualizing and Benchmarking LLM Factual Hallucination Tendencies via Internal State Analysis and Clustering

通过内部状态分析和聚类可视化和评估大语言模型事实性幻觉倾向

Nathan Mao, Varun Kaushik, Shreya Shivkumar, Parham Sharafoleslami, Kevin Zhu, Sunishchal Dev

机构 * The Harker School(哈克尔学校) Monta Vista High School(蒙塔维斯高中) University of California Berkeley(加州大学伯克利分校) Algoverse AI Research(Algoverse AI研究)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 通过FalseCite数据集评估大语言模型在误导性引用下的事实性幻觉倾向,并利用内部状态分析和聚类揭示隐藏状态的特征。

Journal ref Proceedings of IJCNLP-AACL SRW 2025, pp. 289-298

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05183 2026-02-09 cs.LG cs.AI 86%

Data-Centric Interpretability for LLM-based Multi-Agent Reinforcement Learning

面向大语言模型多智能体强化学习的数据导向可解释性

John Yan, Michael Yu, Yuqi Sun, Alexander Duffy, Tyler Marques, Matthew Lyle Olson

机构 * goodstartlabs(Good Start Labs)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Meta-Autointerp方法,利用SAEs和LLM总结器分析多智能体强化学习行为,发现细粒度行为及奖励黑客,验证SAE特征的有效性并提升智能体性能。

Comments authors 1, 2 and 3 contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14478 2026-02-09 cs.CL cs.LG 86%

Estimating Semantic Alphabet Size for LLM Uncertainty Quantification

估计语义字母表大小以用于LLM不确定性量化

Lucas H. McCabe, Rimon Melamed, Thomas Hartvigsen, H. Howie Huang

机构 * George Washington University(乔治·华盛顿大学) LMI Consulting(LMI咨询公司) University of Virginia(弗吉尼亚大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出了一种改进的语义字母表大小估计器,用于更准确地估计LLM的不确定性,同时保持高可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05115 2026-02-06 cs.AI cs.CL 86%

SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers

SocialVeil:在沟通障碍下探测语言代理的社会智能

Keyang Xuan, Pengda Wang, Chongrui Ye, Haofei Yu, Tal August, Jiaxuan You

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院) Department of Psychological Sciences, Rice University(里士满大学心理学系)

专题命中 知识编辑与模型理解 :language agent(title);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SocialVeil通过模拟沟通障碍测试语言模型的社会智能,发现障碍显著降低相互理解并增加困惑度,表明真实社交环境下的交互挑战。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04074 2026-02-05 cs.LG cs.CL 86%

Stroke Lesions as a Rosetta Stone for Language Model Interpretability

中风病变作为语言模型可解释性的一种罗塞塔石碑

Julius Fridriksson, Roger D. Newman-Norlund, Saeed Ahmadi, Regan Willis, Nadra Salman, Kalil Warren, Xiang Guan, Yong Yang, Srihari Nelakuditi, Rutvik Desai, Leonardo Bonilha, Jeff Charney, Chris Rorden

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 中风病变被用于验证语言模型的可解释性,通过比较模型扰动与人类病变模式,揭示语言处理的共享计算原则。

Comments 45 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03132 2026-02-04 cs.LG cs.AI cs.NE 86%

Contrastive Concept-Tree Search for LLM-Assisted Algorithm Discovery

对比概念树搜索用于大语言模型辅助算法发现

Timothee Leleu, Sudeera Gunathilaka, Federico Ghimenti, Surya Ganguli

机构 * NTT Research(NTT研究院) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出对比概念树搜索(CCTS)方法,通过提取层次化概念表示和对比学习模型,提升LLM辅助算法发现的搜索效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12769 2026-02-03 cs.CL cs.AI 86%

How Much Do LLMs Hallucinate across Languages? On Realistic Multilingual Estimation of LLM Hallucination

LLMs在不同语言中产生幻觉的程度有多大?对多语言现实估计LLM幻觉的探讨

Saad Obaid ul Islam, Anne Lauscher, Goran Glavaš

机构 * WüNLP, CAIDAS, University of Würzburg(乌尔姆大学) Data Science Group, University of Hamburg(汉堡大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究评估了多语言LLM在长形式问答中的幻觉程度,发现高资源语言中幻觉率与语言规模无关,且支持更多语言的LLM幻觉率更高。

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01378 2026-02-03 cs.CL cs.AI stat.ML 86%

Context Dependence and Reliability in Autoregressive Language Models

自回归语言模型中的上下文依赖性与可靠性

Poushali Sengupta, Shashi Raj Pandey, Sabita Maharjan, Frank Eliassen

机构 * Department of Informatics, University of Oslo(信息学院,奥斯陆大学) Department of Electronic Systems, Aalborg University(电子系统系,奥胡斯大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出RISE方法,用于自回归语言模型中区分关键上下文元素与冗余信息,提升解释的可靠性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22364 2026-02-02 cs.CL cs.AI 86%

Context Structure Reshapes the Representational Geometry of Language Models

上下文结构重塑语言模型的表征几何

Eghbal A. Hosseini, Yuxuan Li, Yasaman Bahri, Declan Campbell, Andrew Kyle Lampinen

机构 * Google DeepMind(谷歌DeepMind) Princeton Neuroscience Institute, Princeton University(普林斯顿神经科学研究所,普林斯顿大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 研究发现语言模型在不同任务中根据上下文结构动态调整表征方式,部分任务中上下文增加会提升预测性能,而其他任务中则不一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21060 2026-01-30 cs.LG cs.CL cs.HC 86%

Human-LLM Collaborative Feature Engineering for Tabular Data

人类与大语言模型协作的表格数据特征工程

Zhuoyan Li, Aditya Bansal, Jinzhao Li, Shishuang He, Zhuoran Lu, Mutian Zhang, Qin Liu, Yiwei Yang, Swati Jain, Ming Yin, Yunyao Li

机构 * Purdue University(普渡大学) Adobe(Adobe公司) UIUC(伊利诺伊大学香槟分校) University of Washington(华盛顿大学) UC Davis(加州大学戴维斯分校)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出人类与大语言模型协作的表格数据特征工程框架,通过解耦操作提出与选择过程,结合人类专家反馈提升特征工程效率和效果。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01675 2026-01-26 cs.CL cs.AI 86%

Linguistic traces of stochastic empathy in language models

语言模型中随机共情的语言痕迹

Bennett Kleinberg, Jari Zegers, Jonas Festor, Stefana Vida, Julian Präsent, Riccardo Loconte, Sanne Peereboom

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 研究发现语言模型通过隐含的人性表示模仿随机共情,从而在生成内容中表现出更接近人性的特征。

Comments preprint (updated)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08843 2026-01-15 cs.CL cs.LG 86%

Rubric-Conditioned LLM Grading: Alignment, Uncertainty, and Robustness

基于评分标准的LLM评分:对齐、不确定性与鲁棒性

Haotian Deng, Chris Farber, Jiyoon Lee, David Tang

机构 * Purdue University(普渡大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文研究了基于评分标准的LLM评分的对齐性、不确定性与鲁棒性,发现评分标准粒度增加时对齐性下降,通过信任曲线分析发现过滤低置信度预测可提升准确性,同时模型对同义词替换敏感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18623 2025-12-23 cs.CL cs.AI 86%

LLM-CAS: Dynamic Neuron Perturbation for Real-Time Hallucination Correction

LLM-CAS: 动态神经元扰动用于实时幻觉修正

Jensen Zhang, Ningyuan Liu, Yijia Fan, Zihao Huang, Qinglin Zeng, Kaitong Cai, Jian Wang, Keze Wang

机构 * Sun Yat-sen University(中山大学) Snap Inc(Snap公司)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 LLM-CAS通过动态神经元扰动实现实时幻觉修正,提升大型语言模型的事实准确性。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16891 2025-12-19 cs.CV cs.AI cs.IR cs.LG cs.MM 86%

LinkedOut: Linking World Knowledge Representation Out of Video LLM for Next-Generation Video Recommendation

LinkedOut: 从视频大语言模型中提取世界知识表示以实现下一代视频推荐

Haichao Zhang, Yao Lu, Lichen Wang, Yunzhe Li, Daiwei Chen, Yunpeng Xu, Yun Fu

机构 * Northeastern University(东北大学) LinkedIn(领英) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 LinkedOut通过从视频中提取世界知识表示,实现低延迟、多视频输入的视频推荐,无需人工标注,取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07020 2025-12-15 cs.RO cs.AI cs.LG 86%

Driving Through Uncertainty: Risk-Averse Control with LLM Commonsense for Autonomous Driving under Perception Deficits

在不确定性中驾驶:利用大语言模型常识实现风险厌恶控制以应对自动驾驶中的感知缺陷

Yuting Hu, Chenhui Xu, Ruiyang Qin, Dancheng Liu, Amir Nassereldine, Yiyu Shi, Jinjun Xiong

机构 * University at Buffalo(布法罗大学) University of Notre Dame(诺特尔大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出LLM-RCO框架,利用大语言模型整合人类驾驶常识,以提升自动驾驶在感知缺陷下的风险规避与适应性控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15555 2025-12-05 cs.LG cs.AI stat.ML 86%

Bayesian Concept Bottleneck Models with LLM Priors

具有LLM先验的贝叶斯概念瓶颈模型

Jean Feng, Avni Kothari, Luke Zier, Chandan Singh, Yan Shuo Tan

机构 * University of California, San Francisco(加州大学旧金山分校) Microsoft Research(微软研究院) National University of Singapore(新加坡国立大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出BC-LLM模型,利用贝叶斯框架和LLM作为先验,实现高效的概念提取和可解释性提升。

Comments 2025 Conference on Neural Information Processing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07649 2025-11-27 cs.LG cs.AI 86%

TS-RAG: Retrieval-Augmented Generation based Time Series Foundation Models are Stronger Zero-Shot Forecaster

TS-RAG:基于时间序列基础模型的检索增强生成模型在零样本预测中更强大

Kanghui Ning, Zijie Pan, Yu Liu, Yushan Jiang, James Yiming Zhang, Kashif Rasul, Anderson Schneider, Lintao Ma, Yuriy Nevmyvaka, Dongjin Song

机构 * School of Computing, University of Connecticut(康奈尔大学计算机学院) Department of Machine Learning Research, Morgan Stanley(摩根士丹利机器学习研究部) Ant Group(蚂蚁集团) TWG Global(TWG全球)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 TS-RAG通过检索增强生成框架提升时间序列预测的零样本性能和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06852 2025-11-25 cs.CR cs.AI cs.LG cs.SE 86%

Differentiated Directional Intervention A Framework for Evading LLM Safety Alignment

差异化方向干预:一种规避LLM安全对齐的框架

Peng Zhang, Peijie Sun

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DBDI框架,通过区分有害检测和拒绝执行方向,提升LLM安全对齐的规避效果。

Comments AAAI-26-AIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16540 2025-11-21 cs.CL cs.LG 86%

Beyond Tokens in Language Models: Interpreting Activations through Text Genre Chunks

超越标记的语言模型:通过文本体裁块解释激活

Éloïse Benito-Rodriguez, Einar Urdshals, Jasmina Nasufi, Nicky Pochinkov

机构 * Chalmers Technical University(挑战者技术大学) Lund University(隆德大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出通过文本体裁块的激活预测来解释语言模型,使用Mistral-7B和两个数据集,达到高达98%的F1分数。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15258 2025-11-21 cs.AI cs.CL 86%

Multi-dimensional Data Analysis and Applications Basing on LLM Agents and Knowledge Graph Interactions

基于LLM代理和知识图谱交互的多维数据分析与应用

Xi Wang, Xianyao Ling, Kun Li, Gang Yin, Liang Zhang, Jiang Wu, Jun Xu, Fu Zhang, Wenbo Lei, Annie Wang, Peng Gong

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于LLM代理与知识图谱交互的多维数据分析方法,通过自动提取产品数据、实时构建知识图谱并支持用户深入分析,提升多维数据的处理能力。

Comments 14 pages, 7 figures, 40 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13290 2025-11-18 cs.AI cs.CL cs.CY 86%

Dropouts in Confidence: Moral Uncertainty in Human-LLM Alignment

Jea Kwon, Luiz Felipe Vecchietti, Sungwon Park, Meeyoung Cha

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06700 2025-11-11 cs.CY cs.AI cs.CL 86%

Place Matters: Comparing LLM Hallucination Rates for Place-Based Legal Queries

Damian Curran, Vanessa Sporne, Lea Frermann, Jeannie Paterson

机构 * School of Computing and Information Systems, The University of Melbourne, Australia(计算与信息系统学院,墨尔本大学,澳大利亚) The Centre for Artificial Intelligence and Digital Ethics(人工智能与数字伦理中心) Melbourne Law School, The University of Melbourne, Australia(墨尔本法学院,墨尔本大学,澳大利亚)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03878 2025-11-07 cs.AI cs.IR cs.LG cs.MA 86%

KnowThyself: An Agentic Assistant for LLM Interpretability

Suraj Prasai, Mengnan Du, Ying Zhang, Fan Yang

机构 * Wake Forest University(威克森林大学) New Jersey Institute of Technology(新泽西理工学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 5 pages, 1 figure, Accepted for publication at the Demonstration Track of the 40th AAAI Conference on Artificial Intelligence (AAAI 26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02937 2025-10-29 cs.LG cs.AI 86%

FoGE: Fock Space inspired encoding for graph prompting

Sotirios Panagiotis Chytas, Rudrasis Chakraborty, Vikas Singh

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Lawrence Livermore National Lab(劳伦斯利弗莫尔国家实验室)

专题命中 知识编辑与模型理解 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18476 2025-10-22 cs.AI cs.CL 86%

Probabilistic Modeling of Intentions in Socially Intelligent LLM Agents

Feifan Xia, Yuyang Fang, Defang Li, Yantong Xie, Weikang Li, Yang Li, Deguo Xia, Jizhou Huang

机构 * Baidu Inc(百度公司) Imperial College London(伦敦帝国学院) Zhejiang University(浙江大学) Carnegie Mellon University(卡内基梅隆大学) Peking University(北京大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17028 2025-10-21 cs.CL cs.LG 86%

Mapping from Meaning: Addressing the Miscalibration of Prompt-Sensitive Language Models

Kyle Cox, Jiawei Xu, Yikun Han, Rong Xu, Tianhao Li, Chi-Yang Hsu, Tianlong Chen, Walter Gerych, Ying Ding

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence. 39, 22 (Apr. 2025), 23696-23703

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12608 2025-10-15 cs.CL cs.AI 86%

StyleDecipher: Robust and Explainable Detection of LLM-Generated Texts with Stylistic Analysis

Siyuan Li, Aodu Wulianghai, Xi Lin, Guangyan Li, Xiang Chen, Jun Wu, Jianhua Li

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Shanghai Key Laboratory of Integrated Administration Technologies for Information Security(上海信息安全集成管理技术重点实验室) State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,中国科学院自动化研究所) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏