arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2410.13928 2025-08-07 cs.LG cs.CL 85%

Automatically Interpreting Millions of Features in Large Language Models

Gonçalo Paulo, Alex Mallen, Caden Juang, Nora Belrose

机构 * Northwestern University, Evanston, Illinois, USA(西北大学)

专题命中 知识编辑与模型理解 :large language model(title);language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02790 2025-07-08 cs.CL cs.AI 85%

An Evolutionary Large Language Model for Hallucination Mitigation

Abdennour Boulesnane, Abdelhakim Souilah

机构 * BIOSTIM Laboratory Faculty of Medicine Salah Boubnider University Constantine, Algeria(BIOSTIM实验室医学院萨拉赫·布宾德大学阿尔及利亚科纳克特) Department of IFA Faculty of NTIC Abdelhamid Mehri University Constantine, Algeria(IFA部门NTIC学院阿卜杜勒哈米德·梅赫里大学阿尔及利亚科纳克特)

专题命中 知识编辑与模型理解 :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09341 2024-07-02 cs.CL cs.AI 85%

Large Language Model Bias Mitigation from the Perspective of Knowledge Editing

Ruizhe Chen, Yichen Li, Zikai Xiao, Zuozhu Liu

专题命中 知识编辑与模型理解 :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02962 2024-06-06 cs.CL cs.AI cs.IR 85%

Docs2KG: Unified Knowledge Graph Construction from Heterogeneous Documents Assisted by Large Language Models

Qiang Sun, Yuanyi Luo, Wenxiao Zhang, Sirui Li, Jichunyang Li, Kai Niu, Xiangrui Kong, Wei Liu

专题命中 知识编辑与模型理解 :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13356 2023-10-10 cs.CL cs.AI 85%

Probing the Moral Development of Large Language Models through Defining Issues Test

Kumar Tanmay, Aditi Khandelwal, Utkarsh Agarwal, Monojit Choudhury

专题命中 知识编辑与模型理解 :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments First three authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01530 2026-08-12 cs.CV 版本更新 85%

Logit Lens Supervision for Patch-Level Explanations in Vision-Language Models

在视觉语言模型中保留局部化补丁语义

Parsa Esmaeilkhani, Longin Jan Latecki

机构 * Department of Computer and Information Sciences, Temple University, Philadelphia, USA(计算机与信息科学系,特兰普大学,费城,美国)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 为解决视觉语言模型中图像与文本 tokens 信息扩散问题,提出 Logit Lens Loss(LLL)以保留图像 tokens 的局部化语义,提升模型可解释性和分割任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07208 2026-08-10 cs.CL cs.AI cs.LG econ.GN q-fin.EC 新提交 85%

Measuring Concept Content in Text from LLM Activations: ESG Evidence from Concept Vectors and Linear Probes

从大语言模型激活值中测量文本的概念内容:基于概念向量与线性探测的ESG证据

Luc Hazenoot, Zhaochun Ren, Amirhossein Zohrehvand

机构 * Leiden Institute of Advanced Computer Science, Leiden University(莱顿大学高级计算机科学研究所)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究提出用冻结LLMs的激活值测量文本概念内容,在ESG金融文本实验中,线性探测效果接近微调分类器,优于模型自身答案,且优于RFM概念向量。

Comments 19 pages, 1 figure, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18555 2026-07-22 cs.SE 新提交 85%

LM2Alloy: Investigating LLM-Generated Formal Specifications for Automated Test Derivation in Production Software

LM2Alloy:研究用于生产软件自动测试推导的大语言模型生成的形式规范

Tasmim Rashid, Muhammad Zubair Malik

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 该研究探索用大语言模型从需求文档和生产源代码生成Alloy形式规范及推导可执行测试用例,在Flipper和Cerberus库上评估,发现能揭示约束级缺陷,基于代码的规范方差更低,为生产软件自动测试推导提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13911 2026-07-16 cs.NE 新提交 85%

How to Guide LLM Generation: Dual-Surrogate Guided Search for Automated Heuristic Design

如何引导大语言模型生成:用于自动启发式设计的双代理引导搜索

Yuhan Wang, Chaoda Peng, Xingyu Wu, Sheng-Hao Wu, Zhi-Hui Zhan

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究如何在有限预算下引导大语言模型进行自动启发式设计,提出双代理引导搜索方法,通过两个互补代理评分及不确定性感知规则选择行动,在多样套件中表现出色,超越简单排名和固定偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24952 2026-06-25 cs.CL cs.AI cs.LG 新提交 85%

Perfect Detection, Failed Control: The Geometry of Knowing vs. Steering in Language Models

完美检测,控制失败:语言模型中知道与引导的几何学

Cosimo Galeone, Anna Ettorre, Minsu Park, Giuseppe Ettorre, Daniele Ligorio

机构 * Alomana

专题命中 知识编辑与模型理解 :language model(title);instruction tuning(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过几何角度测量发现,语言模型中检测行为的表示方向与控制行为的方向存在显著偏差(余弦值约0.12),表明检测不等于可控性,且该偏差源于预训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17431 2026-06-23 cs.CL cs.AI cs.LG 版本更新 85%

Fine-Grained Uncertainty Quantification for Long-Form Language Model Outputs: A Comparative Study

长文本语言模型输出的细粒度不确定性量化:一项比较研究

Dylan Bouchard, Mohit Singh Chauhan, Viren Bajaj, David Skarbrevik

机构 * CVS Health(CVS健康公司) Wellesley, MA(马萨诸塞州韦尔士利)

专题命中 知识编辑与模型理解 :language model(title);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 针对长文本生成,提出细粒度不确定性量化分类法,通过响应分解、单元级评分和响应级聚合三阶段区分方法,引入FactScore-STEM-Geo数据集,实验发现声明-响应蕴含评分优于复杂方法,声明级评分优于句子级,不确定性感知解码有效提升事实性。

Comments Accepted by TMLR; UQLM repository: https://github.com/cvs-health/uqlm

Journal ref Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11722 2026-06-11 cs.LG cs.AI cs.CL 新提交 85%

ICA Lens: Interpreting Language Models Without Training Another Dictionary

ICA Lens: 无需训练另一本词典即可解释语言模型

Sida Liu, Feijiang Han

机构 * Independent Researcher(独立研究员) University of Maryland(马里兰大学)

专题命中 知识编辑与模型理解 :language model(title);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 提出ICALens,基于独立成分分析(ICA)高效提取语言模型表示中可解释方向,无需训练稀疏自编码器,在SAEBench上表现竞争力。

Comments Ongoing Project

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29395 2026-05-29 stat.ME stat.ML 85%

Low Rank for Rank: Uncertainty-Aware Task-Specific LLM Ranking under Sparse Pairwise Comparisons

低秩排序:稀疏成对比较下不确定性感知的任务特定大语言模型排名

Jiachun Li, David Simchi-Levi, Will Wei Sun

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 提出一种低秩框架,通过稀疏成对比较进行任务特定的大语言模型排名,利用任务-模型能力矩阵的低秩结构实现跨任务信息共享,并开发了不确定性量化方法以提供置信区间和排名证书。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27997 2026-05-28 cs.CL cs.AI cs.LG 85%

Where Does Toxicity Live? Mechanistic Localization and Targeted Suppression in Language Models

毒性存在于何处?语言模型中的机制定位与定向抑制

Himanshu Beniwal, Mayank Singh

机构 * Indian Institute of Technology Gandhinagar(印度理工学院冈德辛加尔)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过分析毒性与中性提示的激活差异,定位特定层和神经元中的毒性,并利用推理时缩放或最小秩一权重编辑进行抑制,无需梯度下降,实现毒性降低同时保持语言质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02178 2026-05-19 cs.CL cs.AI cs.LG 85%

The Expert Strikes Back: Interpreting Mixture-of-Experts Language Models at Expert Level

专家反击:在专家层面解读混合专家语言模型

Jeremy Herbst, Stefan Wermter, Jae Hee Lee

机构 * Department of Informatics, University of Hamburg, Hamburg, Germany(汉堡大学信息学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究通过k稀疏探测比较MoE专家与密集FFN,发现专家神经元更单语义,提出以专家为分析单位,揭示专家是细粒度任务专家,而非领域专家或token处理者。

Comments 8 pages, 7 Figures. Accepted at ICML 2026. Improved writing, changed author order, updated citations

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07148 2026-05-11 cs.CV 85%

Uncovering and Shaping the Latent Representation of 3D Scene Topology in Vision-Language Models

揭示和塑造视觉-语言模型中3D场景拓扑的潜在表示

Haoming Wang, Wei Gao

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 知识编辑与模型理解 :language model(title,abstract);SFT(abstract,abstract_cn)

AI总结 本文研究了视觉-语言模型是否能构建3D环境的拓扑表示,通过隔离空间子空间并数学塑造潜在表示,证明其与场景3D高斯核图的拉普拉斯特征映射一致,并在空间任务中提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01048 2026-04-21 cs.CL cs.AI cs.LG 85%

Interpreting Language Models Through Concept Descriptions: A Survey

通过概念描述解读语言模型:一项调查

Nils Feldhus, Laura Kopf

机构 * BIFOLD – Berlin Institute for the Foundations of Learning and Data(柏林学习与数据基础研究所) Technische Universität Berlin(柏林技术大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文调查了通过生成自然语言概念描述来解读模型组件和抽象的方法,揭示了生成这些描述的关键方法、评估指标及数据集,并指出对更严谨因果评估的需求。

Comments Accepted at The Eight Workshop on Analyzing and Interpreting Neural Networks for NLP (BlackboxNLP), co-located with EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10107 2026-04-14 cs.HC 85%

The Double-Edged Sword of Open-Ended Interaction: How LLM-Driven NPCs Affect Players' Cognitive Load and Gaming Experience

开放式交互的双刃剑:LLM驱动的NPC如何影响玩家的认知负荷和游戏体验

Ting-Chen Hsu, Wenran Chen, Jiangxu Lin, Fei Qin, Zheyuan Zhang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究探讨LLM驱动NPC对玩家认知负荷和游戏体验的影响,揭示心理机制、任务场景差异及个体特质作用,发现NPC显著增加认知负荷但未提升整体体验,且效果随任务场景变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09318 2026-04-13 cs.PL cs.FL 85%

CIR+CVN: Bridging LLM Semantic Understanding and Petri-Net Verification for Concurrent Programs

CIR+CVN:连接LLM语义理解与Petri网验证以实现并发程序

Kaiwen Zhang, Guanjun Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出CIR+CVN框架,通过LLM生成并发抽象模型,结合Petri网验证并发程序,实现迭代调试与修复,提升并发程序的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08708 2026-04-13 cs.LG cs.AI cs.CL 85%

Every Response Counts: Quantifying Uncertainty of LLM-based Multi-Agent Systems through Tensor Decomposition

每种回应都重要:通过张量分解量化基于大语言模型的多智能体系统不确定性

Tiejin Chen, Huaiyuan Yao, Jia Chen, Evangelos E. Papalexakis, Hua Wei

机构 * Arizona State University(亚利桑那州立大学) University of California, Riverside(加利福尼亚大学河滨分校)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出MATU框架,通过张量分解量化多智能体系统中的不确定性,解决多步推理、通信路径变化和拓扑多样性等挑战,提供通用可靠性评估。

Comments Accept to ACL 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04570 2026-04-02 cs.HC 85%

A Map of Exploring Human Interaction patterns with LLM: Insights into Collaboration and Creativity

探索人类交互模式的地图:协作与创造力的洞察

Jiayang Li, Jiale Li

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过系统分析110篇人类与LLM交互研究,提出一种新的映射方法,揭示协作与创造力领域的研究现状与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22567 2026-03-25 cs.CE cs.MA 85%

TrustTrade: Human-Inspired Selective Consensus Reduces Decision Uncertainty in LLM Trading Agents

TrustTrade: 人类启发的选 择性共识降低LLM交易代理决策不确定性

Minghan Li, Rachel Gonsalves, Weiyue Li, Sunghoon Yoon, Mengyu Wang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 TrustTrade通过引入多代理选择性共识框架,减少LLM交易代理在高噪声市场中的决策不确定性,提升风险意识和稳定性。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11605 2026-03-13 cs.CV 85%

LaMoGen: Language to Motion Generation Through LLM-Guided Symbolic Inference

LaMoGen:通过LLM引导的符号推理实现语言到动作生成

Junkun Jiang, Ho Yin Au, Jingyu Xiang, Jie Chen

机构 * Department of Computer Science, Hong Kong Baptist University, HKSAR(香港 Baptist 大学计算机科学系)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LaMoGen通过LLM引导的符号推理实现语言到动作的生成,利用LabanLite动作表示提升动作的可解释性和可控性。

Comments Accepted by CVPR 2026. Supplementary material included. Project page: https://jjkislele.github.io/LaMoGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01096 2026-03-03 cs.CV cs.AI cs.CL cs.LG 85%

Unified Vision-Language Modeling via Concept Space Alignment

通过概念空间对齐实现统一的视觉-语言建模

Yifu Qiu, Paul-Ambroise Duquenne, Holger Schwenk

机构 * University of Edinburgh(爱丁堡大学) FAIR at Meta(Meta公司FAIR团队)

专题命中 知识编辑与模型理解 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过概念空间对齐实现统一的视觉-语言建模,V-SONAR在多语言和多模态任务中超越现有模型。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12021 2026-02-09 cs.SE 85%

LitterBox+: An Extensible Framework for LLM-enhanced Scratch Static Code Analysis

LitterBox+: 一种可扩展的LLM增强Scratch静态代码分析框架

Benedikt Fein, Florian Obermüller, Gordon Fraser

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LitterBox+通过将Scratch块式代码转换为文本形式,利用LLM生成能力提升静态代码分析,提供API和界面扩展,支持代码查询与修复,提升学习者编程体验。

Comments ASE 2025 Tool Demonstration Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03271 2026-02-04 cs.CR 85%

LogicScan: An LLM-driven Framework for Detecting Business Logic Vulnerabilities in Smart Contracts

LogicScan: 一种基于大语言模型的智能合约业务逻辑漏洞检测框架

Jiaqi Gao, Zijian Zhang, Yuqiang Sun, Ye Liu, Chengwei Liu, Han Liu, Yi Li, Yang Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LogicScan利用大语言模型和业务规范语言,通过挖掘链上协议的业务不变量,实现对智能合约业务逻辑漏洞的高效检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12273 2026-01-21 cs.SE 85%

Leveraging Mutation Analysis for LLM-based Repair of Quantum Programs

利用突变分析改进基于大语言模型的量子程序修复

Chihiro Yoshida, Yuta Ishimoto, Olivier Nourry, Masanari Kondo, Makoto Matsushita, Yasutaka Kamei, Yoshiki Higo

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出利用突变分析提升基于大语言模型的量子程序修复效果,通过设计不同提示配置实验,发现突变分析能显著提高修复成功率和解释质量。

Comments 6 pages, Accepted at SANER-ERA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11238 2026-01-19 cs.IR 85%

LLM-Assisted Pseudo-Relevance Feedback

基于大语言模型的伪相关反馈

David Otero, Javier Parapar

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种结合大语言模型的伪相关反馈方法,通过在RM3计算前过滤相关文档,提升查询扩展的鲁棒性和准确性。

Comments Accepted ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17535 2026-01-14 cs.IR 85%

How role-play shapes relevance judgment in zero-shot LLM rankers

角色扮演如何塑造零样本LLM排序器的相关性判断

Yumeng Wang, Jirui Qi, Catherine Chen, Panagiotis Eustratiadis, Suzan Verberne

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究探讨角色扮演如何影响零样本LLM排序器的相关性判断,发现角色描述的精心制定显著提升排序质量,且角色信号主要在早期层编码,为设计更有效的提示提供了指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02878 2026-01-07 econ.TH 85%

Improving Financial Forecasting with a Synergistic LLM-Transformer Architecture: A Hybrid Approach to Stock Price Prediction

通过协同LLM-Transformer架构提升金融预测:一种股票价格预测的混合方法

Sayed Akif Hussain, Chen Qiu-shi, Syed Amer Hussain, Syed Atif Hussain, Asma Komal, Muhammad Imran Khalid

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出混合LLM-Transformer架构,通过融合文本和数值数据提升股票价格预测精度,实验证明模型在噪声环境下具有更强的鲁棒性和可解释性。

Comments 14 pages, 6 Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏