arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-06 至 2026-02-06 共收录 201 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 10 篇

2602.05859 2026-02-06 cs.LG cs.AI cs.CL 88%

DLM-Scope: Mechanistic Interpretability of Diffusion Language Models via Sparse Autoencoders

DLM-Scope:通过稀疏自编码器实现扩散语言模型的机制可解释性

Xu Wang, Bingqing Jiang, Yu Wan, Baosong Yang, Lingpeng Kong, Difan Zou

机构 * The University of Hong Kong(香港大学) Tongyi Lab, Alibaba Group Inc(阿里云实验室)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);post-training(abstract)

AI总结 DLM-Scope通过稀疏自编码器首次实现扩散语言模型的机制可解释性,展示了其在特征提取和干预中的有效性。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05115 2026-02-06 cs.AI cs.CL 86%

SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers

SocialVeil:在沟通障碍下探测语言代理的社会智能

Keyang Xuan, Pengda Wang, Chongrui Ye, Haofei Yu, Tal August, Jiaxuan You

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院) Department of Psychological Sciences, Rice University(里士满大学心理学系)

专题命中 知识编辑与模型理解 :language agent(title);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SocialVeil通过模拟沟通障碍测试语言模型的社会智能,发现障碍显著降低相互理解并增加困惑度,表明真实社交环境下的交互挑战。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05905 2026-02-06 cs.CL 81%

Codified Finite-state Machines for Role-playing

编码有限状态机用于角色扮演

Letian Peng, Yupeng Hou, Kun Zhou, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出编码有限状态机(CFSMs)和编码概率有限状态机(CPFSMs)框架,通过自动编码文本角色档案生成可解释的状态机,提升角色扮演中的一致性和随机性探索能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00377 2026-02-06 cs.CL 79%

DecompressionLM: Deterministic, Diagnostic, and Zero-Shot Concept Graph Extraction from Language Models

DecompressionLM:从语言模型中确定性、诊断性地提取零样本概念图

Zhaochen Hong, Jiaxuan You

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

AI总结 DecompressionLM通过无状态框架实现零样本概念图提取,揭示语言模型编码内容,解决跨序列耦合、竞争解码效应和可扩展性限制问题,提升压缩模型的知识广度和事实基础评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04560 2026-02-06 cs.LG stat.ML 79%

GAMformer: Bridging Tabular Foundation Models and Interpretable Machine Learning

GAMformer: 联接表格基础模型与可解释机器学习

Andreas Mueller, Julien Siems, Harsha Nori, David Salinas, Arber Zela, Rich Caruana, Frank Hutter

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.LG

AI总结 GAMformer是首个针对GAMs的表格基础模型,通过上下文学习在一个前向传递中估计GAM形状函数,实现了基础模型的威力与关键应用的可解释性需求之间的平衡。

Comments 22 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05128 2026-02-06 cs.HC 79%

Reporting and Reviewing LLM-Integrated Systems in HCI: Challenges and Considerations

在人机交互中报告和审查集成大语言模型的系统:挑战与考虑

Karla Felix Navarro, Eugene Syriani, Ian Arawjo

专题命中 知识编辑与模型理解 :LLM(title,abstract)

AI总结 本文探讨了在人机交互中报告和审查集成大语言模型系统时的挑战,指出信任规范受大语言模型行为不确定性和夸大宣传影响,并提出作者与评审者在标准应用上的不一致及情境依赖的提示报告问题。

Comments 18 pages, 1 figure, 2 tables. For proposed reporting guidelines, see https://ianarawjo.github.io/Guidelines-for-Reporting-LLM-Integrated-Systems-in-HCI/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05874 2026-02-06 cs.CL cs.AI 79%

xList-Hate: A Checklist-Based Framework for Interpretable and Generalizable Hate Speech Detection

xList-Hate: 一个基于检查表的框架用于可解释且可推广的仇恨言论检测

Adrián Girón, Pablo Miralles, Javier Huertas-Tato, Sergio D'Antonio, David Camacho

机构 * Universidad Politécnica de Madrid(马德里理工大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 xList-Hate通过基于检查表的诊断框架,提升仇恨言论检测的可解释性和跨领域鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05927 2026-02-06 stat.ML cs.LG 70%

Transformers Are Born Biased: Structural Inductive Biases at Random Initialization and Their Practical Consequences

Transformer 诞生时的偏见:随机初始化下的结构归纳偏见及其实际影响

Siquan Li, Yao Tong, Haonan Wang, Tianyang Hu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) National University of Singapore(新加坡国立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究揭示了随机初始化的 Transformer 存在结构偏见,通过 SeedPrint 方法区分初始化差异的模型,并解释了注意力机制导致的汇现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05464 2026-02-06 cs.AI cs.CV cs.LG 62%

Refine and Purify: Orthogonal Basis Optimization with Null-Space Denoising for Conditional Representation Learning

细化与净化:基于空域去噪的正交基优化用于条件表示学习

Jiaquan Wang, Yan Lyu, Chen Li, Yuheng Jia

机构 * School of Computer Science and Engineering, Southeast University, China(计算机科学与工程学院,东南大学) Biomedicine Discovery Institute, Department of Biochemistry and Molecular Biology, Monash University, Australia(生物医学发现研究所,墨尔本大学)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 OD-CRL通过正交基优化和空域去噪技术提升条件表示学习的性能,实现更稳健的特征提取与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05340 2026-02-06 stat.ML cs.LG 57%

Decision-Focused Sequential Experimental Design: A Directional Uncertainty-Guided Approach

决策导向的顺序实验设计:一种方向性不确定性引导方法

Beichen Wan, Mo Liu, Paul Grigas, Zuo-Jun Max Shen

机构 * Department of Statistics and Operations Research, University of North Carolina(统计与运筹学系,北卡罗来纳大学) Department of Industrial Engineering and Operations Research, University of California, Berkeley(工业工程与运筹学系,加州大学伯克利分校)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.LG

AI总结 本文提出一种基于方向性的不确定性度量,用于改进顺序实验设计,以更有效地优化决策损失。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 11 篇

2510.08859 2026-02-06 cs.CL cs.AI cs.CR 90%

Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models

模式增强的多轮劫持:在大语言模型中利用结构漏洞

Ragib Amin Nihal, Rui Wen, Kazuhiro Nakadai, Jun Sakuma

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出PE-CoA框架,通过五个对话模式构建多轮劫持攻击,揭示了大语言模型在不同危害类别下的漏洞及防御局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03969 2026-02-06 cs.AI cs.CR cs.LG 86%

How Catastrophic is Your LLM? Certifying Risk in Conversation

你的LLM有多危险?对话中风险的认证

Chengxiao Wang, Isha Chaudhary, Qian Hu, Weitong Ruan, Rahul Gupta, Gagandeep Singh

机构 * University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出C$^3$LLM框架,通过统计方法认证LLMs在多轮对话中的灾难性风险,揭示前沿模型中高达70%的潜在风险,强调改进安全训练的必要性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05864 2026-02-06 cs.HC 86%

Prompting Destiny: Negotiating Socialization and Growth in an LLM-Mediated Speculative Gameworld

提示命运:在LLM中介的推测游戏世界中协商社会化与成长

Mandi Yang, Zhiqi Gao, Yibo Meng, Dongyijie Primo Pan

专题命中 其他LLM :LLM(title,abstract);prompting(title)

AI总结 本文提出了一款LLM中介的推测游戏,通过四季结构探讨社会化过程中道德责任与教育角色定位的反思机制,揭示了开放性表达与持续参与间的张力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05877 2026-02-06 cs.AI cs.HC 85%

Agent2Agent Threats in Safety-Critical LLM Assistants: A Human-Centric Taxonomy

安全关键型LLM助手中的Agent2Agent威胁:以人为中心的分类

Lukas Stappen, Ahmet Erkan Turan, Johann Hagerer, Georg Groh

机构 * BMW Group Research(宝马集团研究) Technical University Munich(慕尼黑技术大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出AgentHeLLM框架,通过分离资产识别与攻击路径分析,为安全关键型LLM助手提供以人为中心的威胁建模方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03999 2026-02-06 cs.CL 85%

LH-Deception: Simulating and Understanding LLM Deceptive Behaviors in Long-Horizon Interactions

LH-Deception:模拟和理解长周期交互中大语言模型的欺骗行为

Yang Xu, Xuanming Zhang, Samuel Yeh, Jwala Dhamala, Ousmane Dia, Rahul Gupta, Sharon Li

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Zhejiang University(浙江大学) Amazon AGI(亚马逊人工智能研究院)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 LH-Deception通过多智能体系统模拟长周期交互中的LLM欺骗行为,揭示欺骗的模型依赖性和对信任的侵蚀,为真实场景下的LLM评估提供基础。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05987 2026-02-06 cs.HC 85%

From Human-Human Collaboration to Human-Agent Collaboration: A Vision, Design Philosophy, and an Empirical Framework for Achieving Successful Partnerships Between Humans and LLM Agents

从人与人协作到人与智能体协作:一种愿景、设计哲学和实现人与LLM智能体成功合作的实证框架

Bingsheng Yao, Chaoran Chen, April Yi Wang, Sherry Tongshuang Wu, Toby Jia-jun Li, Dakuo Wang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出通过借鉴远程人类协作的研究来设计和研究人与LLM智能体的合作,建立新的协作范式和研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07053 2026-02-06 cs.CL cs.SD eess.AS 83%

TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling

TASTE: 用于语音语言建模的文本对齐语音标记化与嵌入

Liang-Hsuan Tseng, Yi-Chang Chen, Kuan-Yi Lee, Da-Shan Shiu, Hung-yi Lee

机构 * MediaTek Research(联发科技研究) Graduate Institute of Communication Engineering, National Taiwan University(国立台湾大学通信工程研究所) Artificial Intelligence Center of Research Excellence, National Taiwan University(国立台湾大学卓越人工智能研究中心)

专题命中 其他LLM :language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 TASTE通过语音重建目标实现文本对齐的语音标记化与嵌入,提升语音语言建模的性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05998 2026-02-06 cs.CV 67%

VisRefiner: Learning from Visual Differences for Screenshot-to-Code Generation

VisRefiner: 从视觉差异中学习以实现截图到代码生成

Jie Deng, Kaichun Yao, Libo Zhang

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 VisRefiner通过学习视觉差异提升截图到代码生成的准确性和自我完善能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04104 2026-02-06 cs.HC 67%

Making Videos Accessible for Blind and Low Vision Users Using a Multimodal Agent Video Player

通过多模态代理视频播放器使视频对视障和低视力用户更加可访问

Adriana Olmos, Anoop K. Sinha, Renelito Delos Santos, Ruben Rodriguez Rodriguez, James A. Landay, Sam S. Sepah, Philip Nelson, Shaun K. Kane

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出一种多模态代理视频播放器,通过多层提示编排为视障和低视力用户带来交互式、可访问的视频体验,增强用户自主性和信任感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05769 2026-02-06 cs.CL 57%

Different Time, Different Language: Revisiting the Bias Against Non-Native Speakers in GPT Detectors

不同时区,不同语言:重新审视GPT检测器对非母语者的偏见

Adnan Al Ali, Jindřich Helcl, Jindřich Libovický

机构 * Charles University, Faculty of Mathematics and Physics(查理大学数学与物理系) University of Oslo, Language Technology Group(奥斯陆大学语言技术组)

专题命中 其他LLM :LLM(abstract);分类 cs.CL

AI总结 该研究重新审视了GPT检测器对非母语者的偏见问题,发现非母语者的文本困惑度不低,并且现代检测器无需依赖困惑度即可有效工作。

Comments This paper was accepted to EACL 2026 Student Research Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05035 2026-02-06 cs.CL 57%

Capacity Constraints and the Multilingual Penalty for Lexical Disambiguation

多语言限制与词义消歧的多语言惩罚

Sean Trott, Pamela D. Rivière

机构 * Rutgers University - Newark(罗格斯大学-纽瓦克)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本研究发现多语言语言模型在词义消歧任务中面临容量限制,包括表示性、注意性和词汇相关性问题,这些因素影响了模型性能。

Comments 9 pages, 5 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏