arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-30 至 2026-01-30 共收录 258 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 11 篇

2506.09277 2026-01-30 cs.CL 85%

NeuroFaith: Evaluating LLM Self-Explanation Faithfulness via Internal Representation Alignment

NeuroFaith:通过内部表示对齐评估LLM自解释的忠实性

Milan Bhan, Jean-Noel Vittaut, Nicolas Chesneau, Sarath Chandar, Marie-Jeanne Lesot

机构 * Sorbonne Université, CNRS, LIP6(索邦大学、国家科学研究中心、LIP6实验室) Mila - Quebec AI Institute, Université de Montréal(魁北克人工智能研究院、蒙特利尔大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 NeuroFaith通过内部表示对齐评估LLM自解释的忠实性,提出了一种灵活的框架和线性探针以提高模型的解释可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22028 2026-01-30 cs.LG 79%

From Logits to Latents: Contrastive Representation Shaping for LLM Unlearning

从 logits 到 latents:用于大语言模型遗忘的对比表示塑造

Haoran Tang, Rajiv Khanna

机构 * Purdue University(普渡大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);分类 cs.LG

AI总结 CLReg 通过对比表示正则化减少大语言模型中遗忘与保留知识的纠缠,提升遗忘效果并降低隐私风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21380 2026-01-30 cs.CR 78%

RerouteGuard: Understanding and Mitigating Adversarial Risks for LLM Routing

RerouteGuard: 理解并缓解LLM路由中的对抗风险

Wenhui Zhang, Huiyu Xu, Zhibo Wang, Zhichao Li, Zeqing He, Xuelin Wei, Kui Ren

专题命中 知识编辑与模型理解 :LLM(title,abstract)

AI总结 RerouteGuard通过动态嵌入检测和自适应阈值,有效检测并缓解LLM路由中的对抗风险,提升多模型AI系统的安全性。

Comments 15 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20420 2026-01-30 cs.LG 77%

Concept Component Analysis: A Principled Approach for Concept Extraction in LLMs

概念成分分析:一种用于大语言模型中概念提取的原则性方法

Yuhang Liu, Erdun Gao, Dong Gong, Anton van den Hengel, Javen Qinfeng Shi

机构 * Australian Institute for Machine Learning, The University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学) School of Computer Science and Engineering, The University of New South Wales(计算机科学与工程学院,新南威尔士大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出概念成分分析(ConCA)方法,通过无监督线性解混从LLM中提取可解释概念,提供理论支持优于现有SAEs方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04418 2026-01-30 cs.LG cs.CL 73%

The Illusion of Certainty: Uncertainty Quantification for LLMs Fails under Ambiguity

确定性的幻觉:在歧义下LLM的不确定性量化失效

Tim Tomov, Dominik Fuchsgruber, Tom Wollschläger, Stephan Günnemann

机构 * School of Computation, Information Technology \& Munich Data Science Institute - Technical University of Munich

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究揭示了在歧义环境下LLM的不确定性量化方法存在缺陷,提出了MAQA*和AmbigQA*数据集以评估模型在歧义数据上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13578 2026-01-30 cs.CV cs.AI cs.LG 73%

CMOOD: Concept-based Multi-label OOD Detection

基于概念的多标签异常检测

Zhendong Liu, Yi Nian, Yuehan Qin, Henry Peng Zou, Li Li, Xiyang Hu, Yue Zhao

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 COOD提出了一种基于概念的零样本多标签OOD检测框架,通过增强语义空间和改进评分函数,有效区分复杂标签依赖的OOD样本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25262 2026-01-30 cs.LG cs.AI 62%

IBNorm: Information-Bottleneck Inspired Normalization for Representation Learning

IBNorm: 信息瓶颈启发的表示学习规范化方法

Xiandong Zou, Jia Li, Xiaotong Yuan, Pan Zhou

机构 * Singapore Management University(新加坡管理大学) Beijing Normal University(北京师范大学) Nanjing University(南京大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG

AI总结 IBNorm基于信息瓶颈原理,通过有界压缩操作提升表示学习的信息量和稳定性,实验表明其在多种模型中优于传统规范化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 11 篇

2601.21681 2026-01-30 cs.LG physics.flu-dyn 89%

LLM4Fluid: Large Language Models as Generalizable Neural Solvers for Fluid Dynamics

LLM4Fluid: 大语言模型作为通用神经求解器用于流体动力学

Qisong Xiao, Xinhai Chen, Qinglin Wang, Xiaowei Guo, Binglin Wang, Weifeng Chen, Zhichao Wang, Yunfei Liu, Rui Xia, Hang Zou, Gencheng Liu, Shuai Li, Jie Liu

机构 * National Key Laboratory of Parallel and Distributed Computing(平行与分布式计算国家重点实验室) Laboratory of Digitizing Software for Frontier Equipment(前沿设备数字化软件实验室) College of Computer Science and Technology(计算机科学与技术学院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 LLM4Fluid利用大语言模型作为通用神经求解器,通过降阶建模和物理引导解构机制,实现流体动力学的高效预测与泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22020 2026-01-30 cs.LG cs.CV 88%

Visual-Guided Key-Token Regularization for Multimodal Large Language Model Unlearning

多模态大语言模型去敏中的视觉引导关键标记正则化

Chengyi Cai, Zesheng Ye, Peike Li, Bo Han, Jianzhong Qi, Feng Liu

机构 * The University of Melbourne(墨尔本大学) Google Research(谷歌研究) Hong Kong Baptist University(香港 Baptist 大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出视觉引导的关键标记正则化方法,用于多模态大语言模型的去敏,通过信息熵定义关键标记并利用梯度重新加权提升去敏效果,实验表明能有效减少遗忘并保持响应一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21339 2026-01-30 cs.AI 86%

Within-Model vs Between-Prompt Variability in Large Language Models for Creative Tasks

大语言模型在创造性任务中模型内与提示间变异性研究

Jennifer Haase, Jana Gonnermann-Müller, Paul H. P. Hanel, Nicolas Leins, Thomas Kosch, Jan Mendling, Sebastian Pokutta

机构 * Zuse Institute Berlin, Berlin, Germany(柏林Zuse研究所) Weizenbaum Institute for the Networked Society, Berlin, Germany(网络化社会研究所) University of Essex, Colchester, UK(埃塞克斯大学)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 研究探讨了大语言模型在创造性任务中提示与模型选择对输出质量的影响,发现提示和模型选择对原创性有相似影响,但模型内方差对流畅性影响更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05029 2026-01-30 cs.AI cs.MA 85%

Reputation as a Solution to Cooperation Collapse in LLM-based MASs

声誉作为解决基于大语言模型的多智能体系统合作崩溃的解决方案

Siyue Ren, Wanli Fu, Xinkun Zou, Chen Shen, Yi Cai, Chen Chu, Zhen Wang, Shuyue Hu

机构 * School of Mechanical Engineering, Northwestern Polytechnical University(西北工业大学机械工程学院) School of Cybersecurity, Northwestern Polytechnical University(西北工业大学网络安全学院) School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(西北工业大学人工智能、光学和电子学(iOPEN)学院) Kyushu University(九州大学) South China University of Technology(华南理工大学) Yunnan University of Finance and Economics(云南财经大学) Northwestern Polytechnical University(西北工业大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 RepuNet通过动态双层声誉框架解决基于大语言模型的多智能体系统中的合作崩溃问题,促进并维持合作。

Comments Published as a conference paper at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04503 2026-01-30 physics.soc-ph cs.AI cs.MA 78%

When LLMs Play the Telephone Game: Cultural Attractors as Conceptual Tools to Evaluate LLMs in Multi-turn Settings

当LLMs玩电话游戏:文化吸引子作为评估多轮设置中LLM的观念工具

Jérémy Perez, Grgur Kovač, Corentin Léger, Cédric Colas, Gaia Molinaro, Maxime Derex, Pierre-Yves Oudeyer, Clément Moulin-Frier

机构 * Inria(法国国家信息与自动化研究所) Université de Bordeaux(波尔多大学) MIT(麻省理工学院) Computational Cognitive Science Lab(计算认知科学实验室) University of California, Berkeley(加州大学伯克利分校) Institute for Advanced Study in Toulouse(图卢兹高级研究学院)

专题命中 其他LLM :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过电话游戏实验揭示LLM多轮交互中的信息失真与吸引子现象,探讨初始文本、指令等对吸引子效应的影响。

Comments Code available at https://github.com/jeremyperez2/TelephoneGameLLM. Companion website with a Data Explorer tool at https://sites.google.com/view/telephone-game-llm . This paper was published at the 2025 International Conference on Learning Representations (ICLR2025) https://iclr.cc/virtual/2025/poster/28880

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22008 2026-01-30 cs.IR 78%

LANCER: LLM Reranking for Nugget Coverage

LANCER: 用于 nugget 覆盖的 LLM 重排序

Jia-Huei Ju, François G. Landry, Eugene Yang, Suzan Verberne, Andrew Yates

专题命中 其他LLM :LLM(title,abstract)

AI总结 LANCER 通过生成子问题并重排序文档,提升长形式 RAG 中的信息覆盖度。

Comments ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21511 2026-01-30 cs.AI cs.NE cs.SE 77%

LLaMEA-SAGE: Guiding Automated Algorithm Design with Structural Feedback from Explainable AI

LLaMEA-SAGE: 通过可解释AI的结构反馈引导自动算法设计

Niki van Stein, Anna V. Kononova, Lars Kotthoff, Thomas Bäck

机构 * LIACS, Leiden University(莱顿大学信息科学研究中心) University of St Andrews(圣安德鲁大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 LLaMEA-SAGE通过可解释AI的结构反馈引导自动算法设计,提升搜索效率和性能。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21678 2026-01-30 cs.CL physics.data-an 70%

Scale-Dependent Semantic Dynamics Revealed by Allan Deviation

通过阿兰偏差揭示的尺度依赖语义动态

Debayan Dasgupta

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 通过阿兰偏差分析,揭示了语义动态在不同尺度下的变化特征,发现大语言模型在稳定性方面存在系统性不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20880 2026-01-30 stat.AP cs.LG 70%

Spatial Heterogeneity in Climate Risk and Human Flourishing: An Exploration with Generative AI

气候风险与人类繁荣的空间异质性:基于生成AI的探索

Stefano Maria Iacus, Haodong Qi, Devika Jain

机构 * Institute for Quantitative Social Science, Harvard University(哈佛大学定量社会科学研究所) Stockholm University(斯德哥尔摩大学) Department of Global Political Studies, Malmö University(马尔默大学全球政治学系) Center for Geographic Analysis, Harvard University(哈佛大学地理分析中心)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究利用生成AI和结构方程模型,探讨美国各郡累积气候风险与人类繁荣之间的空间异质性关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21220 2026-01-30 cs.CV 67%

LAMP: Learning Universal Adversarial Perturbations for Multi-Image Tasks via Pre-trained Models

LAMP: 通过预训练模型学习通用对抗扰动以实现多图像任务

Alvi Md Ishmam, Najibul Haque Sarker, Zaber Ibn Abdul Hakim, Chris Thomas

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 LAMP通过预训练模型学习通用对抗扰动,针对多图像多模态大语言模型实现高效的黑盒攻击,提升了多任务攻击成功率。

Comments Accepted in main technical track AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21116 2026-01-30 cs.SE cs.AI 57%

AI-Assisted Engineering Should Track the Epistemic Status and Temporal Validity of Architectural Decisions

AI辅助工程应跟踪架构决策的epistemic状态和时间有效性

Sankalp Gilda, Shlok Gilda

机构 * DeepThought Solutions Department of Computer Science University of Florida(佛罗里达大学计算机科学系)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出第一原理框架(FPF)以跟踪架构决策的epistemic状态和时间有效性,通过epistemic层、保守聚合和自动证据衰减机制,解决AI辅助工程中证据过期和信任膨胀的问题。

Comments 18 pages, 6 figures, 13 tables. Position paper

详情

展开后加载摘要…

URL PDF HTML 收藏