arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-11 至 2025-12-11 共收录 136 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 11 篇

2512.09394 2025-12-11 cs.CL 79%

Language models as tools for investigating the distinction between possible and impossible natural languages

语言模型作为探究可能与不可能自然语言区别的工具

Julie Kallini, Christopher Potts

机构 * Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

AI总结 本文探讨语言模型作为探究可能与不可能自然语言区别的工具,通过改进模型架构来揭示人类语言学习的归纳偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16407 2025-12-11 cs.SE 75%

CREME: Robustness Enhancement of Code LLMs via Layer-Aware Model Editing

通过层感知模型编辑提升代码LLM的鲁棒性

Shuhan Liu, Xing Hu, Kerui Huang, Xiaohu Yang, David Lo, Xin Xia

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 CREME通过识别并编辑鲁棒性敏感层,提升代码生成模型对提示扰动的鲁棒性,显著提高扰动提示下的生成准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09496 2025-12-11 cs.LG cs.AI 73%

Representation Invariance and Allocation: When Subgroup Balance Matters

表示不变与分配:当子组平衡至关重要时

Anissa Alloula, Charles Jones, Zuzanna Wakefield-Skorniewska, Francesco Quinzan, Bartłomiej Papież

机构 * University of Oxford(牛津大学) Imperial College London(伦敦帝国理工学院)

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨了子组平衡对模型性能的影响,提出潜在分离假设,并通过实验验证,为数据收集和平衡提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09148 2025-12-11 cs.CL cs.AI 73%

Detecting Hallucinations in Graph Retrieval-Augmented Generation via Attention Patterns and Semantic Alignment

通过注意力模式和语义对齐检测图检索增强生成中的幻觉

Shanghao Li, Jinda Han, Yibo Wang, Yuanjie Zhu, Zihe Song, Langzhou He, Kenan Kamel A Alghythee, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过注意力模式和语义对齐检测GraphRAG中的幻觉,开发了轻量级检测器GGA,提升了系统可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01481 2025-12-11 cs.CL 70%

The Vector Grounding Problem

向量语义问题

Dimitri Coelho Mollo, Raphaël Millière

机构 * Umeå University(乌梅大学) University of Oxford(牛津大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文探讨了大型语言模型是否能通过指涉 grounding 实现对现实世界的联系,提出了基于因果-信息关系和选择历史的判断标准。

Comments Accepted for publication in Philosophy and the Mind Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05507 2025-12-11 cs.PL cs.AI 57%

Grammar-Based Code Representation: Is It a Worthy Pursuit for LLMs?

基于语法的代码表示:对于大语言模型来说,这是否值得追求?

Qingyuan Liang, Zhao Zhang, Zeyu Sun, Zheng Lin, Qi Luo, Yueyi Xiao, Yizhou Chen, Yuqun Zhang, Haotian Zhang, Lu Zhang, Bin Chen, Yingfei Xiong

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) Kuaishou Technology(快手科技) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 本文探讨了基于语法的代码表示在大语言模型中的有效性,通过实验表明其在提升代码生成准确性和区分细微代码差异方面具有价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08981 2025-12-11 cs.CV cs.AI 57%

Mitigating Bias with Words: Inducing Demographic Ambiguity in Face Recognition Templates by Text Encoding

通过词语缓解偏见:通过文本编码在人脸识别模板中诱导人口统计学模糊性

Tahar Chettaoui, Naser Damer, Fadi Boutros

机构 * Fraunhofer IGD(弗劳恩霍夫研究所(IGD)) TU Darmstadt(德累斯顿技术大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 通过引入文本编码,UTIE在人脸识别模板中诱导人口统计学模糊性,以减少偏见并提升验证性能。

Comments Accepted at BMVC workshop (SRBS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 9 篇

2508.04679 2025-12-11 cs.HC 89%

MisVisFix: An Interactive Dashboard for Detecting, Explaining, and Correcting Misleading Visualizations using Large Language Models

MisVisFix: 一种利用大语言模型检测、解释和纠正误导性可视化信息的交互式仪表板

Amit Kumar Das, Klaus Mueller

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 MisVisFix利用大语言模型提供交互式工具,用于检测、解释和纠正误导性可视化信息,提升数据解读的准确性和可信度。

Comments 11 pages, 6 figures. Accepted at IEEE VIS: Visualization & Visual Analytics 2025 conference, November 2-7, 2025, Vienna, Austria

Journal ref IEEE Transactions on Visualization and Computer Graphics (TVCG), PrePrints 5555, pp. 1-11, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09117 2025-12-11 cs.AI 88%

A Categorical Analysis of Large Language Models and Why LLMs Circumvent the Symbol Grounding Problem

大型语言模型的范畴分析及为何LLMs绕过了符号 grounding 问题

Luciano Floridi, Yiyang Jia, Fernando Tohmé

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文通过范畴分析,探讨了LLMs如何绕过符号 grounding 问题,而非解决它。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08951 2025-12-11 cs.NE cs.AI cs.GR 83%

AI Co-Artist: A LLM-Powered Framework for Interactive GLSL Shader Animation Evolution

AI共艺术家:一种基于大语言模型的交互式GLSL着色器动画进化的框架

Kamer Ali Yuksel, Hassan Sawaf

机构 * aiXplain Inc.(aiXplain公司)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AI Co-Artist利用大语言模型降低GLSL着色器创作门槛,通过直观交互实现视觉艺术的进化与生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11436 2025-12-11 cs.CV 82%

TAViS: Text-bridged Audio-Visual Segmentation with Foundation Models

TAViS: 基于文本的音频视觉分割与基础模型

Ziyang Luo, Nian Liu, Xuguang Yang, Salman Khan, Rao Muhammad Anwer, Hisham Cholakkal, Fahad Shahbaz Khan, Junwei Han

机构 * Northwestern Polytechnical University(西北工业大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究院)

专题命中 其他LLM :foundation model(title,abstract);prompting(abstract)

AI总结 TAViS通过文本桥接机制结合多模态基础模型与分割模型,实现高效的音频视觉分割与跨模态对齐。

Comments ICCV2025,code:https://github.com/Sssssuperior/TAViS

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09894 2025-12-11 cs.LG 79%

Exploring Protein Language Model Architecture-Induced Biases for Antibody Comprehension

探索蛋白质语言模型架构引起的抗体理解偏差

Mengren, Liu, Yixiang Zhang, Yiming, Zhang

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本研究探讨了蛋白质语言模型架构对抗体理解偏差的影响,通过对比不同模型在抗体靶向预测中的表现,揭示了架构选择对生物特征提取的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12909 2025-12-11 cs.LG cs.AI 73%

Sinusoidal Initialization, Time for a New Start

正弦初始化,新的开始

Alberto Fernández-Hernández, Jose I. Mestre, Manuel F. Dolz, Jose Duato, Enrique S. Quintana-Ortí

机构 * OpenChip(OpenChip公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出正弦初始化方法,通过结构化权重矩阵提升深度学习模型的收敛速度、稳定性及准确率。

Journal ref NeurIPS (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08662 2025-12-11 cs.CL cs.LG econ.GN q-fin.EC 73%

Revealing economic facts: LLMs know more than they say

揭示经济事实:LLMs知道的比他们说的更多

Marcus Buckmann, Quynh Anh Nguyen, Edward Hill

机构 * Bank of England(英格兰银行)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文通过分析LLM隐藏状态,发现其能更准确地估计经济数据,提出简单线性模型和迁移学习方法提升估计精度,并展示其在数据填补中的应用价值。

Comments 34 pages, 17 figures

Journal ref Bank of England Staff Working Paper Series, No. 1150 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17863 2025-12-11 cs.LG cs.NE 70%

The emergence of sparse attention: impact of data distribution and benefits of repetition

稀疏注意力的出现:数据分布的影响与重复性的益处

Nicolas Zucchet, Francesco d'Angelo, Andrew K. Lampinen, Stephanie C. Y. Chan

机构 * ETH Zürich(苏黎世联邦理工学院) EPFL(苏黎世联邦理工学院) Google DeepMind(谷歌DeepMind)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了稀疏注意力在训练过程中的涌现机制,揭示其与任务结构、架构和优化器选择的关系,并发现重复能加速这一过程。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09182 2025-12-11 cs.LG 57%

Understanding the Failure Modes of Transformers through the Lens of Graph Neural Networks

通过图神经网络视角理解Transformer的失效模式

Hunjae Lee

机构 * Department of Computer Science(计算机科学系) Southern Methodist University(南方 Methodist 大学)

专题命中 其他LLM :LLM(abstract);分类 cs.LG

AI总结 本文通过图神经网络视角分析Transformer的失效模式,揭示信息传播瓶颈及改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏