arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-08 至 2025-12-08 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 12 篇

2512.05461 2025-12-08 cs.CY cs.AI cs.HC 85%

Knowing Your Uncertainty -- On the application of LLM in social sciences

了解你的不确定性——关于LLM在社会科学中的应用

Bolun Zhang, Linzhuo Li, Yunqi Chen, Qinlin Zhao, Zihan Zhu, Xiaoyuan Yi, Xing Xie

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一个统一框架,用于评估LLM在社会科学任务中的不确定性,通过任务类型和验证类型两个维度,为研究者提供方法学保障和实践指导。

Comments 49 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16188 2025-12-08 cs.CL 83%

SAE-SSV: Supervised Steering in Sparse Representation Spaces for Reliable Control of Language Models

SAE-SSV: 在稀疏表示空间中进行监督引导以可靠控制语言模型

Zirui He, Mingyu Jin, Bo Shen, Ali Payani, Yongfeng Zhang, Mengnan Du

机构 * NJIT(新 jersey 理工学院) Rutgers University(罗格斯大学) Cisco(思科公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 SAE-SSV通过在稀疏表示空间中训练监督引导向量,实现对语言模型行为的可靠控制,提高了生成任务的成功率和可解释性。

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05546 2025-12-08 cs.CV cs.AI 79%

Conscious Gaze: Adaptive Attention Mechanisms for Hallucination Mitigation in Vision-Language Models

有意识的注视:用于视觉-语言模型中幻觉抑制的自适应注意力机制

Weijue Bu, Guan Yuan, Guixian Zhang

机构 * School of Computer Science and Technology/School of Artificial Intelligence(计算机科学与技术学院/人工智能学院) China University of Mining and Technology(中国矿业大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

AI总结 CG-VLM通过认知需求传感器和聚焦共识诱导模块,在推理时精准干预视觉-语言模型的注意力,有效抑制幻觉并提升性能。

Comments 6 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00713 2025-12-08 cs.CR cs.AI 79%

Concept-Guided Backdoor Attack on Vision Language Models

基于概念的视觉语言模型后门攻击

Haoyu Shen, Weimin Lyu, Haotian Xu, Tengfei Ma

机构 * Stony Brook University(石溪大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

AI总结 本研究提出基于概念的视觉语言模型后门攻击方法,通过概念阈值污染和概念瓶颈模型引导未见后门两种技术,实现对模型生成文本的恶意替换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19532 2025-12-08 q-bio.BM 78%

Toward the Explainability of Protein Language Models

迈向蛋白质语言模型的可解释性

Andrea Hunklinger, Noelia Ferruz

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 本文探讨了XAI在蛋白质语言模型中的应用,提出了XAI在蛋白质研究中的五个潜在角色,并呼吁推动可解释性的发展。

Comments 15 pages, 6 figures; version 4: Additional revision of the manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17162 2025-12-08 cs.CR 78%

Analyzing PDFs like Binaries: Adversarially Robust PDF Malware Analysis via Intermediate Representation and Language Model

像二进制一样分析PDF:通过中间表示和语言模型实现对抗鲁棒的PDF恶意软件分析

Side Liu, Jiang Ming, Guodong Zhou, Xinyi Liu, Jianming Fu, Guojun Peng

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 通过中间表示和语言模型实现对抗鲁棒的PDF恶意软件分析,利用语义和结构特征提取提升检测性能。

Comments Accepted by ACM CCS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02327 2025-12-08 stat.ML cs.LG 77%

Variational Uncertainty Decomposition for In-Context Learning

变分不确定性分解用于上下文学习

I. Shavindra Jayasekera, Jacob Si, Filippo Valdettaro, Wenlong Chen, A. Aldo Faisal, Yingzhen Li

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出变分不确定性分解框架,用于分解上下文学习中的先验和随机不确定性,通过优化辅助查询获得不确定性上界并诱导下界,实验验证其有效性。

Comments Neurips Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05745 2025-12-08 cs.CR cs.MM 67%

ARGUS: Defending Against Multimodal Indirect Prompt Injection via Steering Instruction-Following Behavior

ARGUS: 通过引导指令遵循行为防御多模态间接提示注入攻击

Weikai Lu, Ziqian Zeng, Kehua Zhang, Haoran Li, Huiping Zhuang, Ruidong Wang, Cen Chen, Hao Peng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

AI总结 ARGUS通过引导指令遵循行为,在表示空间中寻找最优防御方向,实现对多模态间接提示注入攻击的有效防御,同时保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08355 2025-12-08 cs.LG 57%

scE2TM improves single-cell embedding interpretability and reveals cellular perturbation signatures

scE2TM提升了单细胞嵌入的可解释性并揭示了细胞扰动特征

Hegang Chen, Yuyin Lu, Yifan Zhao, Zhiming Dai, Fu Lee Wang, Qing Li, Yanghui Rao, Yue Li

机构 * School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, China(中山大学计算机科学与工程学院) School of Computer Science, McGill University, Montreal, Canada(麦吉尔大学计算机科学学院) Department of Biomedical Informatics, Harvard Medical School, Boston, USA(哈佛医学院生物医学信息学系) School of Science and Technology, Hong Kong Metropolitan University, Hong Kong, China(香港 metropolitan 大学科学与技术学院) Department of Computing, The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学计算系)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 scE2TM通过外部知识引导的嵌入式主题模型提升单细胞嵌入的可解释性,揭示细胞扰动特征和生物通路一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05677 2025-12-08 stat.ME math.PR stat.ML 50%

Empirical Decision Theory

经验决策理论

Christoph Jansen, Georg Schollmeyer, Thomas Augustin, Julian Rodemann

专题命中 知识编辑与模型理解 :prompting(abstract)

AI总结 本文提出了一种经验决策模型,通过协议中的观察行动-后果对来处理决策问题,无需显式指定世界状态,提供了三种推断保证方法。

Comments Christoph Jansen and Georg Schollmeyer contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05482 2025-12-08 cs.CV 50%

Concept-based Explainable Data Mining with VLM for 3D Detection

基于概念的可解释数据挖掘与VLM用于3D检测

Mai Tsujimoto

机构 * The University of Tokyo(东京大学)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 本文提出基于概念的可解释数据挖掘方法,利用VLMs识别稀有物体以提升3D检测性能,减少标注负担并提高模型效果。

Comments 28 pages including appendix. Code: https://github.com/mm1129/concept_based_rare_detector_2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05349 2025-12-08 cond-mat.mtrl-sci 50%

Platonic representation of foundation machine learning interatomic potentials

柏拉图表示法用于基础机器学习互原子势

Zhenzhu Li, Aron Walsh

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 本研究提出柏拉图表示法,通过统一不同MLIPs的潜在空间,实现跨模型最优传输和可解释的嵌入运算,揭示潜在空间中几何失真与物理预测失败的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏