arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-22 至 2026-01-22 共收录 10 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 10 篇

2601.14310 2026-01-22 cs.CR cs.AI 89%

CORVUS: Red-Teaming Hallucination Detectors via Internal Signal Camouflage in Large Language Models

CORVUS:通过内部信号伪装在大语言模型中实现红色团队幻觉检测

Nay Myat Min, Long H. Pham, Hongyu Zhang, Jun Sun

机构 * Singapore Management University(新加坡管理大学) Chongqing University(重庆大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 CORVUS 通过内部信号伪装技术,有效检测大语言模型中的幻觉问题,并推动了对手意识的审计方法。

Comments 13 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00681 2026-01-22 cs.LG cs.AI cs.CL 89%

A Survey of Quantized Graph Representation Learning: Connecting Graph Structures with Large Language Models

图表示学习的综述:连接图结构与大语言模型

Qika Lin, Zhen Peng, Kaize Shi, Kai He, Yiming Xu, Jian Zhang, Erik Cambria, Mengling Feng

机构 * National University of Singapore(新加坡国立大学) Xi’an Jiaotong University(西安交通大学) University of Southern Queensland(南方昆士兰大学) Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文综述了量化图表示学习,探讨了其与大语言模型的整合方法及未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11910 2026-01-22 cs.CV 87%

A Training-Free Guess What Vision Language Model from Snippets to Open-Vocabulary Object Detection

无需训练的Guess What视觉语言模型:从片段到开放词汇物体检测

Guiying Zhu, Bowen Yang, Yin Zhuang, Tong Zhang, Guanqun Wang, Zhihao Che, He Chen, Lianlin Li

机构 * Aerospace and Informatics Domain(航空航天与信息领域) National Key Laboratory of Science and Technology on Space-Born Intelligent Information Processing(空间智能信息处理国家级重点实验室) School of Electronic(电子学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);foundation model(abstract)

AI总结 本文提出无需训练的Guess What视觉语言模型GW-VLM,通过多尺度视觉语言搜索与上下文概念提示实现开放词汇物体检测的高效检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01631 2026-01-22 cs.AI 83%

Unraveling LLM Jailbreaks Through Safety Knowledge Neurons

通过安全知识神经元揭开大语言模型劫持的面纱

Chongwen Zhao, Yutong Ke, Kaizhu Huang

机构 * Duke Kunshan University(杜克昆山大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出SafeTuning方法,通过调整安全知识神经元激活来提升大语言模型对劫持攻击的防御能力,实验显示其在多个模型上均有效

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14622 2026-01-22 cs.RO 82%

Probing Prompt Design for Socially Compliant Robot Navigation with Vision Language Models

通过视觉语言模型探索社交合规机器人导航的提示设计

Ling Xiao, Toshihiko Yamasaki

机构 * Hokkaido University(北海道大学) The University of Tokyo(东京大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract)

AI总结 本文通过设计社交合规的提示策略,提升小型视觉语言模型在机器人导航中的行动准确性,发现与自我竞争的提示设计效果最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14280 2026-01-22 cs.CL cs.AI 79%

Hallucination-Free Automatic Question & Answer Generation for Intuitive Learning

无幻觉的自动问答生成用于直观学习

Nicholas X. Wang, Aggelos K. Katsaggelos

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出无幻觉的多代理生成框架,通过结构化协作减少教育内容中的幻觉,提升问答生成的准确性与教育价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25247 2026-01-22 cs.SE cs.AI cs.LG 79%

Protocode: Prototype-Driven Interpretability for Code Generation in LLMs

Protocode: 为LLMs中的代码生成提供原型驱动的可解释性

Krishna Vamshi Bodla, Haizhao Yang

机构 * University of Maryland, College Park(马里兰大学 College Park分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 Protocode通过原型驱动的ICL采样提升代码生成的可解释性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11509 2026-01-22 cs.CL cs.AI 73%

Does Less Hallucination Mean Less Creativity? An Empirical Investigation in LLMs

减少幻觉是否意味着减少创造力?在大语言模型中的实证研究

Mohor Banerjee, Nadya Yuki Wangsajaya, Syed Ali Redha Alsagoff, Min Sen Tan, Zachary Choy Kit Chun, Alvin Chan Guo Wei

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨了三种减少幻觉的方法对大语言模型创造力的影响,发现CoVe促进发散思维,DoLa抑制创造力,RAG影响较小,为科学应用中的准确性与创造性平衡提供指导。

Comments Accepted at the AAAI 2026 Workshop on AI for Scientific Research (AI4Research)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07404 2026-01-22 cs.SE cs.AI cs.LG 73%

On LLMs' Internal Representation of Code Correctness

关于LLMs内部对代码正确性的表示

Francisco Ribeiro, Claudio Spiess, Prem Devanbu, Sarah Nadi

机构 * New York University Abu Dhabi(纽约大学阿布扎比分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了LLMs内部对代码正确性的表示,通过对比隐藏状态识别正确性表示,并展示其在提升代码生成质量与可靠性方面的贡献。

Comments Accepted for ICSE'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14804 2026-01-22 cs.CV 50%

Symmetry Informative and Agnostic Feature Disentanglement for 3D Shapes

对3D形状的对称信息性和对称无关性特征解耦

Tobias Weißberg, Weikang Wang, Paul Roetzer, Nafie El Amrani, Florian Bernard

机构 * University of Bonn(波恩大学) Lamarr Institute(拉玛尔研究所)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 本文提出了一种同时具有对称信息性和对称无关性的特征解耦方法,以提高3D形状分析的鲁棒性和准确性。

Comments Accepted at 3DV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏