arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2605.08513 2026-05-12 cs.CL cs.AI cs.LG 88%

A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models

单个神经元足以绕过大型语言模型的安全对齐

Hamid Kazemi, Atoosa Chegini, Maria Safi

机构 * Apple(苹果公司) University of Maryland, College Park(马里兰大学 College Park 分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 研究通过针对单个神经元展示安全对齐的两种失效方向,证明在不训练或提示工程的情况下,通过抑制或放大特定神经元可绕过安全对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04590 2026-05-05 cs.SE 88%

Specification-Driven Code Translation Powered by Large Language Models: How Far Are We?

基于大型语言模型的规范驱动代码翻译:我们距离目标还有多远?

Soumit Kanti Saha, Fazle Rabbi, Song Wang, Jinqiu Yang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 本文探讨了利用自然语言规范作为中间表示进行代码翻译的效果,通过多数据集和语言对实验发现,结合源代码可提升特定语言对的翻译质量,但整体效果不一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20903 2026-04-24 cs.CR 88%

Sensitivity Uncertainty Alignment in Large Language Models

大语言模型中的敏感性不确定性对齐

Prakul Sunil Hiremath, Harshit R. Hiremath

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出SUA框架,用于分析大语言模型在对抗性和模糊输入下的失败原因,通过敏感性与不确定性对齐提升模型可靠性。

Comments 24 pages, 4 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25088 2026-03-27 cs.CV 88%

Visual Attention Drifts,but Anchors Hold:Mitigating Hallucination in Multimodal Large Language Models via Cross-Layer Visual Anchors

视觉注意力漂移,但锚点仍有效:通过跨层视觉锚点缓解多模态大语言模型的幻觉

Chengxu Yang, Jingling Yuan, Chuang Hu, Jiawei Jiang

机构 * School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出CLVA方法,通过跨层视觉锚点缓解多模态大语言模型的幻觉问题,强调中间层视觉锚点的重要性,无需额外训练,有效抑制深度层注意力漂移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04846 2026-03-24 cs.CV 88%

Multi-Paradigm Collaborative Adversarial Attack Against Multi-Modal Large Language Models

多范式协同对抗攻击多模态大语言模型

Yuanbo Li, Tianyang Xu, Cong Hu, Tao Zhou, Xiao-Jun Wu, Josef Kittler

机构 * School of Artificial Intelligence and Computer Science, Jiangnan University(江南大学人工智能与计算机科学学院) Centre for Vision, Speech and Signal Processing (CVSSP), University of Surrey(Surrey 大学视觉、语音和信号处理中心)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 针对多模态大语言模型的多范式协同对抗攻击方法,通过聚合视觉和语言特征进行联合优化,提升对抗示例的可转移性,实验表明优于现有方法。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04268 2026-03-12 cs.CV 88%

KVSmooth: Mitigating Hallucination in Multi-modal Large Language Models through Key-Value Smoothing

KVSmooth: 通过键值平滑缓解多模态大语言模型中的幻觉

Siyu Jiang, Feiyang Chen, Xiaojin Zhang, Kun He

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 KVSmooth通过键值平滑技术有效缓解多模态大语言模型中的幻觉问题,提升生成精度和召回率。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05953 2026-03-09 cs.CL cs.AI cs.HC cs.LG 88%

Who We Are, Where We Are: Mental Health at the Intersection of Person, Situation, and Large Language Models

我们是谁,我们在哪里:心理状况在个体、情境和大语言模型交汇处

Nikita Soni, August Håkan Nilsson, Syeda Mahwish, Vasudha Varadarajan, H. Andrew Schwartz, Ryan L. Boyd

机构 * Department of Computer Science, Stony Brook University(石英布大学计算机科学系) Oslo Metropolitan University, Oslo Business School(奥斯陆 Metropolitan 大学奥斯陆商学院) University of Texas at Dallas, Dept. of Psychology(德克萨斯大学达拉斯分校心理学系)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种结合心理学理论和大语言模型的可解释模型,用于预测幸福感并识别适应性与适应不良的自我状态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24041 2026-03-02 cs.CV 88%

Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation

仔细观察:多模态大语言模型中的自适应视觉增强以缓解幻觉

Xingyu Zhu, Kesen Zhao, Liang Yi, Shuo Wang, Zhicai Wang, Beier Zhu, Hanwang Zhang

机构 * MoE Key Lab of BIPC, University of Science and Technology of China(信息与电子技术联合实验室,中国科学技术大学) Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 本研究提出自适应视觉增强框架AIR,通过减少冗余标记和选择性整合补丁来缓解多模态大语言模型中的幻觉问题。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16412 2026-02-24 cs.CV 88%

ReMoRa: Multimodal Large Language Model based on Refined Motion Representation for Long-Video Understanding

ReMoRa:基于精细运动表示的多模态大语言模型用于长视频理解

Daichi Yashima, Shuhei Kurita, Yusuke Oda, Komei Sugiura

机构 * Keio University(庆应大学) NII(日本信息处理学会) NII LLMC(日本信息处理学会语言模型中心)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 ReMoRa通过精细运动表示实现长视频理解,有效压缩视频数据并提升多模态大语言模型性能。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11563 2026-01-21 cs.CY 88%

Human-like Social Compliance in Large Language Models: Unifying Sycophancy and Conformity through Signal Competition Dynamics

大语言模型中的类人社会合规:通过信号竞争动态统一讨好与顺从

Long Zhang, Wei-neng Chen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 本研究提出信号竞争机制,揭示大语言模型中讨好与顺从的几何流形机制,并通过整合认知对齐框架提升模型的社会合规性鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04939 2025-12-23 cs.CV 88%

Verb Mirage: Unveiling and Assessing Verb Concept Hallucinations in Multimodal Large Language Models

动词幻觉:揭示和评估多模态大语言模型中的动词概念幻觉

Zehao Wang, Xinpeng Liu, Yudonglin Zhang, Xiaoqian Wu, Zhou Fang, Yifan Fang, Junfu Pu, Cewu Lu, Yong-Lu Li

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 本文首次揭示多模态大语言模型中的动词概念幻觉问题,并提出基于丰富动词知识的调优方法以有效缓解该问题。

Comments Accepted by AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17866 2025-11-27 econ.GN q-fin.EC 88%

Narratives to Numbers: Large Language Models and Economic Policy Uncertainty

叙事与数字:大型语言模型与经济政策不确定性

Ethan Hartley

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 本研究利用大型语言模型改进经济政策不确定性指数,通过构建新指数展示LLMs在文本测量中的系统性优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14749 2025-11-19 cs.CV 88%

Vision Large Language Models Are Good Noise Handlers in Engagement Analysis

Alexander Vedernikov, Puneet Kumar, Haoyu Chen, Tapio Seppänen, Xiaobai Li

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19110 2025-11-14 cs.CV 88%

LISA: A Layer-wise Integration and Suppression Approach for Hallucination Mitigation in Multimodal Large Language Models

Zhihui Guo, Xin Man, Hui Xu, Jie Shao, Zhiguo Jiang, Xianchao Zhang, Heng Tao Shen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06475 2025-11-11 cs.CV 88%

NOAH: Benchmarking Narrative Prior driven Hallucination and Omission in Video Large Language Models

Kyuho Lee, Euntae Kim, Jinwoo Choi, Buru Chang

机构 * Korea University(韩国大学) Kyung Hee University(庆熙大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

Comments 18 pages, 9 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17522 2025-09-23 cs.CV 88%

Chat-CBM: Towards Interactive Concept Bottleneck Models with Frozen Large Language Models

Hangzhou He, Lei Zhu, Kaiwen Li, Xinliang Zhang, Jiakui Hu, Ourui Fu, Zhengjian Yao, Yanye Lu

机构 * Department of Biomedical Engineering, College of Future Technology, Peking University(生物医学工程系,未来技术学院,北京大学) Institute of Medical Technology, Peking University Health Science Center, Peking University(医学技术研究所,北京大学医学部,北京大学) National Biomedical Imaging Center, College of Future Technology, Peking University(国家生物医学成像中心,未来技术学院,北京大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11952 2025-09-16 cs.CV 88%

CLAIRE: A Dual Encoder Network with RIFT Loss and Phi-3 Small Language Model Based Interpretability for Cross-Modality Synthetic Aperture Radar and Optical Land Cover Segmentation

Debopom Sutradhar, Arefin Ittesafun Abian, Mohaimenul Azam Khan Raiaan, Reem E. Mohamed, Sheikh Izzal Azid, Sami Azam

机构 * Department of Computer Science and Engineering, United International University(计算机科学与工程系,国际大学) Faculty of Science and Information Technology, Charles Darwin University(科学与信息技术学院,查尔斯·达尔文大学) School of Engineering and Energy , Murdoch University(工程与能源学院,默多尼大学) Faculty of Science and Technology, Charles Darwin University(科学与技术学院,查尔斯·达尔文大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);small language model(title,abstract)

Comments 23 pages, 6 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00918 2025-09-03 cs.CR 88%

PREE: Towards Harmless and Adaptive Fingerprint Editing in Large Language Models via Knowledge Prefix Enhancement

Xubin Yue, Zhenhua Xu, Wenpeng Xing, Jiahui Yu, Mohan Li, Meng Han

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06525 2025-08-12 cs.CV 88%

Large Language Models Facilitate Vision Reflection in Image Classification

Guoyuan An, JaeYoon Kim, SungEui Yoon

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01694 2025-08-01 cs.CR cs.SY eess.SY 88%

Graph Representation-based Model Poisoning on Federated Large Language Models

Hanlin Cai, Haofan Dong, Houtianfu Wang, Kai Li, Ozgur B. Akan

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

Comments 7 pages, 5 figures (Submitted to IEEE Communication Magazine)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24329 2025-08-01 cs.CV 88%

DisTime: Distribution-based Time Representation for Video Large Language Models

Yingsen Zeng, Zepeng Huang, Yujie Zhong, Chengjian Feng, Jie Hu, Lin Ma, Yang Liu

机构 * Meituan Inc.(美团公司) Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16692 2025-07-23 cs.IR 88%

Generating Search Explanations using Large Language Models

Arif Laksito, Mark Stevenson

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

Comments Extended Abstract - Workshop on Explainability in Information Retrieval (WExIR), SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15652 2025-07-22 cs.CV 88%

Extracting Visual Facts from Intermediate Layers for Mitigating Hallucinations in Multimodal Large Language Models

Haoran Zhou, Zihan Zhang, Hao Chen

机构 * Southeast University(东南大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04774 2025-06-06 cs.CL cs.AI cs.LG 88%

Fine-Grained Interpretation of Political Opinions in Large Language Models

Jingyu Hu, Mengyue Yang, Mengnan Du, Weiru Liu

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01031 2025-06-03 cs.CV 88%

NavBench: Probing Multimodal Large Language Models for Embodied Navigation

Yanyuan Qiao, Haodong Hong, Wenqi Lyu, Dong An, Siqi Zhang, Yutong Xie, Xinyu Wang, Qi Wu

机构 * The University of Adelaide(阿德莱德大学) The University of Queensland(昆士兰大学) CSIRO Data61(澳大利亚联邦科学与工业研究组织数据61研究中心) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Tongji University(同济大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10046 2025-05-16 cs.CV 88%

Exploring the Deep Fusion of Large Language Models and Diffusion Transformers for Text-to-Image Synthesis

Bingda Tang, Boyang Zheng, Xichen Pan, Sayak Paul, Saining Xie

机构 * New York University(纽约大学) Hugging Face

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03577 2025-05-09 cs.CV 88%

Look Twice Before You Answer: Memory-Space Visual Retracing for Hallucination Mitigation in Multimodal Large Language Models

Xin Zou, Yizhou Wang, Yibo Yan, Yuanhuiyi Lyu, Kening Zheng, Sirui Huang, Junkai Chen, Peijie Jiang, Jia Liu, Chang Tang, Xuming Hu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03513 2025-05-07 cs.CY 88%

Ruled by the Representation Space: On the University's Embrace of Large Language Models

Katia Schwerzmann

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03307 2025-04-10 cs.IR 88%

Intent Representation Learning with Large Language Model for Recommendation

Yu Wang, Lei Sang, Yi Zhang, Yiwen Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

Comments Accepted by SIGIR 2025 Full Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18302 2025-02-26 cs.CV 88%

LDGen: Enhancing Text-to-Image Synthesis via Large Language Model-Driven Language Representation

Pengzhi Li, Pengfei Yu, Zide Liu, Wei He, Xuhao Pan, Xudong Rao, Tao Wei, Wei Chen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏