arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-24 至 2025-10-24 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 11 篇

2510.14349 2025-10-24 cs.CV 89%

Vision-Centric Activation and Coordination for Multimodal Large Language Models

Yunnan Wang, Fan Lu, Kecheng Zheng, Ziyuan Huang, Ziqiang Li, Wenjun Zeng, Xin Jin

机构 * MoE Key Lab of Artificial Intelligence, Shanghai Jiao Tong University(人工智能MoE实验室,上海交通大学) Ant Group(蚂蚁集团) Ningbo Institute of Digital Twin, Eastern Institute of Technology, Ningbo(宁波数字孪生研究所,东部技术研究所,宁波)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20375 2025-10-24 cs.CL cs.AI 88%

The Impact of Negated Text on Hallucination with Large Language Models

Jaehyung Seo, Hyeonseok Moon, Heuiseok Lim

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to the EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20252 2025-10-24 cs.AI 88%

Individualized Cognitive Simulation in Large Language Models: Evaluating Different Cognitive Representation Methods

Tianyi Zhang, Xiaolin Zhou, Yunzhe Wang, Erik Cambria, David Traum, Rui Mao

机构 * Department of Computer Science, University of Southern California(计算机科学系,南加州大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) USC Institute for Creative Technologies(南加州大学创意技术研究所)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20296 2025-10-24 cs.DB cs.AI 77%

RAG-Stack: Co-Optimizing RAG Quality and Performance From the Vector Database Perspective

Wenqi Jiang

机构 * Systems Group, ETH Zurich(苏黎世联邦理工学院系统组)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14144 2025-10-24 cs.CL cs.AI cs.LG 75%

Towards Understanding Safety Alignment: A Mechanistic Perspective from Safety Neurons

Jianhui Chen, Xiaozhi Wang, Zijun Yao, Yushi Bai, Lei Hou, Juanzi Li

机构 * Department of Computer Science and Technology, BNRist(计算机科学与技术系,BNRist) Shenzhen International Graduate School(深圳国际研究生院) KIRC, Institute for Artificial Intelligence, Tsinghua University(人工智能研究院,清华大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20479 2025-10-24 cs.CL cs.AI 73%

RECALL: REpresentation-aligned Catastrophic-forgetting ALLeviation via Hierarchical Model Merging

Bowen Wang, Haiyuan Wan, Liwen Shi, Chen Yang, Peng He, Yue Ma, Haochen Han, Wenhao Li, Tiao Tan, Yongjian Li, Fangming Liu, Yifan Gong, Sheng Zhang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室) Huazhong University of Science and Technology(华中科技大学) Xiamen University(厦门大学) The Hong Kong University of Science and Technology, Guangzhou(香港科技大学(广州)) School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20807 2025-10-24 cs.CV cs.LG 70%

Video Prediction of Dynamic Physical Simulations With Pixel-Space Spatiotemporal Transformers

Dean L Slack, G Thomas Hudson, Thomas Winterbottom, Noura Al Moubayed

机构 * Durham University(杜伦大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 14 pages, 14 figures

Journal ref IEEE Transactions on Neural Networks and Learning Systems, 36, 19106-19118, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20531 2025-10-24 cs.CV cs.AI 70%

Fake-in-Facext: Towards Fine-Grained Explainable DeepFake Analysis

Lixiong Qin, Yang Zhang, Mei Wang, Jiani Hu, Weihong Deng, Weiran Xu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Normal University(北京师范大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 25 pages, 9 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13688 2025-10-24 cs.LG stat.ML 70%

What Happens During the Loss Plateau? Understanding Abrupt Learning in Transformers

Pulkit Gopalani, Wei Hu

机构 * University of Michigan(密歇根大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20229 2025-10-24 cs.CV cs.AI cs.CL 62%

Why LVLMs Are More Prone to Hallucinations in Longer Responses: The Role of Context

Ge Zheng, Jiaye Qian, Jiajin Tang, Sibei Yang

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) ShanghaiTech University(上海理工大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI

Journal ref Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), 2025, pp. 4101-4113

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19861 2025-10-24 cs.LG 57%

Some Attention is All You Need for Retrieval

Felix Michalak, Steven Abreu

机构 * University of Groningen(格罗宁根大学)

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.LG

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏