arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-07 至 2025-10-07 共收录 382 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 27 篇

2510.04439 2025-10-07 cs.CL 77%

On the Role of Unobserved Sequences on Sample-based Uncertainty Quantification for LLMs

Lucie Kunitomo-Jacquin, Edison Marrese-Taylor, Ken Fukuda

机构 * National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to UncertaiNLP workshop of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03659 2025-10-07 cs.LG cs.AI cs.CL stat.ML 75%

Does higher interpretability imply better utility? A Pairwise Analysis on Sparse Autoencoders

Xu Wang, Yan Hu, Benyou Wang, Difan Zou

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学) School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳))

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20836 2025-10-07 cs.LG cs.AI 73%

First Hallucination Tokens Are Different from Conditional Ones

Jakob Snel, Seong Joon Oh

机构 * University of Tübingen, Germany(图宾根大学) Tübingen AI Center(图宾根人工智能中心)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 4.5 pages, 3 figures, Dataset, Knowledge Paper, Hallucination, Trustworthiness

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04285 2025-10-07 cs.CL cond-mat.stat-mech cs.LG stat.ML 73%

Probing Geometry of Next Token Prediction Using Cumulant Expansion of the Softmax Entropy

Karthik Viswanathan, Sang Eon Park

机构 * Institute of Physics, University of Amsterdam(阿姆斯特丹大学物理研究所) Massachusetts Institute of Technology(麻省理工学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 14 pages, 7 figures. Poster at HiLD 2025: 3rd Workshop on High-dimensional Learning Dynamics

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03351 2025-10-07 cs.LG cs.AI eess.IV 73%

Interpretable Neuropsychiatric Diagnosis via Concept-Guided Graph Neural Networks

Song Wang, Zhenyu Lei, Zhen Tan, Jundong Li, Javier Rasero, Aiying Zhang, Chirag Agarwal

机构 * University of Central Florida(中央佛罗里达大学) University of Virginia(弗吉尼亚大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03295 2025-10-07 cs.CV cs.CL cs.LG 73%

Multimodal Arabic Captioning with Interpretable Visual Concept Integration

Passant Elchafei, Amany Fashwan

专题命中 知识编辑与模型理解 :LLM(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03645 2025-10-07 cs.AI 70%

Graph Generation Powered with LLMs for Boosting Multivariate Time-Series Representation Learning

Yucheng Wang, Min Wu, Ruibing Jin, Xiaoli Li, Lihua Xie, Zhenghua Chen

机构 * Institute for Infocomm Research, A ∗ STAR, Singapore(信息通信研究所,A*STAR,新加坡) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(电气电子工程学院,南洋理工大学,新加坡) College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10612 2025-10-07 cs.CL 70%

Rowen: Adaptive Retrieval-Augmented Generation for Hallucination Mitigation in LLMs

Hanxing Ding, Liang Pang, Zihao Wei, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at SIGIR-AP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16876 2025-10-07 cs.SE 67%

Revolutionizing Validation and Verification: Explainable Testing Methodologies for Intelligent Automotive Decision-Making Systems

Halit Eris, Stefan Wagner

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Preprint to be published at SE4ADS

Journal ref 2025 IEEE/ACM 1st International Workshop on Software Engineering for Autonomous Driving Systems (SE4ADS), Ottawa, ON, Canada, 2025, pp. 34-37

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09747 2025-10-07 cs.NE 67%

BrainFLORA: Uncovering Brain Concept Representation via Multimodal Neural Embeddings

Dongyang Li, Haoyang Qin, Mingyang Wu, Chen Wei, Quanying Liu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16357 2025-10-07 cs.CV 67%

Law of Vision Representation in MLLMs

Shijia Yang, Bohan Zhai, Quanzeng You, Jianbo Yuan, Hongxia Yang, Chenfeng Xu

机构 * Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校) The Hong Kong Polytechnic University(香港理工大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments The code is available at https://github.com/bronyayang/Law_of_Vision_Representation_in_MLLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03315 2025-10-07 cs.CL cs.AI cs.LG 67%

Decomposing Attention To Find Context-Sensitive Neurons

Alex Gibson

机构 * University of Cambridge(剑桥大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 7 figures. Submitted to the Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03442 2025-10-07 cs.LG cs.AI cs.MA 62%

The Argument is the Explanation: Structured Argumentation for Trust in Agents

Ege Cakar, Per Ola Kristensson

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 4 figures, 6 tables, submitted to IAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07399 2025-10-07 cs.CV 50%

Exploring Representation Invariance in Finetuning

Wenqiang Zu, Shenghao Xie, Hao Chen, Zhiqiang Chen, Liwen Hu, Yuanhao Xi, Yiming Liang, Junliang Ye, Bo Lei, Tiejun Huang, Guoqi Li, Lei Ma

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) University of Göttingen(哥廷根大学) Tsinghua University(清华大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 知识编辑与模型理解 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 38 篇

2510.05090 2025-10-07 cs.CL cs.AI 88%

Finish First, Perfect Later: Test-Time Token-Level Cross-Validation for Diffusion Large Language Models

Runchu Tian, Junxia Cui, Xueqiang Xu, Feng Yao, Jingbo Shang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California San Diego(加州大学圣地亚哥分校)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 17 pages, 8 figures. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23835 2025-10-07 cs.SE cs.AI 88%

HFuzzer: Testing Large Language Models for Package Hallucinations via Phrase-based Fuzzing

Yukai Zhao, Menghan Wu, Xing Hu, Xin Xia

机构 * School of Software Technology, Zhejiang University, Ningbo, China(软件技术学院,浙江大学,宁波,中国) The State Key Laboratory of Blockchain and Data Security, Zhejiang University, Hangzhou, China(区块链与数据安全国家重点实验室,浙江大学,杭州,中国)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted by ASE25

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03842 2025-10-07 cs.RO cs.AI 88%

INGRID: Intelligent Generative Robotic Design Using Large Language Models

Guanglu Jia, Ceng Zhang, Gregory S. Chirikjian

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments We are revising it

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00882 2025-10-07 cs.SE 88%

SAFE: Advancing Large Language Models in Leveraging Semantic and Syntactic Relationships for Software Vulnerability Detection

Van Nguyen, Surya Nepal, Tingmin Wu, Xingliang Yuan, Carsten Rudolph

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

Journal ref Proceedings of the 20th ACM Asia Conference on Computer and Communications Security (ASIA CCS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03334 2025-10-07 cs.LG cs.DC 86%

Semantic-Aware Scheduling for GPU Clusters with Large Language Models

Zerui Wang, Qinghao Hu, Ana Klimovic, Tianwei Zhang, Yonggang Wen, Peng Sun, Dahua Lin

机构 * Shanghai Jiao Tong University \& Shanghai AI Laboratory Shanghai China Nanyang Technological University Singapore Singapore ETH Zurich Zurich Switzerland Shanghai AI Laboratory Shanghai China The Chinese University of Hong Kong Hong Kong China Shanghai Jiao Tong University \& Shanghai AI Laboratory Nanyang Technological University ETH Zurich Shanghai AI Laboratory The Chinese University of Hong Kong

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05025 2025-10-07 cs.CL cs.AI cs.CR 85%

Imperceptible Jailbreaking against Large Language Models

Kuofeng Gao, Yiming Li, Chao Du, Xin Wang, Xingjun Ma, Shu-Tao Xia, Tianyu Pang

机构 * Tsinghua University(清华大学) Sea AI Lab, Singapore(新加坡Sea AI实验室) Nanyang Technological University(南洋理工大学) Fudan University(复旦大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04796 2025-10-07 cs.SE 85%

RevMine: An LLM-Assisted Tool for Code Review Mining and Analysis Across Git Platforms

Samah Kansab, Francis Bordeleau, Ali Tizghadam

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04637 2025-10-07 cs.GR cs.CV 85%

Social Agent: Mastering Dyadic Nonverbal Behavior Generation via Conversational LLM Agents

Zeyi Zhang, Yanju Zhou, Heyuan Yao, Tenglong Ao, Xiaohang Zhan, Libin Liu

机构 * School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) Yuanpei College, Peking University(北京大学元培学院) School of Computer Science, Peking University(北京大学计算机学院) Tencent(腾讯) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments SIGGRAPH ASIA 2025 (Conference Track); Project page: https://pku-mocca.github.io/Social-Agent-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04078 2025-10-07 cs.SE 85%

Bamboo: LLM-Driven Discovery of API-Permission Mappings in the Android Framework

Han Hu, Wei Minn, Yonghui Liu, Jiakun Liu, Ferdian Thung, Terry Yue Zhuo, Lwin Khin Shar, Debin Gao, David Lo

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04498 2025-10-07 cs.CL cs.AI 84%

GenQuest: An LLM-based Text Adventure Game for Language Learners

Qiao Wang, Adnan Labib, Robert Swier, Michael Hofmeyr, Zheng Yuan

机构 * Hosei University(立命馆大学) King’s College London(伦敦大学国王学院) Kindai University(_kindai大学) Tokyo Uni. of Science(东京科学大学) University of Sheffield(谢菲尔德大学)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Workshop on Wordplay: When Language Meets Games, EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12903 2025-10-07 cs.CL cs.AI 84%

A Stitch in Time Saves Nine: Proactive Self-Refinement for Language Models

Jinyi Han, Xinyi Wang, Haiquan Zhao, Tingyun li, Zishang Jiang, Sihang Jiang, Jiaqing Liang, Xin Lin, Weikang Zhou, Zeye Sun, Fei Yu, Yanghua Xiao

机构 * Shanghai Institute of Artificial Intelligence for Education(上海人工智能教育研究院) East China Normal University(华东师范大学) School of Data Science, Fudan University(复旦大学数据科学学院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Antgroup(蚂蚁集团)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25286 2025-10-07 cs.CY cs.AI 83%

Artificial Authority: From Machine Minds to Political Alignments. An Experimental Analysis of Democratic and Autocratic Biases in Large-Language Models

Natalia Ożegalska-Łukasik, Szymon Łukasik

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23158 2025-10-07 cs.CL 83%

User Feedback in Human-LLM Dialogues: A Lens to Understand Users But Noisy as a Learning Signal

Yuhan Liu, Michael J. Q. Zhang, Eunsol Choi

机构 * New York University(纽约大学)

专题命中 其他LLM :LLM(title,abstract);language model(abstract);分类 cs.CL

Comments EMNLP camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00714 2025-10-07 cs.SE cs.AI 83%

RFCAudit: An LLM Agent for Functional Bug Detection in Network Protocols

Mingwei Zheng, Chengpeng Wang, Xuwei Liu, Jinyao Guo, Shiwei Feng, Xiangyu Zhang

机构 * Department of Computer Science, Purdue University(计算机科学系,普渡大学)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03748 2025-10-07 cs.CL cs.AI 82%

TreePrompt: Leveraging Hierarchical Few-Shot Example Selection for Improved English-Persian and English-German Translation

Ramtin Kakavand, Ebrahim Ansari

机构 * Department of Computer Science(计算机科学系) Institute for Advanced Studies in Basic Sciences(基础科学高级研究所)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04986 2025-10-07 cs.HC 82%

Observing Without Doing: Pseudo-Apprenticeship Patterns in Student LLM Use

Jade Hak, Nathaniel Lam Johnson, Matin Amoozadeh, Amin Alipour, Souti Chattopadhyay

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏