arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-30 至 2025-09-30 共收录 512 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 30 篇

2509.24171 2025-09-30 cs.LG 70%

Model Correlation Detection via Random Selection Probing

Ruibo Chen, Sheng Zhang, Yihan Wu, Tong Zheng, Peihua Mai, Heng Huang

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23684 2025-09-30 cs.LG 70%

Hedonic Neurons: A Mechanistic Mapping of Latent Coalitions in Transformer MLPs

Tanya Chowdhury, Atharva Nijasure, Yair Zick, James Allan

机构 * Center for Intelligent Information Retrieval(智能信息检索中心) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23434 2025-09-30 cs.HC cs.AI 70%

NeuroBridge: Using Generative AI to Bridge Cross-neurotype Communication Differences through Neurotypical Perspective-taking

Rukhshan Haroon, Kyle Wigdor, Katie Yang, Nicole Toumanios, Eileen T. Crehan, Fahad Dogar

机构 * Computer Science Tufts University(计算机科学 华盛顿大学) Human Development, Cognitive Science Tufts University(人类发展与认知科学 华盛顿大学) Eunice Kennedy Shriver Center UMass Chan Medical School(欧尼丝·凯瑟琳·施里弗中心 马萨诸塞大学医学学院) Tufts University(华盛顿大学) UMass Chan Medical School(马萨诸塞大学医学学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13111 2025-09-30 cs.LG cs.RO 70%

Uncertainty-Aware Trajectory Prediction via Rule-Regularized Heteroscedastic Deep Classification

Kumar Manas, Christian Schlauch, Adrian Paschke, Christian Wirth, Nadja Klein

机构 * Department of Mathematics and Computer Science, Freie Universität Berlin(自由大学柏林数学与计算机科学系) Continental Automotive Technologies GmbH, AI Lab Berlin(大陆汽车技术有限公司柏林AI实验室) Karlsruhe Institute of Technology, Scientific Computing Center, Methods for Big Data(卡尔斯鲁厄理工学院科学计算中心、大数据方法) Fraunhofer Institute for Open Communication Systems, Berlin, Germany(弗劳恩霍夫开放通信系统研究所,柏林德国)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 17 Pages, 9 figures. Accepted to Robotics: Science and Systems(RSS), 2025

Journal ref Robotics: Science and Systems (RSS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25177 2025-09-30 cs.CV 67%

Mitigating Hallucination in Multimodal LLMs with Layer Contrastive Decoding

Bingkui Tong, Jiaer Xia, Kaiyang Zhou

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) Hong Kong Baptist University(香港 Baptist大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03271 2025-09-30 cs.HC 67%

Beyond Quantification: Navigating Uncertainty in Professional AI Systems

Sylvie Delacroix, Diana Robinson, Umang Bhatt, Jacopo Domenicucci, Jessica Montgomery, Gael Varoquaux, Carl Henrik Ek, Vincent Fortuin, Yulan He, Tom Diethe, Neill Campbell, Mennatallah El-Assady, Soren Hauberg, Ivana Dusparic, Neil Lawrence

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Journal ref RSS Data Science (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17550 2025-09-30 cs.CV 67%

T2VUnlearning: A Concept Erasing Method for Text-to-Video Diffusion Models

Xiaoyu Ye, Songjie Cheng, Yongtao Wang, Yajiao Xiong, Yishen Li

机构 * Peking University(北京大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23457 2025-09-30 cs.CV 67%

No Concept Left Behind: Test-Time Optimization for Compositional Text-to-Image Generation

Mohammad Hossein Sameti, Amir M. Mansourian, Arash Marioriyad, Soheil Fadaee Oshyani, Mohammad Hossein Rohban, Mahdieh Soleymani Baghshah

机构 * Sharif University of Technology(沙里夫技术大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 8 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17858 2025-09-30 cs.IR 67%

LexSemBridge: Fine-Grained Dense Representation Enhancement through Token-Aware Embedding Augmentation

Shaoxiong Zhan, Hai Lin, Hongming Tan, Xiaodong Cai, Hai-Tao Zheng, Xin Su, Zifei Shan, Ruitong Liu, Hong-Gee Kim

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 8 pages, 4 figures. Accepted to ECAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14233 2025-09-30 cs.CL cs.AI cs.LG 67%

Mechanistic Fine-tuning for In-context Learning

Hakaze Cho, Peng Luo, Mariko Kato, Rin Kaenbyou, Naoya Inoue

机构 * Japan Advanced Institute of Science and Technology(日本科学技术先进研究院) Beijing Institute of Technology(北京理工大学) RIKEN(日本研究机构)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 28 pages, 31 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09129 2025-09-30 cs.LG cs.AI cs.CL 67%

NextLocLLM: Location Semantics Modeling and Coordinate-Based Next Location Prediction with LLMs

Shuai Liu, Ning Cao, Yile Chen, Yue Jiang, George Rosario Jagadeesh, Gao Cong

机构 * Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments STIntelligence in CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08885 2025-09-30 cs.CL cs.LG 62%

AdversariaL attacK sAfety aLIgnment(ALKALI): Safeguarding LLMs through GRACE: Geometric Representation-Aware Contrastive Enhancement- Introducing Adversarial Vulnerability Quality Index (AVQI)

Danush Khanna, Gurucharan Marthi Krishna Kumar, Basab Ghosh, Yaswanth Narsupalli, Vinija Jain, Vasu Sharma, Aman Chadha, Amitava Das

专题命中 知识编辑与模型理解 :preference optimization(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01651 2025-09-30 q-bio.QM cs.AI cs.LG q-bio.BM 62%

FusionDTI: Fine-grained Binding Discovery with Token-level Fusion for Drug-Target Interaction

Zhaohan Meng, Zaiqiao Meng, Ke Yuan, Iadh Ounis

机构 * School of Computing Science(计算科学学院) School of Cancer Sciences(癌症科学学院) Cancer Research UK Scotland Institute(英国癌症研究苏格兰研究所) University of Glasgow(格拉斯哥大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG

Comments Findings of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24431 2025-09-30 cs.LG 57%

Semantic Compression via Multimodal Representation Learning

Eleonora Grassucci, Giordano Cicchetti, Aurelio Uncini, Danilo Comminiello

机构 * Dept. of Information Engineering, Electronics, and Telecomm.(信息工程、电子与电信系)

专题命中 知识编辑与模型理解 :post-training(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00310 2025-09-30 cs.RO cs.AI 57%

TReF-6: Inferring Task-Relevant Frames from a Single Demonstration for One-Shot Skill Generalization

Yuxuan Ding, Shuangge Wang, Tesca Fitzgerald

机构 * Yale University(耶鲁大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23717 2025-09-30 cs.AI 57%

Measuring Sparse Autoencoder Feature Sensitivity

Claire Tian, Katherine Tian, Nathan Hu

机构 * The Harker School(哈克尔学校) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

Comments NeurIPS 2025 Workshop on Mechanistic Interpretability Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12341 2025-09-30 cs.CV cs.AI 57%

Semantic Discrepancy-aware Detector for Image Forgery Identification

Ziye Wang, Minghang Yu, Chunyan Xu, Zhen Cui

机构 * Nanjing University of Science and Technology(南京理工大学) Beijing Normal University(北京师范大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15963 2025-09-30 cs.CV cs.CL 57%

OViP: Online Vision-Language Preference Learning for VLM Hallucination

Shujun Liu, Siyuan Wang, Zejun Li, Jianxiang Wang, Cheng Zeng, Zhongyu Wei

机构 * Fudan University(复旦大学) University of Southern California(南加州大学) ByteDance(字节跳动)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23849 2025-09-30 cs.CV 50%

CE-FAM: Concept-Based Explanation via Fusion of Activation Maps

Michihiro Kuroki, Toshihiko Yamasaki

机构 * The University of Tokyo(东京大学)

专题命中 知识编辑与模型理解 :language model(abstract)

Comments This paper has been accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23838 2025-09-30 cs.CV 50%

2nd Place Report of MOSEv2 Challenge 2025: Concept Guided Video Object Segmentation via SeC

Zhixiong Zhang, Shuangrui Ding, Xiaoyi Dong, Yuhang Zang, Yuhang Cao, Jiaqi Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 知识编辑与模型理解 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 42 篇

2412.18750 2025-09-30 cs.SE cs.AI cs.LG 90%

Order Matters! An Empirical Study on Large Language Models' Input Order Bias in Software Fault Localization

Md Nakhla Rafi, Dong Jae Kim, Tse-Hsun Chen, Shaowei Wang

机构 * Software Performance, Analysis, \ Reliability (SPEAR) Lab\ University Montreal Canada DePaul University Chicago USA University of Manitoba Winnipeg Canada Software Performance, Analysis, \ Reliability (SPEAR) Lab\ University DePaul University University of Manitoba

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25043 2025-09-30 cs.SE cs.AI 89%

Large Language Models for Software Testing: A Research Roadmap

Cristian Augusto, Antonia Bertolino, Guglielmo De Angelis, Francesca Lonetti, Jesús Morán

机构 * University of Oviedo(奥维多大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 40 pages & 10 figures Submitted on 29th September 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23972 2025-09-30 cs.AR 88%

AssertFix: Empowering Automated Assertion Fix via Large Language Models

Hongqin Lyu, Yunlin Du, Yonghao Wang, Zhiteng Chao, Tiancheng Wang, Huawei Li

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

Comments 6 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23284 2025-09-30 cs.CV 88%

Bidirectional Likelihood Estimation with Multi-Modal Large Language Models for Text-Video Retrieval

Dohwan Ko, Ji Soo Lee, Minhyuk Choi, Zihang Meng, Hyunwoo J. Kim

机构 * Korea University(韩国大学) Meta GenAI(Meta 生成人工智能) KAIST(韩国科学技术院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

Comments ICCV 2025 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05625 2025-09-30 cs.SE 88%

Harnessing Large Language Model for Virtual Reality Exploration Testing: A Case Study

Zhenyu Qi, Haotang Li, Hao Qin, Kebin Peng, Sen He, Xue Qin

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

Journal ref Automated Software Engineering, 33, 7 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16994 2025-09-30 cs.AI cs.CL cs.LG 87%

A Voter-Based Stochastic Rejection-Method Framework for Asymptotically Safe Language Model Outputs

Jake R. Watts, Joel Sokol

机构 * Department of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, Georgia, USA(工业与系统工程系,佐治亚理工学院,亚特兰大,佐治亚州,美国)

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23558 2025-09-30 cs.AI cs.CR 85%

Formalization Driven LLM Prompt Jailbreaking via Reinforcement Learning

Zhaoqi Wang, Daqing He, Zijian Zhang, Xin Li, Liehuang Zhu, Meng Li, Jiamou Liu

机构 * Beijing Institute of Technology(北京理工大学) Hefei University of Technology(合肥工业大学) The University of Auckland(奥克兰大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24043 2025-09-30 cs.CR 85%

An Ensemble Framework for Unbiased Language Model Watermarking

Yihan Wu, Ruibo Chen, Georgios Milis, Heng Huang

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22978 2025-09-30 cs.SE 85%

Towards Human-interpretable Explanation in Code Clone Detection using LLM-based Post Hoc Explainer

Teeradaj Racharak, Chaiyong Ragkhitwetsagul, Chayanee Junplong, Akara Supratak

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23718 2025-09-30 cs.SE cs.CR 85%

PROMFUZZ: Leveraging LLM-Driven and Bug-Oriented Composite Analysis for Detecting Functional Bugs in Smart Contracts

Xingshuang Lin, Qinge Xie, Binbin Zhao, Yuan Tian, Saman Zonouz, Na Ruan, Jiliang Li, Raheem Beyah, Shouling Ji

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏