arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7608 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7608 篇

2510.15804 2025-10-20 cs.CL 83%

Emergence of Linear Truth Encodings in Language Models

Shauli Ravfogel, Gilad Yehudai, Tal Linzen, Joan Bruna, Alberto Bietti

机构 * New York University(纽约大学) Flatiron Institute(Flatiron研究所)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted in Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14825 2025-10-17 cs.LG 83%

Programmatic Representation Learning with Language Models

Gabriel Poesia, Georgia Gabriela Sampaio

机构 * Kempner Institute at Harvard University(哈佛大学凯普纳研究所) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.LG

Comments Code available at https://github.com/gpoesia/leapr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12587 2025-10-15 cs.CL 83%

Teaching Language Models to Faithfully Express their Uncertainty

Bryan Eikema, Evgenia Ilia, José G. C. de Souza, Chrysoula Zerva, Wilker Aziz

机构 * University of Amsterdam(阿姆斯特丹大学) Outsystems(Outsystems公司) Instituto de Telecomunicações(电信研究所) Instituto Superior Técnico, Universidade de Lisboa(里斯本大学电信研究所)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10331 2025-10-14 cs.AI 83%

LLM-Friendly Knowledge Representation for Customer Support

Hanchen Su, Wei Luo, Wei Han, Yu Elaine Liu, Yufeng Wayne Zhang, Cen Mia Zhao, Ying Joy Zhang, Yashar Mehdad

机构 * Airbnb Inc.(Airbnb公司)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12032 2025-10-10 cs.CV cs.AI 83%

FSFM: A Generalizable Face Security Foundation Model via Self-Supervised Facial Representation Learning

Gaojian Wang, Feng Lin, Tong Wu, Zhenguang Liu, Zhongjie Ba, Kui Ren

机构 * State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江区)区块链与数据安全研究院)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI

Comments 21 pages, 11 figures, project page: https://fsfm-3c.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10246 2025-10-07 cs.LG 83%

Detecting LLM Hallucination Through Layer-wise Information Deficiency: Analysis of Ambiguous Prompts and Unanswerable Questions

Hazel Kim, Tom A. Lamb, Adel Bibi, Philip Torr, Yarin Gal

机构 * University of Oxford(牛津大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted to EMNLP(main)2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12113 2025-10-06 cs.CR cs.AI 83%

Semantic Preprocessing for LLM-based Malware Analysis

Benjamin Marais, Tony Quertier, Grégoire Barrue

机构 * Orange Innovation(Orange创新)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25525 2025-10-01 cs.CR cs.LG 83%

Defeating Cerberus: Concept-Guided Privacy-Leakage Mitigation in Multimodal Language Models

Boyang Zhang, Istemi Ekin Akkus, Ruichuan Chen, Alice Dethise, Klaus Satzke, Ivica Rimac, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA赫尔姆霍茨信息安全中心) Nokia Bell Labs(诺基亚贝尔实验室)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05652 2025-09-23 cs.CR cs.CL 83%

Sugar-Coated Poison: Benign Generation Unlocks LLM Jailbreaking

Yu-Hang Wu, Yu-Jie Xiong, Hao Zhang, Jia-Chen Zhang, Zheng Zhou

机构 * Shanghai University of Engineering Science(上海工程技术大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13154 2025-09-17 cs.CL 83%

LLM Hallucination Detection: A Fast Fourier Transform Method Based on Hidden Layer Temporal Signals

Jinxin Li, Gang Tu, ShengYu Cheng, Junjie Hu, Jinting Wang, Rui Chen, Zhilong Zhou, Dongbo Shan

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12519 2025-09-17 cs.CE cs.CL q-fin.CP 83%

Context-Aware Language Models for Forecasting Market Impact from Sequences of Financial News

Ross Koval, Nicholas Andrews, Xifeng Yan

机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校) Johns Hopkins University(约翰霍普金斯大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12065 2025-09-16 cs.CL 83%

Steering Language Models in Multi-Token Generation: A Case Study on Tense and Aspect

Alina Klerings, Jannik Brinkmann, Daniel Ruffinelli, Simone Ponzetto

机构 * University of Mannheim(曼海姆大学) Technical University Clausthal(克劳斯泰尔大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments to be published in The 2025 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04664 2025-09-08 cs.CL 83%

Why Language Models Hallucinate

Adam Tauman Kalai, Ofir Nachum, Santosh S. Vempala, Edwin Zhang

机构 * OpenAI Georgia Tech(佐治亚理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00723 2025-09-03 cs.AI cs.MM 83%

OmniDPO: A Preference Optimization Framework to Address Omni-Modal Hallucination

Junzhe Chen, Tianshu Zhang, Shiyu Huang, Yuwei Niu, Chao Sun, Rongzhou Zhang, Guanyu Zhou, Lijie Wen, Xuming Hu

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) OpenRL Chongqing University(重庆大学)

专题命中 知识编辑与模型理解 :preference optimization(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14918 2025-08-22 cs.CY cs.AI 83%

Disentangling the Drivers of LLM Social Conformity: An Uncertainty-Moderated Dual-Process Mechanism

Huixin Zhong, Yanan Liu, Qi Cao, Shijin Wang, Zijing Ye, Zimu Wang, Shiyao Zhang

机构 * Xi’an Jiaotong Liverpool University(西安交通大学利物浦大学) School of Microelectronics, Shanghai University(上海大学微电子学院)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14654 2025-08-21 cs.AI 83%

Entropy-Constrained Strategy Optimization in Urban Floods: A Multi-Agent Framework with LLM and Knowledge Graph Integration

Peilin Ji, Xiao Xue, Simeng Wang, Wenhao Yan

机构 * College of Intelligence and Computing(智能与计算学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);prompting(abstract);分类 cs.AI

Comments 17 pages including appendix, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16550 2025-08-19 cs.LG stat.ML 83%

A Free Probabilistic Framework for Analyzing the Transformer-based Language Models

Swagatam Das

机构 * Electronics and Communication Sciences Unit, Indian Statistical Institute, Kolkata, India.(印度统计研究所电子与通信科学单元,加尔各答,印度)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16572 2025-07-23 cs.CL 83%

Pixels to Principles: Probing Intuitive Physics Understanding in Multimodal Language Models

Mohamad Ballout, Serwan Jassim, Elia Bruni

机构 * Institute of Cognitive Science, University of Osnabrück(认知科学研究所,奥斯纳布吕克大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10281 2025-07-16 cs.CL 83%

One world, one opinion? The superstar effect in LLM responses

Sofie Goethals, Lauren Rhue

机构 * University of Antwerp(安特卫普大学) Robert H. Smith School of Business(罗伯特·H·史密斯商学院)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Journal ref https://aclanthology.org/2025.c3nlp-1.pdf#page=100

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10360 2025-07-01 cs.CL cs.IR 83%

Parenting: Optimizing Knowledge Selection of Retrieval-Augmented Language Models with Parameter Decoupling and Tailored Tuning

Yongxin Xu, Ruizhe Zhang, Xinke Jiang, Yujie Feng, Yuzhen Xiao, Xinyu Ma, Runchuan Zhu, Xu Chu, Junfeng Zhao, Yasha Wang

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted to ACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01584 2025-06-30 cs.AI 83%

SENSEI: Semantic Exploration Guided by Foundation Models to Learn Versatile World Models

Cansu Sancaktar, Christian Gumbsch, Andrii Zadaianchuk, Pavel Kolev, Georg Martius

机构 * Autonomous Learning, University of Tübingen(图宾根大学自主学习研究所) Empirical Inference, Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Neuro-Cognitive Modeling, University of Tübingen(图宾根大学神经认知建模研究所) VISLab, University of Amsterdam(阿姆斯特丹大学视觉实验室)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract);分类 cs.AI

Comments ICML 2025 camera-ready version. Project webpage at https://sites.google.com/view/sensei-paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17345 2025-06-24 cond-mat.mtrl-sci cs.LG 83%

CLOUD: A Scalable and Physics-Informed Foundation Model for Crystal Representation Learning

Changwen Xu, Shang Zhu, Venkatasubramanian Viswanathan

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract);分类 cs.LG

Comments 36 pages, 11 pages of Supporting Information

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03984 2025-06-05 cs.CL 83%

Around the World in 24 Hours: Probing LLM Knowledge of Time and Place

Carolin Holtermann, Paul Röttger, Anne Lauscher

机构 * University of Hamburg(汉堡大学) University of Bocconi(博科尼大学)

专题命中 知识编辑与模型理解 :LLM(title);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16733 2025-06-05 cs.LG 83%

Coreset Selection via LLM-based Concept Bottlenecks

Akshay Mehra, Trisha Mittal, Subhadra Gopalakrishnan, Joshua Kimball

机构 * Dolby Laboratory(多利贝实验室) Apple(苹果公司)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01334 2025-06-03 cs.CL 83%

Enhancing Interpretable Image Classification Through LLM Agents and Conditional Concept Bottleneck Models

Yiwen Jiang, Deval Mehta, Wei Feng, Zongyuan Ge

机构 * Faculty of Engineering, Monash University(墨尔本大学工程学院) AIM for Health Lab, Faculty of IT, Monash University(墨尔本大学信息科技学院健康人工智能实验室)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at ACL 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01074 2025-06-03 cs.CL cs.PL cs.SE 83%

How Programming Concepts and Neurons Are Shared in Code Language Models

Amir Hossein Kargaran, Yihong Liu, François Yvon, Hinrich Schütze

机构 * LMU Munich & Munich Center for Machine Learning(慕尼黑大学及慕尼黑机器学习中心) Sorbonne Université & CNRS, ISIR(索邦大学及国家科学研究中心,ISIR)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments ACL Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20809 2025-05-28 cs.CL 83%

Improved Representation Steering for Language Models

Zhengxuan Wu, Qinan Yu, Aryaman Arora, Christopher D. Manning, Christopher Potts

机构 * Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 46 pages, 23 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13123 2025-05-20 cs.CV cs.AI 83%

Low-hallucination Synthetic Captions for Large-Scale Vision-Language Model Pre-training

Xinsong Zhang, Yarong Zeng, Xinting Huang, Hu Hu, Runquan Xie, Han Hu, Zhanhui Kang

机构 * Tencent(腾讯)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06291 2025-05-13 eess.SP cs.CE cs.HC cs.LG 83%

ALFEE: Adaptive Large Foundation Model for EEG Representation

Wei Xiong, Junming Lin, Jiangtong Li, Jie Li, Changjun Jiang

机构 * Department of Computer Science and Technology, Tongji University(计算机科学与技术系,同济大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

Comments 17pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01958 2025-05-06 cs.CV cs.CL 83%

A Comprehensive Analysis for Visual Object Hallucination in Large Vision-Language Models

Liqiang Jing, Guiming Hardy Chen, Ehsan Aghazadeh, Xin Eric Wang, Xinya Du

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) University of Massachusetts at Amherst(马萨诸塞大学阿姆赫斯特分校) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏