arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7565 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7565 篇

2506.07184 2025-06-10 cs.AI cs.CL cs.CV 88%

Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images

Liangliang You, Junchi Yao, Shu Yang, Guimin Hu, Lijie Hu, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能与数据分析实验室) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹大学) University of Electronic Science and Technology of China(中国电子科学技术大学) University of Copenhagen(哥本哈根大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05393 2025-06-09 cs.CL cs.LG 88%

Are Large Language Models Good Temporal Graph Learners?

Shenyang Huang, Ali Parviz, Emma Kondrup, Zachary Yang, Zifeng Ding, Michael Bronstein, Reihaneh Rabbany, Guillaume Rabusseau

机构 * Mila - Quebec AI Institute(魁北克AI研究所) School of Computer Science, McGill University(麦吉尔大学计算机科学学院) University of Cambridge(剑桥大学) DIRO, Université de Montréal(蒙特利尔大学DIRO研究所) CIFAR AI Chair(CIFAR人工智能主席) New Jersey Institute of Technology(新泽西理工学院) University of Oxford(牛津大学) AITHYRA

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 9 pages, 9 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00382 2025-06-06 cs.LG cs.CL 88%

Spectral Insights into Data-Oblivious Critical Layers in Large Language Models

Xuyuan Liu, Lei Hsiung, Yaoqing Yang, Yujun Yan

机构 * Dartmouth College(达特茅斯学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by Findings of ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19631 2025-05-27 cs.CL cs.AI 88%

Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models

Zihong Zhang, Liqi He, Zuchao Li, Lefei Zhang, Hai Zhao, Bo Du

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19440 2025-05-27 cs.CL cs.LG 88%

The Birth of Knowledge: Emergent Features across Time, Space, and Scale in Large Language Models

Shashata Sawmya, Micah Adler, Nir Shavit

机构 * Massachusetts Institute of Technology(麻省理工学院) Red Hat, Inc.(红帽公司)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19663 2025-05-27 cs.CL cs.AI 88%

Identifying Knowledge Editing Types in Large Language Models

Xiaopeng Li, Shasha Li, Shangwen Wang, Shezheng Song, Bin Ji, Huijun Liu, Jun Ma, Jie Yu

机构 * National University of Denfense Technology(国防科技大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18235 2025-05-27 cs.LG cs.AI 88%

The Origins of Representation Manifolds in Large Language Models

Alexander Modell, Patrick Rubin-Delanchy, Nick Whiteley

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17705 2025-05-26 cs.AI cs.LG 88%

CIKT: A Collaborative and Iterative Knowledge Tracing Framework with Large Language Models

Runze Li, Siyu Wu, Jun Wang, Wei Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12908 2025-05-26 cs.CL cs.AI 88%

HICD: Hallucination-Inducing via Attention Dispersion for Contrastive Decoding to Mitigate Hallucinations in Large Language Models

Xinyan Jiang, Hang Ye, Yongxin Zhu, Xiaoying Zheng, Zikang Chen, Jun Gong

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02737 2025-05-07 cs.LG cs.AI cs.DB 88%

Knowledge Graphs for Enhancing Large Language Models in Entity Disambiguation

Gerard Pons, Besim Bilalli, Anna Queralt

机构 * Universitat Politècnica de Catalunya, UPC-BarcelonaTech(政治与技术大学、巴塞罗那技术大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Pre-print submitted to ISWC 2024

Journal ref Proc. 23rd Int. Semantic Web Conf. (ISWC 2024), LNCS, Springer, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18572 2025-04-29 cs.AI cs.CL 88%

BELL: Benchmarking the Explainability of Large Language Models

Syed Quiser Ahmed, Bharathi Vokkaliga Ganesh, Jagadish Babu P, Karthick Selvaraj, ReddySiva Naga Parvathi Devi, Sravya Kappala

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10989 2025-04-15 cs.CL cs.AI cs.HC 88%

Can Large Language Models Detect Verbal Indicators of Romantic Attraction?

Sandra C. Matz, Heinrich Peters, Moran Cerf, Eric Grunenberg, Paul W. Eastwick, Mitja D. Back, Eli J. Finkel

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05325 2025-04-09 cs.CL cs.AI cs.CY cs.HC cs.IR 88%

Unequal Opportunities: Examining the Bias in Geographical Recommendations by Large Language Models

Shiran Dudy, Thulasi Tholeti, Resmi Ramachandranpillai, Muhammad Ali, Toby Jia-Jun Li, Ricardo Baeza-Yates

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01059 2025-02-26 cs.CL cs.LG 88%

Dynamic Attention-Guided Context Decoding for Mitigating Context Faithfulness Hallucinations in Large Language Models

Yanwen Huang, Yong Zhang, Ning Cheng, Zhitao Li, Shaojun Wang, Jing Xiao

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06426 2025-02-25 cs.CL cs.AI cs.MA 88%

DebUnc: Improving Large Language Model Agent Communication With Uncertainty Metrics

Luke Yoffe, Alfonso Amayuelas, William Yang Wang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07184 2025-02-12 cs.CL cs.AI 88%

Refine Knowledge of Large Language Models via Adaptive Contrastive Learning

Yinghui Li, Haojing Huang, Jiayi Kuang, Yangning Li, Shu-Yu Guo, Chao Qu, Xiaoyu Tan, Hai-Tao Zheng, Ying Shen, Philip S. Yu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03199 2025-02-06 cs.CL cs.AI 88%

Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models

Jialiang Wu, Yi Shen, Sijia Liu, Yi Tang, Sen Song, Xiaoyi Wang, Longjun Cai

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10044 2024-12-30 cs.LG cs.CL 88%

Benchmarking Large Language Model Uncertainty for Prompt Optimization

Pei-Fu Guo, Yun-Da Tsai, Shou-De Lin

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05939 2024-12-10 cs.CV cs.CL cs.LG 88%

Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models

Xiao Xu, Tianhao Niu, Yuxi Xie, Libo Qin, Wanxiang Che, Min-Yen Kan

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments A manuscript that should have been Arxived in May :)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12058 2024-12-05 cs.AI cs.CL 88%

WellDunn: On the Robustness and Explainability of Language Models and Large Language Models in Identifying Wellness Dimensions

Seyedali Mohammadi, Edward Raff, Jinendra Malekar, Vedant Palit, Francis Ferraro, Manas Gaur

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted in BlackboxNLP @ EMNLP 2024

Journal ref Proceedings of the 7th BlackboxNLP Workshop: Analyzing and Interpreting Neural Networks for NLP, pages 364-388, November 2024, Miami, Florida, US. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15215 2024-11-26 cs.LG cs.AI q-bio.BM 88%

S$^2$ALM: Sequence-Structure Pre-trained Large Language Model for Comprehensive Antibody Representation Learning

Mingze Yin, Hanjing Zhou, Jialu Wu, Yiheng Zhu, Yuxuan Zhan, Zitai Kong, Hongxia Xu, Chang-Yu Hsieh, Jintai Chen, Tingjun Hou, Jian Wu

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17304 2024-11-22 cs.CL cs.AI 88%

Probing Multimodal Large Language Models for Global and Local Semantic Representations

Mingxu Tao, Quzhe Huang, Kun Xu, Liwei Chen, Yansong Feng, Dongyan Zhao

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by LREC-COLING 2024 as a short paper. ACL Anthology URL: [https://aclanthology.org/2024.lrec-main.1142/]

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09637 2024-11-19 cs.LG cs.AI 88%

ReLU's Revival: On the Entropic Overload in Normalization-Free Large Language Models

Nandan Kumar Jha, Brandon Reagen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS 2024 Workshop on Attributing Model Behavior at Scale (Camera-ready version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13845 2024-11-04 cs.CL cs.AI 88%

Semantic Density: Uncertainty Quantification for Large Language Models through Confidence Measurement in Semantic Space

Xin Qiu, Risto Miikkulainen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to Neurips 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20009 2024-10-29 cs.CL cs.LG 88%

On Large Language Models' Hallucination with Regard to Known Facts

Che Jiang, Biqing Qi, Xiangyu Hong, Dayuan Fu, Yang Cheng, Fandong Meng, Mo Yu, Bowen Zhou, Jie Zhou

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by NAACL 2024 MainConference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14273 2024-10-21 cs.CL cs.AI cs.CR 88%

REEF: Representation Encoding Fingerprints for Large Language Models

Jie Zhang, Dongrui Liu, Chen Qian, Linfeng Zhang, Yong Liu, Yu Qiao, Jing Shao

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03772 2024-10-14 cs.CL cs.AI 88%

Precision Knowledge Editing: Enhancing Safety in Large Language Models

Xuying Li, Zhuo Li, Yuji Kosuga, Yasuhiro Yoshida, Victor Bian

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10132 2024-09-17 cs.CL cs.AI 88%

StruEdit: Structured Outputs Enable the Fast and Accurate Knowledge Editing for Large Language Models

Baolong Bi, Shenghua Liu, Yiwei Wang, Lingrui Mei, Hongcheng Gao, Junfeng Fang, Xueqi Cheng

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03021 2024-09-06 cs.CL cs.LG 88%

CLUE: Concept-Level Uncertainty Estimation for Large Language Models

Yu-Hsiang Wang, Andrew Bai, Che-Ping Tsai, Cho-Jui Hsieh

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14387 2024-08-27 cs.LG cs.AI 88%

Reprogramming Foundational Large Language Models(LLMs) for Enterprise Adoption for Spatio-Temporal Forecasting Applications: Unveiling a New Era in Copilot-Guided Cross-Modal Time Series Representation Learning

Sakhinana Sagar Srinivas, Chidaksh Ravuru, Geethan Sannidhi, Venkataramana Runkana

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);prompting(abstract);分类 cs.AI、cs.LG

Comments Paper published at the Deployable AI (DAI) workshop at AAAI-2024

详情

展开后加载摘要…

URL PDF HTML 收藏