arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-29 至 2025-09-29 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 12 篇

2509.22121 2025-09-29 cs.LG 89%

Mind the Missing: Variable-Aware Representation Learning for Irregular EHR Time Series using Large Language Models

Jeong Eul Kwon, Joo Heung Yoon, Hyo Kyung Lee

机构 * School of Industrial Management Engineering, Korea University(韩国大学工业管理工程学院) Division of Pulmonary, Allergy, Critical Care, and Sleep Medicine, Department of Medicine, University of Pittsburgh(匹兹堡大学医学部呼吸科、过敏科、重症医学科及睡眠医学科)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21534 2025-09-29 cs.LG 88%

A circuit for predicting hierarchical structure in-context in Large Language Models

Tankred Saanum, Can Demircan, Samuel J. Gershman, Eric Schulz

机构 * Harvard University(哈佛大学) Institute for Human-Centered AI(以人为中心的人工智能研究所) Helmholtz Computational Health Center(海德堡计算健康中心)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16975 2025-09-29 cs.LG cs.AI cs.CL 85%

Latent Concept Disentanglement in Transformer-based Language Models

Guan Zhe Hong, Bhavya Vasudeva, Vatsal Sharan, Cyrus Rashtchian, Prabhakar Raghavan, Rina Panigrahy

机构 * Purdue University(普渡大学) University of Southern California(南加州大学) Google(谷歌)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12881 2025-09-29 cs.CL 79%

TEXT2AFFORD: Probing Object Affordance Prediction abilities of Language Models solely from Text

Sayantan Adak, Daivik Agrawal, Animesh Mukherjee, Somak Aditya

机构 * IIT, Kharagpur(印度Kharagpur理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

Comments Accepted at Conference on Computational Natural Language Learning 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22251 2025-09-29 cs.CL cs.AI 79%

Beyond Textual Context: Structural Graph Encoding with Adaptive Space Alignment to alleviate the hallucination of LLMs

Yifang Zhang, Pengfei Duan, Yiwen Yang, Shengwu Xiong

机构 * Wuhan University of Technology(武汉理工大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21999 2025-09-29 cs.CL cs.AI 79%

Black-Box Hallucination Detection via Consistency Under the Uncertain Expression

Seongho Joo, Kyungmin Min, Jahyun Koo, Kyomin Jung

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21357 2025-09-29 cs.CL cs.AI 73%

A Novel Differential Feature Learning for Effective Hallucination Detection and Classification

Wenkai Wang, Vincent Lee, Yizhen Zheng

机构 * Department of Data Science and AI(数据科学与人工智能系) Monash University(墨尔本大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages, 7 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17445 2025-09-29 cs.CL 70%

Semantic Reformulation Entropy for Robust Hallucination Detection in QA Tasks

Chaodong Tong, Qi Zhang, Lei Jiang, Yanbing Liu, Nannan Sun, Wei Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 5pages, 5 figures, submitted to ICASSP 2026,

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11029 2025-09-29 cs.LG 70%

Exploiting the Asymmetric Uncertainty Structure of Pre-trained VLMs on the Unit Hypersphere

Li Ju, Max Andersson, Stina Fredriksson, Edward Glöckner, Andreas Hellander, Ekta Vats, Prashant Singh

机构 * Department of Information Technology, Uppsala University(信息科技系,乌普萨拉大学) Science for Life Laboratory, Uppsala University(生命科学实验室,乌普萨拉大学)

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21997 2025-09-29 cs.CV 67%

Exposing Hallucinations To Suppress Them: VLMs Representation Editing With Generative Anchors

Youxu Shi, Suorong Yang, Dong Liu

机构 * University of Science and Technology of China(中国科学技术大学) Nanjing University(南京大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01986 2025-09-29 cs.CL cs.AI cs.LG 67%

Adaptively profiling models with task elicitation

Davis Brown, Prithvi Balehannina, Helen Jin, Shreya Havaldar, Hamed Hassani, Eric Wong

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21695 2025-09-29 cs.LG 57%

Wav2Arrest 2.0: Long-Horizon Cardiac Arrest Prediction with Time-to-Event Modeling, Identity-Invariance, and Pseudo-Lab Alignment

Saurabh Kataria, Davood Fattahi, Minxiao Wang, Ran Xiao, Matthew Clark, Timothy Ruchti, Mark Mai, Xiao Hu

机构 * Nell Hodgson Woodruff School of Nursing, Emory University(埃默里大学护理学院) Department of Pediatrics, Emory School of Medicine(埃默里医学院儿科部)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

Comments Submitted to BPSC

详情

展开后加载摘要…

URL PDF HTML 收藏