arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2409.12518 2025-03-11 cs.RO cs.AI 70%

Hier-SLAM: Scaling-up Semantics in SLAM with a Hierarchically Categorical Gaussian Splatting

Boying Li, Zhixi Cai, Yuan-Fang Li, Ian Reid, Hamid Rezatofighi

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted for publication at ICRA 2025. Code is available at https://github.com/LeeBY68/Hier-SLAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14507 2025-03-07 cs.DB cs.AI 70%

Prompt-Matcher: Leveraging Large Models to Reduce Uncertainty in Schema Matching Results

Longyu Feng, Huahang Li, Chen Jason Zhang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03032 2025-03-06 cs.CL 70%

SAFE: A Sparse Autoencoder-Based Framework for Robust Query Enrichment and Hallucination Mitigation in LLMs

Samir Abdaljalil, Filippo Pallucchini, Andrea Seveso, Hasan Kurban, Fabio Mercorio, Erchin Serpedin

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00867 2025-03-04 cs.CL 70%

DUAL: Diversity and Uncertainty Active Learning for Text Summarization

Petros Stylianos Giouroukis, Alexios Gidiotis, Grigorios Tsoumakas

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16821 2025-03-04 cs.CL 70%

Perturbation-Restrained Sequential Model Editing

Jun-Yu Ma, Hong Wang, Hao-Xiang Xu, Zhen-Hua Ling, Jia-Chen Gu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11141 2025-03-04 cs.AI 70%

Can Structured Data Reduce Epistemic Uncertainty?

Shriram M S, Sushmitha S, Gayathri K S, Shahina A

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Presented at NeLaMKRR@KR, 2024 (arXiv:2410.05339)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20701 2025-03-03 cs.AI cs.CY cs.HC 70%

Why Trust in AI May Be Inevitable

Nghi Truong, Phanish Puranam, Ilia Testlin

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16451 2025-02-25 cs.CL 70%

Contrastive Learning of English Language and Crystal Graphs for Multimodal Representation of Materials Knowledge

Yang Jeong Park, Mayank Kumaran, Chia-Wei Hsu, Elsa Olivetti, Ju Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 24 pages, 14 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12714 2025-02-25 cs.LG physics.chem-ph 70%

An Equivariant Pretrained Transformer for Unified 3D Molecular Representation Learning

Rui Jiao, Xiangzhe Kong, Li Zhang, Ziyang Yu, Fangyuan Ren, Wenjuan Tan, Wenbing Huang, Yang Liu

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14100 2025-02-25 cs.CL cs.IR 70%

Towards Context-Robust LLMs: A Gated Representation Fine-tuning Approach

Shenglai Zeng, Pengfei He, Kai Guo, Tianqi Zheng, Hanqing Lu, Yue Xing, Hui Liu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09508 2025-02-25 cs.CL cs.CY 70%

CollabEdit: Towards Non-destructive Collaborative Knowledge Editing

Jiamu Zheng, Jinghuai Zhang, Tianyu Du, Xuhong Zhang, Jianwei Yin, Tao Lin

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 20 pages, 11 figures. Published as a conference paper at ICLR 2025. Code at https://github.com/LINs-lab/CollabEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19187 2025-02-20 cs.CL 70%

Beyond Logit Lens: Contextual Embeddings for Robust Hallucination Detection & Grounding in VLMs

Anirudh Phukan, Divyansh, Harshit Kumar Morj, Vaishnavi, Apoorv Saxena, Koustava Goswami

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to NAACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12732 2025-02-19 cs.LG 70%

Circuit Representation Learning with Masked Gate Modeling and Verilog-AIG Alignment

Haoyuan Wu, Haisheng Zheng, Yuan Pu, Bei Yu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10848 2025-02-18 cs.LG q-bio.QM 70%

Implicit Neural Representations of Molecular Vector-Valued Functions

Jirka Lhotka, Daniel Probst

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments This is a tiny paper track submission to the LRML workshop at ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09218 2025-02-14 cs.LO cs.AI 70%

Data2Concept2Text: An Explainable Multilingual Framework for Data Analysis Narration

Flavio Bertini, Alessandro Dal Palù, Federica Zaglio, Francesco Fabiano, Andrea Formisano

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments In Proceedings ICLP 2024, arXiv:2502.08453

Journal ref EPTCS 416, 2025, pp. 139-152

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07905 2025-02-13 cs.CV cs.LG 70%

DeepSeek on a Trip: Inducing Targeted Visual Hallucinations via Representation Vulnerabilities

Chashi Mahiul Islam, Samuel Jacob Chacko, Preston Horne, Xiuwen Liu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 19 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12259 2025-02-12 cs.CL 70%

On the Feasibility of In-Context Probing for Data Attribution

Cathy Jiao, Gary Gao, Aditi Raghunathan, Chenyan Xiong

专题命中 知识编辑与模型理解 :LLM(abstract);prompting(abstract);分类 cs.CL

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15999 2025-02-11 cs.CL 70%

Steering Knowledge Selection Behaviours in LLMs via SAE-Based Representation Engineering

Yu Zhao, Alessio Devoto, Giwon Hong, Xiaotang Du, Aryo Pradipta Gema, Hongru Wang, Xuanli He, Kam-Fai Wong, Pasquale Minervini

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10417 2025-01-27 cs.AI 70%

M^2ConceptBase: A Fine-Grained Aligned Concept-Centric Multimodal Knowledge Base

Zhiwei Zha, Jiaan Wang, Zhixu Li, Xiangru Zhu, Wei Song, Yanghua Xiao

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by CIKM2024. The code and data can be found at https://github.com/AwellmanZha/M2ConceptBase

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12857 2025-01-23 cs.LG 70%

HierPromptLM: A Pure PLM-based Framework for Representation Learning on Heterogeneous Text-rich Networks

Qiuyu Zhu, Liang Zhang, Qianxiong Xu, Cheng Long

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00253 2025-01-22 cs.CL cs.SE 70%

CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based Verification

Yuchen Tian, Weixiang Yan, Qian Yang, Xuandong Zhao, Qian Chen, Wen Wang, Ziyang Luo, Lei Ma, Dawn Song

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by AAAI 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01432 2025-01-17 cs.CV cs.LG 70%

VLG-CBM: Training Concept Bottleneck Models with Vision-Language Guidance

Divyansh Srivastava, Ge Yan, Tsui-Wei Weng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Appeared at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11514 2025-01-16 cs.CL 70%

Counterfactual Debating with Preset Stances for Hallucination Elimination of LLMs

Yi Fang, Moxin Li, Wenjie Wang, Hui Lin, Fuli Feng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments accepted by COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07048 2025-01-14 cs.AI 70%

Unveiling the Potential of Text in High-Dimensional Time Series Forecasting

Xin Zhou, Weiqing Wang, Shilin Qu, Zhiqiang Zhang, Christoph Bergmeir

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by NeurIPS24 TSALM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05487 2025-01-13 cs.CL 70%

The Future of AI: Exploring the Potential of Large Concept Models

Hussain Ahmad, Diksha Goel

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04591 2025-01-09 cs.CL cond-mat.dis-nn quant-ph 70%

Quantum-inspired Embeddings Projection and Similarity Metrics for Representation Learning

Ivan Kankeu, Stefan Gerd Fritsch, Gunnar Schönhoff, Elie Mounzer, Paul Lukowicz, Maximilian Kiefer-Emmanouilidis

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03304 2025-01-09 cs.RO cs.LG 70%

LiLMaps: Learnable Implicit Language Maps

Evgenii Kruzhkov, Sven Behnke

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08582 2024-12-30 cs.CL 70%

On the Universal Truthfulness Hyperplane Inside LLMs

Junteng Liu, Shiqi Chen, Yu Cheng, Junxian He

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2024: Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15446 2024-12-25 cs.CV cs.AI 70%

Concept Complement Bottleneck Model for Interpretable Medical Image Diagnosis

Hongmei Wang, Junlin Hou, Hao Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 27 pages, 5 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15588 2024-12-23 cs.CL 70%

NeSyCoCo: A Neuro-Symbolic Concept Composer for Compositional Generalization

Danial Kamali, Elham J. Barezi, Parisa Kordjamshidi

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments AAAI 2025 Project Page: https://iamdanialkamali.github.io/publication/neuro-symbolic-concept-composer

详情

展开后加载摘要…

URL PDF HTML 收藏