arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-23 至 2025-09-23 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 14 篇

2509.18076 2025-09-23 cs.AI 89%

Improving Large Language Models Function Calling and Interpretability via Guided-Structured Templates

Hy Dang, Tianyi Liu, Zhuofeng Wu, Jingfeng Yang, Haoming Jiang, Tao Yang, Pei Chen, Zhengyang Wang, Helen Wang, Huasheng Li, Bing Yin, Meng Jiang

机构 * University of Notre Dame(诺丁汉大学) Amazon(亚马逊)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17665 2025-09-23 cs.LG cs.AI cs.CY 88%

Mechanistic Interpretability with SAEs: Probing Religion, Violence, and Geography in Large Language Models

Katharina Simbeck, Mariam Mahran

机构 * HTW Berlin University of Applied Sciences(柏林应用科学大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted at AEQUITAS 2025: Workshop on Fairness and Bias in AI | co-located with ECAI, October 26th, 2025, Bologna, Italy. 12 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16696 2025-09-23 cs.CL cs.LG 88%

Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models

Wataru Hashimoto, Hidetaka Kamigaito, Taro Watanabe

机构 * Nara Institute of Science and Technology(奈良科学技术大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted at EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17522 2025-09-23 cs.CV 88%

Chat-CBM: Towards Interactive Concept Bottleneck Models with Frozen Large Language Models

Hangzhou He, Lei Zhu, Kaiwen Li, Xinliang Zhang, Jiakui Hu, Ourui Fu, Zhengjian Yao, Yanye Lu

机构 * Department of Biomedical Engineering, College of Future Technology, Peking University(生物医学工程系,未来技术学院,北京大学) Institute of Medical Technology, Peking University Health Science Center, Peking University(医学技术研究所,北京大学医学部,北京大学) National Biomedical Imaging Center, College of Future Technology, Peking University(国家生物医学成像中心,未来技术学院,北京大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08760 2025-09-23 cs.NI cs.AI cs.LG cs.SE 86%

INTA: Intent-Based Translation for Network Configuration with LLM Agents

Yunze Wei, Xiaohui Xie, Tianshuo Hu, Yiwei Zuo, Xinyi Chen, Kaiwen Chi, Yong Cui

机构 * Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Australian National University(澳大利亚国立大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by The 33rd IEEE International Conference on Network Protocols (IEEE ICNP 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01609 2025-09-23 cs.CL 85%

Adaptive Distraction: Probing LLM Contextual Robustness with Automated Tree Search

Yanbo Wang, Zixiang Xu, Yue Huang, Chujie Gao, Siyuan Wu, Jiayi Ye, Pin-Yu Chen, Xiuying Chen, Xiangliang Zhang

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(莫扎伊德大学人工智能学院) University of Notre Dame(诺特丹大学) IBM Research(IBM研究院)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05652 2025-09-23 cs.CR cs.CL 83%

Sugar-Coated Poison: Benign Generation Unlocks LLM Jailbreaking

Yu-Hang Wu, Yu-Jie Xiong, Hao Zhang, Jia-Chen Zhang, Zheng Zhou

机构 * Shanghai University of Engineering Science(上海工程技术大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17481 2025-09-23 cs.CV cs.AI cs.CL 81%

ChartHal: A Fine-grained Framework Evaluating Hallucination of Large Vision Language Models in Chart Understanding

Xingqi Wang, Yiming Cui, Xin Yao, Shijin Wang, Guoping Hu, Xiaoyu Qin

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) State Key Laboratory of Cognitive Intelligence, iFLYTEK(认知智能国家重点实验室)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13140 2025-09-23 cs.NI 75%

RIDAS: A Multi-Agent Framework for AI-RAN with Representation- and Intention-Driven Agents

Kuiyuan Ding, Caili Guo, Yang Yang, Jianzhang Guo

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17671 2025-09-23 cs.CL cs.AI 73%

Turk-LettuceDetect: A Hallucination Detection Models for Turkish RAG Applications

Selva Taş, Mahmut El Huseyni, Özay Ezerceli, Reyhan Bayraktar, Fatma Betül Terzioğlu

机构 * Hidden for Review(保密)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08846 2025-09-23 cs.CL cs.AI 73%

Steering Towards Fairness: Mitigating Political Bias in LLMs

Afrozah Nadeem, Mark Dras, Usman Naseem

机构 * School of Computing, Macquarie University(计算机学院,麦考瑞大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at CASE@RANLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05683 2025-09-23 cs.CL cs.LG 73%

WikiBigEdit: Understanding the Limits of Lifelong Knowledge Editing in LLMs

Lukas Thede, Karsten Roth, Matthias Bethge, Zeynep Akata, Tom Hartvigsen

机构 * Tübingen AI Center, University of Tübingen(图宾根人工智能中心,图宾根大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Technical University, Munich(慕尼黑技术大学) University of Virginia(弗吉尼亚大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments published at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17482 2025-09-23 cs.CL 57%

Diagnosing Model Editing via Knowledge Spectrum

Tsung-Hsuan Pan, Chung-Chi Chen, Hen-Hsen Huang, Hsin-Hsi Chen

机构 * Department of Computer Science and Information Engineering(计算机科学与信息工程系) National Taiwan University(国立台湾大学) Artificial Intelligence Research Center(人工智能研究中心) AIST Japan(日本AIST) Institute of Information Science Academia Sinica(学术院信息科学研究所)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17914 2025-09-23 cs.DC 50%

XaaS Containers: Performance-Portable Representation With Source and IR Containers

Marcin Copik, Eiman Alnuaimi, Alok Kamatar, Valerie Hayot-Sasson, Alberto Madonna, Todd Gamblin, Kyle Chard, Ian Foster, Torsten Hoefler

专题命中 知识编辑与模型理解 :LLM(abstract)

Comments Accepted at the International Conference for High Performance Computing, Networking, Storage and Analysis (SC'25)

详情

展开后加载摘要…

URL PDF HTML 收藏