arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7583 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7583 篇

2510.13271 2026-01-07 cs.CL 77%

Do You Get the Hint? Benchmarking LLMs on the Board Game Concept

你得到提示了吗?对大型语言模型的棋盘游戏概念基准测试

Ine Gevers, Walter Daelemans

机构 * CLiPS, University of Antwerp(CLiPS,安特卫普大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过棋盘游戏Concept测试LLMs的演绎推理能力,发现人类易解而LLMs表现不佳,尤其在低资源语言中更差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14335 2026-01-06 cs.CL cs.IR 77%

Context-aware Decoding Reduces Hallucination in Query-focused Summarization

上下文感知解码减少查询导向摘要中的幻觉

Zhichao Xu

机构 * University of Utah(犹他大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出上下文感知解码方法,通过减少查询导向摘要中的幻觉并保留词法模式匹配度,提升生成质量。

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23557 2025-12-30 cs.CR cs.AI 77%

Toward Trustworthy Agentic AI: A Multimodal Framework for Preventing Prompt Injection Attacks

迈向可信的代理AI:一种多模态框架用于防止提示注入攻击

Toqeer Ali Syed, Mishal Ateeq Almutairi, Mahmoud Abdel Moaty

机构 * Faculty of Computer and Information System(计算机与信息系统系) Islamic University of Madinah(麦地那伊斯兰大学) Arab Open University-Bahrain(巴林阿拉伯开放大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种多模态框架,通过溯源感知机制防止代理AI中的提示注入攻击,提升系统安全性和稳定性。

Comments It is accepted in a conference paper, ICCA 2025 in Bahrain on 21 to 23 December

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21024 2025-12-25 cs.GT cs.AI 77%

Policy-Conditioned Policies for Multi-Agent Task Solving

基于策略条件的多智能体任务解决

Yue Lin, Shuhui Zhu, Wenhao Li, Ang Li, Dan Qiao, Pascal Poupart, Hongyuan Zha, Baoxiang Wang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of Waterloo(滑铁卢大学) Tongji University(同济大学) Vector Institute(向量研究所)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过程序化表示和大型语言模型实现多智能体任务解决,引入程序均衡概念并提出PIBR算法,有效解决协调博弈和合作环境问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01564 2025-12-24 cs.CL 77%

Enhancing Uncertainty Estimation in LLMs with Expectation of Aggregated Internal Belief

通过聚合内部信念期望增强大语言模型的不确定性估计

Zeguan Xiao, Diyang Dou, Boya Xiong, Yun Chen, Guanhua Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL

AI总结 本文提出EAGLE方法,通过聚合内部信念期望提升大语言模型的不确定性估计,改进校准性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12085 2025-12-23 cs.LG cs.GR 77%

GraphShaper: Geometry-aware Alignment for Improving Transfer Learning in Text-Attributed Graphs

GraphShaper: 图形感知对齐以提高文本属性图形中的迁移学习

Heng Zhang, Tianyi Zhang, Yuling Shi, Xiaodong Gu, Yaomin Shen, Haochen You, Zijian Zhang, Yilei Yuan, Jin Huang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.LG

AI总结 GraphShaper通过多几何专门化框架提升文本属性图中迁移学习的性能,实现9.47%和7.63%的准确率提升。

Comments This submission has been withdrawn by the authors due to a fundamental error in the methodology that affects the validity of the main results

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04964 2025-12-10 cs.CL 77%

Uncertainty Quantification for LLMs through Minimum Bayes Risk: Bridging Confidence and Consistency

通过最小贝叶斯风险进行大语言模型的不确定性量化:连接置信度与一致性

Roman Vashurin, Maiya Goloburda, Albina Ilina, Aleksandr Rubashevskii, Preslav Nakov, Artem Shelmanov, Maxim Panov

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·泽亚德人工智能大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出通过最小贝叶斯风险连接模型置信度与输出一致性,改进大语言模型的不确定性量化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07687 2025-12-09 cs.CL cs.CV 77%

HalluShift++: Bridging Language and Vision through Internal Representation Shifts for Hierarchical Hallucinations in MLLMs

HalluShift++: 通过内部表示转移弥合语言与视觉,解决多模态大语言模型中的层级幻觉

Sujoy Nath, Arkaprabha Basu, Sharanya Dasgupta, Swagatam Das

机构 * Netaji Subhash Engineering College (NSEC)(奈尔贾伊·萨布哈工程学院) TCG Crest Electronics and Communication Sciences Unit (ECSU)(电子与通信科学单位) Indian Statistical Institute(印度统计研究所)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 HalluShift++通过分析MLLM内部表示转移,解决多模态大语言模型中的层级幻觉问题,提升幻觉检测的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02327 2025-12-08 stat.ML cs.LG 77%

Variational Uncertainty Decomposition for In-Context Learning

变分不确定性分解用于上下文学习

I. Shavindra Jayasekera, Jacob Si, Filippo Valdettaro, Wenlong Chen, A. Aldo Faisal, Yingzhen Li

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出变分不确定性分解框架,用于分解上下文学习中的先验和随机不确定性,通过优化辅助查询获得不确定性上界并诱导下界,实验验证其有效性。

Comments Neurips Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04112 2025-12-05 cs.MM cs.AI 77%

MindFuse: Towards GenAI Explainability in Marketing Strategy Co-Creation

MindFuse:迈向营销策略协同创作中的生成式AI可解释性

Aleksandr Farseev, Marlo Ongpin, Qi Yang, Ilia Gossoudarev, Yu-Yi Chu-Farseeva, Sergey Nikolenko

机构 * ITMO University(ITMO大学) SoMin.ai Research(SoMin.ai研究) Faculty of Software Engineering(软件工程学院) Computer Systems, ITMO University(计算机系统,ITMO大学) ISP RAS Research Center for Trusted Artificial Intelligence(俄罗斯科学院信息与系统研究所以及可信人工智能研究中心)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MindFuse通过可解释生成式AI框架,实现营销策略协同创作中的内容生成、推理和实时优化,提升营销效率12倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04968 2025-12-04 cs.MM cs.AI 77%

The Dream Within Huang Long Cave: AI-Driven Interactive Narrative for Family Storytelling and Emotional Reflection

黑龙洞之梦:由AI驱动的互动叙事用于家庭故事讲述与情感反思

Jiayang Huang, Lingjie Li, Kang Zhang, David Yip

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 《黑龙洞之梦》通过AI驱动的互动叙事,探索家庭关系中的情感连接与大他者不存在的概念。

Comments 8 pages,8 figures, International Symposium on Electronic/Emerging Art (ISEA)

Journal ref Proceedings of the International Symposium on Electronic/Emerging Art (ISEA 2025), Seoul, Republic of Korea, 2025, pp.247-254

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02726 2025-12-03 cs.AI 77%

AuditCopilot: Leveraging LLMs for Fraud Detection in Double-Entry Bookkeeping

AuditCopilot: 利用大语言模型在复式记账中进行欺诈检测

Md Abdul Kadir, Sai Suresh Macharla Vasu, Sidharth S. Nair, Daniel Sonntag

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Oldenburg University(奥尔登堡大学) Saarland University(萨尔兰州立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

AI总结 AuditCopilot利用大语言模型在复式记账中检测欺诈,优于传统方法并提供自然语言解释,提升审计的可解释性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14776 2025-12-02 cs.CL 77%

COMPASS: Context-Modulated PID Attention Steering System for Hallucination Mitigation

COMPASS:基于上下文调节的PID注意力转向系统用于减少幻觉

Kenji Sahay, Snigdha Pandya, Rohan Nagale, Anna Lin, Shikhar Shiromani, Kevin Zhu, Dev Sunishchal

机构 * Algoverse Georgia Institute of Technology(佐治亚理工学院) University of California, Berkeley(加州大学伯克利分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 COMPASS通过上下文调节PID注意力转向系统减少大型语言模型的幻觉,通过可解释的反馈回路提升生成的准确性与可解释性。

Comments 9 pages, 6 figures including algorithmns, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07062 2025-12-02 cs.AI 77%

Improving Region Representation Learning from Urban Imagery with Noisy Long-Caption Supervision

通过噪声长描述监督提升城市影像区域表示学习

Yimei Zhang, Guojiang Shen, Kaili Ning, Tongwei Ren, Xuebo Qiu, Mengmeng Wang, Xiangjie Kong

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出UrbanLN框架,通过长文本意识和噪声抑制提升城市影像区域表示学习,有效解决细粒度特征对齐与噪声干扰问题。

Comments Accepted as a full paper by AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01734 2025-12-01 cs.CL 77%

Benford's Curse: Tracing Digit Bias to Numerical Hallucination in LLMs

本福特定律的诅咒:追踪数字偏差到大语言模型中的数值幻觉

Jiandong Shao, Yao Lu, Jianfei Yang

机构 * Nanyang Technological University(南洋理工大学) University College London(伦敦大学学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 研究发现LLMs在预训练中学习到的数字偏倚导致数值生成偏差,通过修剪特定神经元可缓解错误输出。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18499 2025-11-25 cs.CL 77%

For Those Who May Find Themselves on the Red Team

那些可能发现自己在红队中的人

Tyler Shoemaker

机构 * Texas A&M University(德克萨斯大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文主张文学学者应参与LLM可解释性研究,强调红队作为思想斗争的可能场所。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17572 2025-11-25 cs.CL cs.SI 77%

Community-Aligned Behavior Under Uncertainty: Evidence of Epistemic Stance Transfer in LLMs

在不确定性下对齐的行为:LLMs中认知立场转移的证据

Patrick Gerard, Aiden Chang, Svitlana Volkova

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究通过删除事件知识验证LLMs在无知情况下仍能保持社区特定的行为模式,证明对齐编码了结构化且可推广的行为,推动更安全的LLM部署。

Comments 37 pages, EurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11277 2025-11-21 cs.AI cs.MA 77%

Taming Uncertainty via Automation: Observing, Analyzing, and Optimizing Agentic AI Systems

通过自动化控制不确定性:观察、分析和优化代理AI系统

Dany Moshkovich, Sergey Zeltyn

机构 * IBM Research(IBM研究)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出AgentOps框架,通过自动化管理代理AI系统的不确定性,实现安全、适应性和有效性的运营。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20606 2025-11-19 cs.CL 77%

Model Editing as a Double-Edged Sword: Steering Agent Ethical Behavior Toward Beneficence or Harm

Baixiang Huang, Zhen Tan, Haoran Wang, Zijie Liu, Dawei Li, Ali Payani, Huan Liu, Tianlong Chen, Kai Shu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments AAAI 2026 Oral. 14 pages (including appendix), 11 figures. Code, data, results, and additional resources are available at: https://model-editing.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12728 2025-11-18 cs.CL 77%

On the Brittleness of LLMs: A Journey around Set Membership

Lea Hergert, Gábor Berend, Mario Szegedy, Gyorgy Turan, Márk Jelasity

机构 * University of Szeged(塞格德大学) Rutgers University(罗格斯大学) University of Illinois at Chicago(伊利诺伊大学香槟分校) HUN-REN–SZTE Research Group on AI(AI研究组)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12140 2025-11-18 cs.CL cs.CV 77%

Seeing is Believing: Rich-Context Hallucination Detection for MLLMs via Backward Visual Grounding

Pinxue Guo, Chongruo Wu, Xinyu Zhou, Lingyi Hong, Zhaoyu Chen, Jinglun Li, Kaixun Jiang, Sen-ching Samson Cheung, Wei Zhang, Wenqiang Zhang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09980 2025-11-14 cs.CL 77%

Modeling Uncertainty Trends for Timely Retrieval in Dynamic RAG

Bo Li, Tian Tian, Zhenghua Xu, Hao Cheng, Shikun Zhang, Wei Ye

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments AAAI'26, Oral Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02573 2025-11-14 cs.CL 77%

Guess or Recall? Training CNNs to Classify and Localize Memorization in LLMs

Jérémie Dentan, Davide Buscaldi, Sonia Vanier

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments This paper has been accepted for publication at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07941 2025-11-12 cs.CV cs.AI 77%

Libra-MIL: Multimodal Prototypes Stereoscopic Infused with Task-specific Language Priors for Few-shot Whole Slide Image Classification

Zhenfeng Zhuang, Fangyu Zhou, Liansheng Wang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07480 2025-11-12 cs.CR cs.AI 77%

KG-DF: A Black-box Defense Framework against Jailbreak Attacks Based on Knowledge Graphs

Shuyuan Liu, Jiawei Chen, Xiao Yang, Hang Su, Zhaoxia Yin

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05498 2025-11-11 cs.IR cs.AI 77%

Biomedical Hypothesis Explainability with Graph-Based Context Retrieval

Ilya Tyagin, Saeideh Valipour, Aliaksandra Sikirzhytskaya, Michael Shtutman, Ilya Safro

机构 * Center for Bioinformatics and Computational Biology University of Delaware(生物信息学与计算生物学中心 大田纳西大学) Computer and Information Sciences University of Delaware(计算机与信息科学 大田纳西大学) Drug Discovery and Biomedical Sciences (DDBS) College of Pharmacy University of South Carolina(药物发现与生物医学科学(DDBS)药学院 美国南卡罗来纳大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 30 pages, 10 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17796 2025-11-07 cs.CL 77%

Findings of the Fourth Shared Task on Multilingual Coreference Resolution: Can LLMs Dethrone Traditional Approaches?

Michal Novák, Miloslav Konopík, Anna Nedoluzhko, Martin Popel, Ondřej Pražák, Jakub Sido, Milan Straka, Zdeněk Žabokrtský, Daniel Zeman

机构 * Charles University(查理大学) University of West Bohemia(西波西米亚大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to CODI-CRAC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04514 2025-11-07 cs.CL cs.CV 77%

DAMRO: Dive into the Attention Mechanism of LVLM to Reduce Object Hallucination

Xuan Gong, Tianshi Ming, Xinpeng Wang, Zhihua Wei

机构 * Department of Computer Science and Technology, Tongji University(计算机科学与技术系,同济大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP2024 (Main Conference), add GitHub link

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00419 2025-11-04 cs.CV cs.AI 77%

LGCA: Enhancing Semantic Representation via Progressive Expansion

Thanh Hieu Cao, Trung Khang Tran, Gia Thinh Pham, Tuong Nghiem Diep, Thanh Binh Nguyen

机构 * University of Science, Vietnam National University Ho Chi Minh City, Vietnam(越南胡志明市国家大学科学大学) National University of Singapore, Singapore(新加坡国立大学) AISIA Lab, Ho Chi Minh City, Vietnam(越南胡志明市AISIA实验室)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI

Comments 15 pages, 5 figures, to appear in SoICT 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00883 2025-11-03 cs.CL 77%

Mathematics Isn't Culture-Free: Probing Cultural Gaps via Entity and Scenario Perturbations

Aditya Tomar, Nihar Ranjan Sahoo, Ashish Mittal, Rudra Murthy, Pushpak Bhattacharyya

机构 * IIT Bombay(印度班加罗尔理工学院) IBM Research(IBM研究院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏