arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-21 至 2025-11-21 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 12 篇

2511.16540 2025-11-21 cs.CL cs.LG 86%

Beyond Tokens in Language Models: Interpreting Activations through Text Genre Chunks

超越标记的语言模型:通过文本体裁块解释激活

Éloïse Benito-Rodriguez, Einar Urdshals, Jasmina Nasufi, Nicky Pochinkov

机构 * Chalmers Technical University(挑战者技术大学) Lund University(隆德大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出通过文本体裁块的激活预测来解释语言模型,使用Mistral-7B和两个数据集,达到高达98%的F1分数。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15258 2025-11-21 cs.AI cs.CL 86%

Multi-dimensional Data Analysis and Applications Basing on LLM Agents and Knowledge Graph Interactions

基于LLM代理和知识图谱交互的多维数据分析与应用

Xi Wang, Xianyao Ling, Kun Li, Gang Yin, Liang Zhang, Jiang Wu, Jun Xu, Fu Zhang, Wenbo Lei, Annie Wang, Peng Gong

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于LLM代理与知识图谱交互的多维数据分析方法,通过自动提取产品数据、实时构建知识图谱并支持用户深入分析,提升多维数据的处理能力。

Comments 14 pages, 7 figures, 40 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12065 2025-11-21 cs.NI 86%

Towards a Wireless Physical-Layer Foundation Model: Challenges and Strategies

迈向无线物理层基础模型:挑战与策略

Jaron Fontaine, Adnan Shahid, Eli De Poorter

专题命中 知识编辑与模型理解 :foundation model(title,abstract);large language model(abstract,comments);language model(abstract,comments)

AI总结 本文提出统一的无线物理层基础模型,旨在解决无线网络中任务特定AI策略的问题,通过预训练任务和语义学习提升模型的通用性和可交互性。

Comments This paper is accepted and part of the WS33 IEEE ICC 2024 1st Workshop on The Impact of Large Language Models on 6G Networks proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13984 2025-11-21 cs.LG cs.AI 81%

Node-Level Uncertainty Estimation in LLM-Generated SQL

节点层面的LLM生成SQL不确定性估计

Hilaf Hasson, Ruocheng Guo

专题命中 知识编辑与模型理解 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于节点层面的LLM生成SQL不确定性估计方法,通过语义感知标记和特征提取提升查询错误检测与修复的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00588 2025-11-21 cs.LG cs.AI cs.CY 79%

Diagnosing Hallucination Risk in AI Surgical Decision-Support: A Sequential Framework for Sequential Validation

诊断人工智能手术决策支持中的幻觉风险:一种用于序列验证的连续框架

Dong Chen, Yanzhe Wei, Zonglin He, Guan-Ming Kuang, Canhua Ye, Meiru An, Huili Peng, Yong Hu, Huiren Tao, Kenneth MC Cheung

机构 * Orthopaedic Centre, The University of Hong Kong - Shenzhen Hospital(香港大学深圳医院骨科中心) Translational Medicine Centre, The University of Hong Kong - Shenzhen Hospital(香港大学深圳医院转化医学中心) Department of Orthopaedics & Traumatology, Li Ka Shing Faculty of Medicine, The University of Hong Kong(香港大学李嘉诚医学院骨科与创伤外科部)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种用于评估人工智能手术决策支持系统幻觉风险的连续框架,通过多维度测试揭示模型在复杂性下的脆弱性,并强调了增强推理能力的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11277 2025-11-21 cs.AI cs.MA 77%

Taming Uncertainty via Automation: Observing, Analyzing, and Optimizing Agentic AI Systems

通过自动化控制不确定性:观察、分析和优化代理AI系统

Dany Moshkovich, Sergey Zeltyn

机构 * IBM Research(IBM研究)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出AgentOps框架,通过自动化管理代理AI系统的不确定性,实现安全、适应性和有效性的运营。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01533 2025-11-21 cs.CR cs.CY 75%

LightDefense: A Lightweight Uncertainty-Driven Defense against Jailbreaks via Shifted Token Distribution

LightDefense: 一种基于不确定性驱动的轻量级对抗劫持防御方法通过移位词分布

Zhuoran Yang, Yanyong Zhang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 LightDefense通过调整词元分布和利用模型不确定性,提供了一种轻量级的对抗劫持防御方法,有效提升LLM的安全性同时保持对正常查询的有用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13246 2025-11-21 cs.CL cs.AI 73%

Atomic Calibration of LLMs in Long-Form Generations

大语言模型在长文本生成中的原子校准

Caiqi Zhang, Ruihan Yang, Zhisong Zhang, Xinting Huang, Sen Yang, Dong Yu, Nigel Collier

机构 * University of Cambridge(剑桥大学) Fudan University(复旦大学) Tencent AI Lab(腾讯AI实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出原子校准方法,用于改进大语言模型在长文本生成中的校准能力,揭示置信度方法与生成过程中置信度变化的关联。

Comments ACL 2025 KnowFM Oral / AACL-IJCNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17747 2025-11-21 cs.CL 70%

Discriminating Form and Meaning in Multilingual Models with Minimal-Pair ABX Tasks

通过最小对ABX任务区分多语言模型中的形式与意义

Maureen de Seyssel, Jie Chi, Skyler Seto, Maartje ter Hoeve, Masha Fedzechkina, Natalie Schluter

机构 * Apple(苹果公司)

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 通过最小对ABX任务研究多语言模型中形式与意义的区分能力,揭示了语言识别和语义识别在训练过程中的变化规律。

Comments Comments: Published in EMNLP 2025. https://aclanthology.org/2025.emnlp-main.1210.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03628 2025-11-21 cs.CL 70%

GPTopic: Dynamic and Interactive Topic Representations

GPTopic: 动态和交互式主题表示

Arik Reuter, Bishnu Khadka, Anton Thielmann, Christoph Weisser, Sebastian Fischer, Benjamin Säfken

机构 * University of Cambridge(剑桥大学) LMU Munich(慕尼黑大学) TU Clausthal(Clausthal技术大学) BASF(巴斯夫) Tribhuvan University(特里布文大学) MCML

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 GPTopic利用大型语言模型创建动态交互式主题表示,通过直观界面提升主题建模的可访问性和全面性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16435 2025-11-21 cs.CV 67%

Beyond Visual Cues: Leveraging General Semantics as Support for Few-Shot Segmentation

超越视觉线索:利用通用语义作为少样本分割的支持

Jin Wang, Bingfeng Zhang, Jian Pang, Mengyu Liu, Honglong Chen, Weifeng Liu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

AI总结 本文提出语言驱动属性泛化架构,通过多属性增强和多模态对齐提升少样本分割性能,实现新的最佳效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11706 2025-11-21 cs.LG cs.CV 57%

Context-Aware Multimodal Representation Learning for Spatio-Temporally Explicit Environmental Modelling

面向情境的多模态表示学习用于时空明确的环境建模

Julia Peters, Karin Mora, Miguel D. Mahecha, Chaonan Ji, David Montero, Clemens Mosig, Guido Kraemer

机构 * Environmental Data Science and Remote Sensing Group(环境数据科学与遥感小组) Institute for Earth System Science and Remote Sensing(地球系统科学与遥感研究所) Leipzig University(莱比锡大学) German Centre for Integrative Biodiversity Research (iDiv)(整合生物多样性研究德国中心(iDiv))

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 本文提出一种面向情境的多模态表示学习框架,整合不同地球观测模态以高时空分辨率建模环境,提升生态分析的精度与效率。

Comments 10 pages (incliding 2 pages of references), 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏