arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7608 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7608 篇

2601.19072 2026-06-12 cs.SE cs.AI 版本更新 81%

HalluJudge: A Reference-Free Hallucination Detection for Context Misalignment in Code Review Automation

HalluJudge: 代码审查自动化中上下文错位的无参考幻觉检测

Kla Tantithamthavorn, Hong Yi Lin, Patanamon Thongtanunam, Wachiraphan Charoenwet, Minwoo Jeong, Ming Wu

机构 * Monash University Australia(墨尔本大学澳大利亚) The University of Melbourne Australia(墨尔本大学澳大利亚) Atlassian USA(Atlassian美国)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出无参考幻觉检测方法HalluJudge,通过上下文对齐评估生成评论的根基性,采用多分支推理策略,在F1=0.85且成本$0.009下与开发者偏好67%一致。

Comments Accepted at FSE'26: Industry Track, Full-Length, Peer-Reviewed

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21543 2026-06-10 cs.CL 版本更新 81%

inversedMixup: Data Augmentation via Inverting Mixed Embeddings

inversedMixup:通过反转混合嵌入进行数据增强

Fanshuang Kong, Richong Zhang, Qiyu Sun, Zhijie Nie, Ting Deng, Chunming Hu

机构 * Beihang University(北京航空航天大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 提出 inversedMixup 框架,结合 Mixup 的可控性与 LLM 的可解释性,通过对齐嵌入空间将混合嵌入重构为可读句子,首次实证文本 Mixup 中的流形入侵现象,并扩展为三阶段数据增强方法,在少样本和全监督场景下有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08477 2026-06-09 cs.AI 新提交 81%

A Variability-Based Framework for Interpretable Naming in Formal and Relational Concept Analysis

基于可变性的框架:形式概念分析与关系概念分析中的可解释命名

Alain Gutierrez, Marianne Huchard, Pierre Martin, André Miralles, Violaine Prince

机构 * LIRMM, Univ. Montpellier, CNRS(法国国家科学研究中心蒙彼利埃大学计算机科学、机器人及微电子实验室) CIRAD, UPR AIDA(法国农业国际合作研究发展中心AIDA研究单元) AIDA, CIRAD, Univ. Montpellier(法国农业国际合作研究发展中心AIDA研究单元,蒙彼利埃大学) INRAE - UMR TETIS - Territoires, Environnement(法国国家农业、食品与环境研究院TETIS联合研究单元)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对形式概念分析和关系概念分析中概念命名缺乏可解释性的问题,提出一种基于可变性的LLM辅助命名框架,通过控制信息源生成可读名称,并在披萨店数据集上验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07818 2026-06-09 cs.CL cs.NE 新提交 81%

Representational Similarity and Model Behavior in Multi-Agent Interaction

多智能体交互中的表征相似性与模型行为

Yujin Potter, Seun Eisape, Shiyang Lai, Alexander Huth, James Evans, Been Kim, Jacob Eisenstein, Dawn Song, Alane Suhr

机构 * University of Washington(华盛顿大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究LLM对间的表征相似性对合作与创新的影响,发现高相似性促进合作但降低新颖性,且早期层相似性关联最强。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06976 2026-06-08 cs.AI 新提交 81%

Exploring Agentic Tool-Calling Decisions via Uncertainty-Aligned Reinforcement Learning

通过不确定性对齐强化学习探索智能体工具调用决策

Yijin Zhou, Linqian Zeng, Xiaoya Lu, Wenyuan Xie, Dongrui Liu, Junchi Yan, Jing Shao

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 针对智能体工具调用中错误累积问题,提出TRUST方法,将不确定性量化作为排斥力融入奖励设计,并标注轻量关键轮次用于多轮轨迹统一后训练,显著提升决策质量与智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04223 2026-06-04 cs.AI 81%

Consensus is Strategically Insufficient: Reasoning-Trace Disagreement as a Knowledge-Representation Signal

共识在策略上是不充分的:推理轨迹分歧作为知识表示信号

Michał Wawer, Jarosław A. Chudziak

机构 * Laboratory of The New Ethos(新伦理实验室) Warsaw University of Technology(华沙理工大学) Institute of Computer Science(计算机科学研究所) Faculty of Electronics and Information Technology(电子与信息技术学院)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本文提出在价值负载任务中,分歧可能反映规范不确定性而非错误,通过将推理轨迹和决策抽象为符号分歧状态,构建知识表示层以支持可废止策略路由,连接亚符号LLM审议与符号知识表示。

Comments Accepted to LAMAS&SR workshop at FLoC 2026 (KR + ICPL + LICS + CP + FSCD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02158 2026-06-02 cs.CL 81%

On the Salience of Low-Probability Tokens for AI-Generated Text Detection: A Multiscale Uncertainty Perspective

低概率标记对AI生成文本检测的显著性:多尺度不确定性视角

Yikai Guo, Bin Wang, Xilai Fan, Wenjun Ke, Haoran Luo

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 针对AI生成文本检测中模板标记主导和点估计脆弱的问题,提出基于低概率标记的多尺度不确定性估计器Uncertainty及其改进版Uncertainty++,在多个数据集和LLM上验证了有效性、泛化性和鲁棒性。

Comments Accepted by ICML 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00301 2026-06-02 cs.LG 81%

FLaG: Fine-Grained Latent Grouping for Hallucination Detection

FLaG:用于幻觉检测的细粒度潜在分组

Wentao Ye, Liyao Li, Zhiqing Xiao, Muzhi Zhu, Jiaqi Hu, Zhanming Shen, Xiaomeng Hu, Sean Du, Haobo Wang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出FLaG框架,通过能量路由机制将实例软关联到多个潜在证据组,并利用对数边际聚合组合组条件可靠性信号,以捕获异构幻觉模式,实现无需修改底层模型的高效幻觉检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30042 2026-05-29 cs.AI 81%

Learning to Choose: An Empowerment-Guided Multi-Agent System with semantic communication for Adaptive Method Selection

学会选择:一种基于赋权与语义通信的自适应方法选择多智能体系统

Geremy Loachamín-Suntaxi, Robert Lazar, Dimitrios G. Giovanis, Ioannis G. Kevrekidis, Eleni D. Koronaki

机构 * Faculty of Science, Technology and Medicine(科学、技术与医学学院) University of Luxembourg(卢森堡大学) Johns Hopkins University(约翰霍普金斯大学) Luxembourg Institute of Science and Technology(卢森堡科学与技术研究院)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种结合上下文赌博机、结构化智能体间通信和语义检查点的多智能体框架,通过保持动作-结果因果一致性来提升科学计算工作流中自适应决策的收敛性、鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29737 2026-05-29 cs.CR cs.CL cs.SE 81%

Minimal Prompt Perturbations Lead to Code Vulnerabilities: Prompt Fragility and Hidden-State Signals in Coding LLMs

最小提示扰动导致代码漏洞:编码大语言模型中的提示脆弱性和隐藏状态信号

Alexander Sternfeld, Andrei Kucharavy, Ljiljana Dolamic

机构 * IEM, HES-SO, Le Foyer, Techno-Pôle 1, Sierre, Switzerland(瑞士苏黎世联邦理工学院(HES-SO)技术园区1号,西尔尔) Cyber-Defence Campus, armasuisse Science and Technology, Thun, Switzerland(瑞士图恩 Cyber-Defence 营地,armasuisse 科学与技术)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 本文通过token级突变实验,发现微小提示扰动(如单字符变化)即可使LLM生成代码从安全变为脆弱,并利用隐藏状态分析揭示输入处理漏洞比安全默认值漏洞更可预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28745 2026-05-28 cs.CL 81%

Stance Detection in Prediction Markets: Addressing Imbalanced Trader Commentary via Counterfactual Augmentation and Market Context

预测市场中的立场检测:通过反事实增强和市场上下文解决交易者评论不平衡问题

Thomas Mbrice

机构 * Department of Computer Science(计算机科学系) Stony Brook University(石溪大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 针对预测市场评论中极端不平衡的立场检测问题,提出结合市场上下文和LLM驱动的反事实增强方法,显著提升了少数类(反对立场)的召回率和F1值。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23933 2026-05-28 cs.CY cs.AI 81%

KT4EQG: Personalized Exercise Question Generation via Knowledge Tracing

KT4EQG: 通过知识追踪实现个性化习题生成

Xinyi Gao, Qiucheng Wu, Lu Ding, Q. Vera Liao, Kaizhi Qian, Ying Xu, Shiyu Chang, Yang Zhang

机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校) University of South Alabama(南方大学) University of Michigan(密歇根大学) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) Harvard University(哈佛大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出KT4EQG框架,利用知识追踪模型选择最合适的概念,并训练基于LLM的题目生成器,以生成个性化习题,实验证明其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04042 2026-05-21 cs.CL 81%

Causal Path Alignment: Anchoring the Optimization Trajectory for Controllable In-Parameter Knowledge Editing

因果路径对齐:为可控的参数知识编辑锚定优化轨迹

Xiyu Liu, Zhengxiao Liu, Naibin Gu, Zheng Lin, Weiping Wang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出Causal Path Alignment框架,通过锚定优化轨迹来解决参数知识编辑中的主体主导记忆干扰问题,提升关系特异性并减少副作用。

Comments Accepted by IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20191 2026-05-21 cs.CL 81%

Shiny Stories, Hidden Struggles: Investigating the Representation of Disability Through the Lens of LLMs

闪耀的故事,隐藏的挣扎:通过LLM的视角调查残疾人的表现

Marco Bombieri, Simone Paolo Ponzetto, Marco Rospocher

机构 * Department of Foreign Languages and Literature, University of Verona(外国语言文学系,威尼斯大学) Department of Information Engineering and Computer Science, University of Trento(信息工程与计算机科学系,特伦托大学) Data and Web Science Group, University of Mannheim(数据与网络科学小组,曼海姆大学)

专题命中 知识编辑与模型理解 :LLM(title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型(LLMs)如何表现残疾人群体,通过模拟残疾人视角生成社交媒体帖子,并与真实残疾人的帖子进行比较,揭示LLMs对残疾人的理想化倾向和潜在的偏见。

Comments Accepted for publication in ACM Transactions on Intelligent Systems and Technology

Journal ref ACM Trans. Intell. Syst. Technol. (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12276 2026-05-13 cs.CL 81%

Modeling Narrative Structure in Latin Epic Poetry with Automatically Generated Story Grammars

用自动生成的故事语法建模拉丁史诗诗歌的叙事结构

Abigail Swenor, John James, Neil Coffee, Walter Scheirer

机构 * Department of Computer Science and Engineering, University of Notre Dame(诺特兰大学计算机科学与工程系) Department of Classics, University at Buffalo(布法罗大学古典学系)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种利用大语言模型和少样本学习自动标注拉丁史诗诗歌故事元素,以提升文学文本分析的可解释性和实用性。

Comments Submitted to Journal of Computational Literary Studies

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10018 2026-05-12 cs.LG 81%

The Value of Mechanistic Priors in Sequential Decision Making

在序列决策中机制先验的价值

Itai Shufaro, Gal Benor, Shie Mannor

机构 * Technion(技术学院) NVIDIA Research(NVIDIA研究)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.LG

AI总结 本文研究了机制先验在序列决策中的价值,通过渐近和预热阶段的分析,提出机制信息度量并展示其在5-FU给药模拟中的高效性,对比LLM先验发现其在机械信息上存在严重损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08516 2026-05-12 cs.AI 81%

OracleTSC: Oracle-Informed Reward Hurdle and Uncertainty Regularization for Traffic Signal Control

OracleTSC: 通过Oracle信息的奖励障碍和不确定性正则化用于交通信号控制

Darryl Jacob, Xinyu Liu, Muchao Ye, Xiaoyong Yuan, Pan He

机构 * Department of Computer Science and Software Engineering(计算机科学与软件工程系) Auburn University(亚伯拉罕大学) Department of Computer Science(计算机科学系) University of Iowa(爱荷华大学) Department of Electrical and Computer Engineering(电气与计算机工程系) Clemson University(克莱姆森大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 OracleTSC通过奖励障碍和不确定性正则化机制提升交通信号控制的稳定性与效果,实验表明其在交通效率提升和跨路口泛化能力方面表现突出。

Comments Published in Transactions on Machine Learning Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08045 2026-05-11 cs.CL 81%

Uncertainty-Aware Structured Data Extraction from Full CMR Reports via Distilled LLMs

基于蒸馏LLM的全CMR报告不确定性感知结构化数据提取

Yi Yu, Parker Martin, Zhenyu Bu, Yixuan Liu, Yi-Yu Zheng, Orlando Simonetti, Yuchi Han, Yuan Xue

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 知识编辑与模型理解 :LLM(title_cn,summary_cn);分类 cs.CL

AI总结 本文提出CMR-EXTR框架,通过蒸馏LLM将自由文本CMR报告转为结构化数据并提供字段置信度,实现无监督推理和不确定性整合,达到99.65%的变量级准确率。

Comments Accepted to ISBI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07935 2026-05-11 cs.AI cs.MA 81%

TraceFix: Repairing Agent Coordination Protocols with TLA+ Counterexamples

TraceFix:基于TLA+反例的智能体协调协议修复

Shuren Xia, Qiwei Li, Taqiya Ehsan, Jorge Ortiz

机构 * Rutgers University(新泽西州普林斯顿大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TraceFix通过TLA+反例迭代修复智能体协调协议,实现高效验证与执行,提升任务完成率和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27275 2026-05-01 cs.HC cs.AI cs.CY 81%

Evaluating Epistemic Guardrails in AI Reading Assistants: A Behavioral Audit of a Minimal Prototype

评估人工智能阅读助手中的认知护栏:一个最小原型的行为审计

Matthew Christian Agustin

机构 * Responsible Innovation Lab(负责任创新实验室)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过TextWalk原型评估认知护栏在AI阅读助手中的行为特性,探讨在压力下其动态表现及对读者解读劳动的影响。

Comments 18 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25931 2026-04-30 cs.CL 81%

Anchored Confabulation: Partial Evidence Non-Monotonically Amplifies Confident Hallucination in LLMs

锚定编造:部分证据非单调放大LLM中的自信幻觉

Ashish Balkishan Lathkar

机构 * Florida State University(佛罗里达州立大学)

专题命中 知识编辑与模型理解 :LLM(title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究揭示了大语言模型中一种新校准特性:提供一个确认的中间事实可非单调放大自信错误答案率。通过六个证据线证明了参数幻觉信心(PHC)概念,并在RAG路由中应用,显著提升性能。

Comments 62 pages, 5 figures. Preprint under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02989 2026-04-23 cs.CL 81%

Mechanistic Interpretability of Large-Scale Counting in LLMs through a System-2 Strategy

通过系统2策略解析大语言模型中大规模计数的机制

Hosein Hasani, Mohammadali Banayeeanzade, Ali Nafisi, Sadegh Mohammadian, Fatemeh Askari, Mobin Bagherian, Amirmohammad Izadi, Mahdieh Soleymani Baghshah

机构 * Sharif University of Technology(谢里夫理工大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种系统2策略,通过分解大计数任务为小问题来提升LLM计数精度,揭示了计数机制并验证了其有效性。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22858 2026-04-21 cs.GR cs.AI 81%

Learning to Build Shapes by Extrusion

通过挤出学习构建形状

Thor Vestergaard Christiansen, Karran Pandey, Alba Reinders, Karan Singh, Morten Rieger Hannemose, J. Andreas Bærentzen

机构 * Technical University of Denmark(丹麦技术大学) University of Toronto(多伦多大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于文本的挤出表示(TEE),通过学习面挤出序列生成3D网格,支持任意面数并生成流形网格,同时可应用于现有网格进行编辑。

Comments A preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20481 2026-04-16 q-bio.NC cs.CL 81%

Coherence in the brain unfolds across separable temporal regimes

大脑中的相干性在可分离的时间 regime 中展开

Davide Staub, Finn Rabe, Akhil Misra, Yves Pauli, Roya Hüppi, Ni Yang, Nils Lang, Lars Michels, Victoria Edkins, Sascha Frühholz, Iris Sommer, Wolfram Hinzen, Philipp Homan

机构 * Department of Adult Psychiatry and Psychotherapy, University of Zurich, Zurich, Switzerland(大学精神病学与心理学系,苏黎世大学,苏黎世,瑞士) Department of Translation and Language Sciences, University Pompeu Fabra, Barcelona, Spain(翻译与语言科学系,庞培法拉大学,巴塞罗那,西班牙) Department of Neuroradiology, Clinical Neuroscience Center, University Hospital Zurich, Zurich, Switzerland(神经放射学系,临床神经科学中心,苏黎世大学医院,苏黎世,瑞士) Department of Psychology, University of Oslo, Oslo, Norway(心理学系,奥斯陆大学,奥斯陆,挪威) Cognitive and Affective Neuroscience Unit, University of Zurich, Zurich, Switzerland(认知与情感神经科学单元,苏黎世大学,苏黎世,瑞士) Center for Clinical Neuroscience and Cognition, University of Groningen, Groningen, Netherlands(临床神经科学与认知中心,格罗宁根大学,格罗宁根,荷兰) Neuroscience Center Zurich, University of Zurich and ETH Zurich, Zurich, Switzerland(苏黎世神经科学中心,苏黎世大学和ETH苏黎世分校,苏黎世,瑞士)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过无标注的漂移和移位信号揭示了语言理解中相干性的神经机制,发现默认模式网络枢纽和初级听觉皮层存在不同的神经偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12460 2026-04-16 cs.CL 81%

Beyond Black-Box Interventions: Latent Probing for Faithful Retrieval-Augmented Generation

超越黑盒干预:用于忠实检索增强生成的潜在探测

Linfeng Gao, Qinggang Zhang, Baolong Bi, Bo Zeng, Zheng Yuan, Zerui Chen, Zhimin Wei, Shenghua Liu, Linlong Xu, Longyue Wang, Weihua Luo, Jinsong Su

机构 * School of Informatics, Xiamen University(厦门大学信息学院) The Hong Kong Polytechnic University(香港理工大学) University of Chinese Academy of Sciences(中国科学院大学) Alibaba Group(阿里巴巴集团) Key Laboratory of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian and Taiwan (Xiamen University), Ministry of Culture and Tourism, China(福建省和台湾非物质文化遗产数字化保护与智能处理重点实验室(厦门大学),中华人民共和国文化和旅游部,中国)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);preference optimization(abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出ProbeRAG框架,通过潜在冲突探测和注意力调节提升检索增强生成的忠实度,解决传统方法在评估知识冲突时的不足。

Comments ACL 2026 Findings; Code is available at https://github.com/LinfengGao/ProbeRAG

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10398 2026-04-15 cs.AI 81%

LatentRefusal: Latent-Signal Refusal for Unanswerable Text-to-SQL Queries

LatentRefusal:用于无法回答的文本到SQL查询的潜在信号拒绝

Xuancheng Ren, Shijing Hu, Zhihui Lu, Jiangqi Huang, Qiang Duan

机构 * Fudan University(复旦大学) Pennsylvania State University(宾夕法尼亚州立大学) Abington College(阿宾顿学院)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LatentRefusal方法,通过分析大语言模型的中间隐藏激活来预测查询可回答性,从而在文本到SQL系统中实现安全拒绝,提升系统安全性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12046 2026-04-15 cs.CL 81%

Think Through Uncertainty: Improving Long-Form Generation Factuality via Reasoning Calibration

在不确定性中思考:通过推理校准提升长形式生成的真实性

Xin Liu, Lu Wang

机构 * Computer Science and Engineering University of Michigan(计算机科学与工程系密歇根大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出CURE框架,通过在声明层面教授模型处理不确定性,提升长形式生成的真实性。该方法通过多阶段训练流程对齐模型置信度与声明正确性,并在推理时选择性预测,实验表明其在事实准确性上优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10189 2026-04-14 cs.CL 81%

FAITH: Factuality Alignment through Integrating Trustworthiness and Honestness

FAITH:通过整合可信度和诚实度实现事实一致性

Xiaoning Dong, Chengyan Wu, Yajie Wen, Yu Chen, Yun Xue, Jing Zhang, Wei Xu, Bolei Ma

机构 * Tsinghua University, Institute for Interdisciplinary Information Sciences(清华大学,交叉信息研究院) Shanghai Qi Zhi Institute(上海期智研究院) South China Normal University, School of Electronic Science and Engineering(华南师范大学,电子科学与工程学院) Guangzhou Richstone Data Technologies Co., Ltd.(广州瑞驰数据技术有限公司) LMU Munich & Munich Center for Machine Learning(慕尼黑大学 & 慕尼黑机器学习中心)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 FAITH通过整合可信度和诚实度信号,提升大语言模型的事实准确性。采用PPO算法优化奖励函数,并结合检索增强模块增强内外知识一致性。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00778 2026-04-02 cs.CL 81%

From Early Encoding to Late Suppression: Interpreting LLMs on Character Counting Tasks

从早期编码到晚期抑制:解释LLM在字符计数任务上的表现

Ayan Datta, Mounika Marreddy, Alexander Mehler, Zhixue Zhao, Radhika Mamidi

机构 * IIIT Hyderabad(印度国际信息技术学院海德拉巴分校) Goethe University, Frankfurt am Main, Germany(德国法兰克福歌德大学) University of Sheffield, UK(英国谢菲尔德大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 研究通过字符计数任务揭示LLM内部计算中的结构干扰问题,发现模型在早期层正确编码信息,但后期层通过负电路抑制了正确输出,导致符号推理失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00429 2026-03-03 cs.HC cs.AI 81%

Personalities at Play: Probing Alignment in AI Teammates

性格的博弈:探究AI队友的对齐

Mohammad Amin Samadi, Nia Nixon

机构 * School of Education University of California Irvine(教育学院 加州大学尔湾分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究探讨AI队友的性格对齐,通过多维度评估发现其性格表现受提示策略、供应商差异和记忆构建影响,强调需综合考虑记忆和系统设计以有效评估AI性格。

详情

展开后加载摘要…

URL PDF HTML 收藏