Effective Sequence-to-Sequence Dialogue State Tracking
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted at EMNLP 2021
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted at EMNLP 2021
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments propaganda, propaganda techniques, disinformation, misinformation, fake news, explainability, interpretability
Journal ref RANLP-2021
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ICLR 2021 camera-ready version
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments accepted by AAAI 2021
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 15 pages, 4 figures. Code and Data: https://github.com/INK-USC/CALM/
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Published in #ICLR2019 International Conference on Learning Representations
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments To appear at AAAI 2019
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 8 pages
Journal ref NAACL 2000
几何幻觉检测度量实际上测量什么?
机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室) ; University of Washington(华盛顿大学) ; University of Pennsylvania(宾夕法尼亚大学) ; Colorado State University(科罗拉多州立大学) ; University of Texas, El Paso(德克萨斯大学埃尔帕索分校) ; Laboratory for Advanced Cybersecurity Research, National Security Agency(国家安全局高级网络安全研究实验室)
专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI、cs.LG;foundation model(comments)
AI总结 本文研究几何统计在检测幻觉中的作用,通过合成数据集分析不同属性对幻觉检测的影响,并提出归一化方法提升多领域检测性能。
Comments Published at the 2025 ICML Workshop on Reliable and Responsible Foundation Models
机构 * Valence Labs(Valence实验室) ; University of Manchester(曼彻斯特大学)
专题命中 知识编辑与模型理解 :foundation model(abstract,comments);分类 cs.AI、cs.LG
Comments ICML 2025 main-track paper (42nd International Conference on Machine Learning). Formerly appeared as best paper runner-up at NeurIPS 2024 Foundation Models for Science Workshop (38th Conference on Neural Information Processing Systems). 18 pages, 7 figures
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI;foundation model(comments)
Comments Accepted poster at the 38th Conference on Neural Information Processing Systems (NeurIPS 2024) Workshop on Foundation Model Interventions
专题命中 知识编辑与模型理解 :foundation model(abstract,comments);分类 cs.AI、cs.LG
Comments NeurIPS Workshop: "Federated Learning in the Age of Foundation Models" 2023
专题命中 知识编辑与模型理解 :language model(abstract,comments);分类 cs.CL、cs.LG
Comments Outdated. Superseded by arXiv:2112.05224 and published at IEEE S&P'22 with title: "Spinning Language Models: Risks of Propaganda-As-A-Service and Countermeasures"
可解释架构的图形化设计
机构 * IBM Research(IBM研究院)
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG
AI总结 该研究提出改编自Penrose张量表示法的图形符号,可直观呈现可解释AI架构的全局视图并与PyTorch einsum代码一一对应,还绘制了Steerling-8B的架构图并转换为代码。
概念分配区:追踪概念如何跨越Transformer深度形成
机构 * Independent Researcher(独立研究者)
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG
AI总结 提出概念分配区(CAZ)框架,通过层间度量(分离度、概念一致性、概念速度)检测概念在残差流中逐渐形成的深度区间,并在34个模型上验证了分离曲线的多模态性及温和CAZ的因果活性。
Comments v2: substantial revision. Cross-architecture ordering statistic and MHA/GQA cohort-split claim retracted per recomputation; corpus and companion-paper citations refreshed. See paper's "Changes from Version 1" section for the full list of superseded values
心脏能反映你的疼痛吗?用自监督心电表示学习应对X-ITE疼痛挑战赛
专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.AI、cs.LG
AI总结 本研究针对X-ITE疼痛挑战赛,结合自监督心电表示学习与多模态预训练,分析疼痛识别中的心电信号特性,为可穿戴疼痛监测提供了基础。
Comments 5 pages, 3 Figures, 1 Table, appear in the Proceedings of the 13th International Conference on Affective Computing and Intelligent Interaction Workshops and Demos (ACIIW 2025)
聚集而非准入:注意力如何将隐变量转化为可表述形式
机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校)
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究通过实验发现语言模型不存在词工作空间理论预测的准入门,揭示了隐变量的可读形式由中层窗口内注意力介导的需求特异性聚集产生,而非门控机制。
Comments 26 pages, 9 figures, 6 tables. Code and data: https://github.com/parsa-mz/innerj
专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI、cs.LG
Comments 10 pages, 4 figures, accepted to the 26th International Society for Music Information Retrieval conference (ISMIR 2025), to be held in Daejeon, South Korea
Journal ref Proceedings of the 26th International Society for Music Information Retrieval Conference (ISMIR 2025), Daejeon, South Korea, pp. 569-578, 2025
低交互秩学习:统一乘法双编码器头
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG
AI总结 本文提出低交互秩学习框架,统一乘法双编码器头架构,解决其设计决策、可识别性等问题,经实验验证该框架可解释对比维度不可解释性并恢复真实模式。
Avalon-ToM-Bench:通过非对称游戏机制评估细粒度心理理论
机构 * National Taiwan University(台湾大学) ; CyCraft AI Lab(CyCraft人工智能实验室)
专题命中 知识编辑与模型理解 :LLM(abstract_cn);分类 cs.CL、cs.AI
AI总结 本文提出Avalon-ToM-Bench基准,基于阿瓦隆游戏机制评估大语言模型的细粒度心理理论,发现模型ToM能力不足源于推理策略而非知识或表征,推理训练比测试时思维链增益更显著。
大型语言模型内部代码正确性表示的鲁棒性研究
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG
AI总结 该研究系统探究大型语言模型内部代码正确性信号的鲁棒性,发现无最优提取配置且分离故障无法提升信号质量。
Comments 14 pages
视觉-语言 Grounding 作为双向概念对应
机构 * University of Washington(华盛顿大学) ; Allen Institute for AI(艾伦人工智能研究所) ; FAIR at Meta(Meta FAIR实验室)
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI
AI总结 本研究将视觉-语言 Grounding 建模为双向概念对应,提出 ConCor-1 模型统一相关任务,在长文本数据集和零样本 LVIS 上对应 F1 分别提升 48%、29%,性能优于基线。
鲁棒滤波注意力:自注意力作为精度加权状态估计
机构 * Independent Researcher, Los Angeles, CA, USA(独立研究者,美国加利福尼亚州洛杉矶)
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG
AI总结 提出鲁棒滤波注意力(RFA),将自注意力建模为基于线性随机微分方程的状态估计,在语言建模中实现优于RoPE的困惑度与零样本外推稳定性。
Comments Accepted to ICML 2026
位置:可信的状态完整性在网络物理系统中——为什么模块主权解决塑性-稳定性悖论
机构 * Software/Hardware Integration Lab (LISHA), Department of Statistics and Informatics, UFSC, Florianópolis, Brazil(软件/硬件集成实验室(LISHA)、统计与信息学系,UFSC,弗洛里亚诺波利斯,巴西)
专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI、cs.LG
AI总结 本文提出模块主权范式,通过冻结领域特定专家和不确定性感知融合,解决网络物理系统中塑性-稳定性悖论,确保状态完整性和可验证性。
Comments v2, 15 pages, (8 main text, 6 references and appendices), 2 figures
通过分布匹配和分布式互换干预实现忠实的双向模型引导
专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.CL、cs.LG
AI总结 本文提出Concept DAS (CDAS)方法,通过分布匹配和分布式互换干预实现模型引导,改进了传统方法的过拟合问题,提高了引导的准确性和稳定性。
Comments camera ready version; 55 pages, 25 figures; accepted for ICLR 2026
Journal ref Proceedings of the International Conference on Learning Representations (ICLR), 2026
AI模型的语义对齐:概念坍缩、检查点动态与跨语言迁移
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.LG
AI总结 该研究针对语言模型基准测试的难点,提出用拓扑方法将模型高维嵌入空间与可解释基线严格比较,以实现多模态对齐,追踪模型适应并测试跨语言短语理解。
Comments Code available at github.com/tylerashoff/persiscope (PyPI: persiscope)
人类能否“梦到”电子羊?用于细粒度视觉语言幻觉基准测试的人类编写样本
机构 * University of Helsinki(赫尔辛基大学) ; Politecnico di Torino(都灵理工大学) ; Universiteit Utrecht(乌得勒支大学) ; Université Bretagne Sud(南布列塔尼大学) ; University of Copenhagen(哥本哈根大学) ; University Grenoble Alpes(格勒诺布尔阿尔卑斯大学) ; University of Lorraine(洛林大学)
专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究针对模型迭代快导致幻觉评估普适性不足的问题,构建多语言人类编写幻觉样本数据集,证实其可替代模型生成样本用于细粒度视觉语言幻觉基准测试。