arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

2026-08-25 至 2026-08-25 共收录 4
2606.14782 2026-08-25 cs.CV cs.CL 版本更新

Last But Not Least: Boundary Attention CalibratiON for Multimodal KV Cache Compression

最后但同样重要:用于多模态KV缓存压缩的边界注意力校准

Tianhao Chen, Yuheng Wu, Kelu Yao, Xiaogang Xu, Xiaobin Hu, Dongman Lee

机构 * KAIST(韩国科学技术院) Zhejiang Laboratory(之江实验室) The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学)

AI总结 针对多模态大语言模型长视觉上下文中KV缓存压缩导致关键证据丢失的问题,提出BACON方法,通过校准观察窗口注意力与最后查询注意力,并利用层内一致性和层间持久性抑制噪声,在激进压缩下平均提升7.5%性能。

Comments EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05779 2026-08-25 cs.CL cs.AI 版本更新

What Models Know, How Well They Know It: Knowledge-Weighted Fine-Tuning for Learning When to Say "I Don't Know"

什么模型知道,它知道得有多好:基于知识加权的微调方法用于学习何时说“我不知道”

Joosung Lee, Hwiyeol Jo, Donghyeon Ko, Kyubyung Chae, Cheonbok Park, Jeonghoon Kim

机构 * NAVER CLOUD(NAVER云) Seoul National University(首尔国立大学) KAIST(韩国科学技术院)

AI总结 本文提出一种基于知识加权的微调方法,通过估计实例级知识评分来提升模型在知识不足时的不确定性表达能力,同时保持对已知问题的准确性。

Comments Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27530 2026-08-25 cs.CL 版本更新

A gentle tutorial on Bock's algorithm for minimum directed spanning trees with a structured reformulation

一个温和的教程和Bock算法的结构化重述:用于最小有向生成树

Yuxi Wang, Jungyeul Park

机构 * UBC(不列颠哥伦比亚大学) KAIST(韩国科学技术院)

AI总结 本文通过结构化重述Bock算法,使其更易读易复现,强调其作为非投影图依赖解析精确解码器的相关性,展示了算法的阶段结构和控制流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07356 2026-08-25 cs.CL 版本更新

Safety-Aligned Weights Are Not Enough: Refusal-Teacher-Guided Finetuning Enhances Safety and Downstream Performance under Harmful Finetuning Attacks

仅安全对齐权重不够:拒绝教师引导微调可在有害微调攻击下提升安全性与下游性能

Seokil Ham, Yubin Choi, Yujin Yang, Seungju Cho, Younghun Kim, Changick Kim

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 针对有害微调攻击威胁,该研究提出拒绝教师引导微调框架,将安全FaaS微调范式从安全对齐权重微调转为基础权重在安全教师指导下的微调,可减少有害输出并提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏