arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Southern California(南加州大学)

2026-09-01 至 2026-09-01 共收录 5
2608.29934 2026-09-01 cs.CL cs.LG 新提交

Compression-Aware Abstention: Teaching LLMs to Refuse When KV-Compression Masks Remove Answer Evidence

感知压缩的弃权:当KV压缩掩码移除答案证据时,教大型语言模型拒绝回答

Mohammadali Khodabandehlou, Bhaskar Krishnamachari

机构 * University of Southern California(南加州大学)

AI总结 该研究首次将感知压缩的弃权表述为学习问题,通过训练LoRA适配器,在减少LLM因KV缓存压缩产生的幻觉的同时保留正确回答能力,在压缩缓存解码下取得显著提升。

Comments 19 pages, 5 figures. Accepted to the GroundLM workshop at EMNLP 2026. Code, adapters, and datasets: https://github.com/mali-kh/compression-aware-abstention

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29733 2026-09-01 cs.CV 新提交

XDG: Accelerated Visual Disambiguation

XDG:加速视觉消歧

Gonglin Chen, Ben Southall, Hanyuan Xiao, Wenbin Teng, Haolin Xiong, Tianwen Fu, Junyi Ouyang, Kshitij Singh Minhas, Supun Samarasekera, Rakesh Kumar, Yajie Zhao

机构 * USC Institute for Creative Technologies(南加州大学创意技术研究所) University of Southern California(南加州大学) SRI International(SRI国际公司)

AI总结 XDG是适配可扩展SfM的高效视觉消歧模型,通过微调Depth Anything 3并复用其相机令牌实现配对分类,在保持精度的同时将推理速度提升超3倍,大幅缩短大规模场景消歧耗时。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29492 2026-09-01 cs.CL 新提交

CoCoA: Context-Conditional Cultural Alignment for Large Language Models

CoCoA:面向大语言模型的上下文条件文化对齐

Kyungdon Lee, Wei Xu, Alan Ritter, Dong-Ho Lee, JinYeong Bak

机构 * Sungkyunkwan University(成均馆大学) Georgia Institute of Technology(佐治亚理工学院) University of Southern California(南加利福尼亚大学)

AI总结 CoCoA是面向大语言模型的上下文条件文化对齐框架,通过双上下文训练等方法,可降低实体文化偏见评分且对通用性能影响小,为缓解LLMs实体文化偏见提供新方向。

Comments Accepted to Findings of EMNLP 2026. 22 pages, 4 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29397 2026-09-01 cs.CL 新提交

AlgoWorlds: Benchmarking Tool Use for Global Optimization in Algorithmic Worlds

AlgoWorlds:用于算法世界中全局优化的工具使用基准

Zixiang Xu, Jiaan Wang, Fandong Meng

机构 * Weixin AI, Tencent(腾讯微信AI) University of Southern California(南加州大学)

AI总结 本研究推出AlgoWorlds基准,评估大语言模型在算法世界中利用工具将信息转化为全局最优决策的能力,实验显示领先模型仅38.61%案例能达精确最优。

Comments Homepage: https://xzx34.github.io/AlgoWorlds/ Code: https://github.com/xzx34/AlgoWorlds

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29109 2026-09-01 cs.CL 新提交

Recognition-Refusal Misalignment in LLMs: Why Models Answer Structurally Unanswerable Questions

大语言模型中的识别-拒绝错位:为何模型会回答结构上无法解答的问题

Yucheng Du, Xiyang Hu

机构 * University of Southern California(南加州大学) Arizona State University(亚利桑那州立大学)

AI总结 该研究发现大语言模型会回答结构上无法解答的问题是因识别到不可行性的信号与安全拒绝通路未对齐,而非缺失识别能力。

Comments Accepted to EMNLP 2026 Main Conference. 29 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏