arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2026-08-31 至 2026-08-31 共收录 3
2608.27785 2026-08-31 cs.CL cs.AI 新提交

Compositional Failure in Audio-Visual LLMs: Late-Layer Prior Dominance Under Cross-modal Conflict

音频-视觉大型语言模型中的组合式失效:跨模态冲突下的深层先验主导

Adarsh Sudheer, David Li, Omar Elbanna, Ishaan Kodarapu, Arjun Bahuguna, Vasu Sharma

AI总结 本研究针对AV-LLMs,以音频-视觉冲突为组合泛化测试,发现模型存在先验主导的组合式失效,开展可解释性分析并验证时间对齐无法提升冲突解决能力,提供了相关代码与数据。

Comments Accepted to the 2nd Workshop on Compositional Learning at ICML 2026. 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27504 2026-08-31 cs.CR 新提交

Circuit Discovery Helps Detect LLM Jailbreaking: A Mechanistic Interpretability Study

电路发现助力检测大语言模型越狱:一项机制可解释性研究

Paria Mehrbod, Boris Knyazev, Guy Wolf, Eugene Belilovsky, Geraldin Nanfack

AI总结 本研究通过机制可解释性分析,在LLaMA-2-7B-chat-hf中识别出负责越狱响应的关键计算电路,剪枝这些电路可降低80%攻击成功率,为对齐LLMs的防御提供了可解释的新方向。

Comments Accepted at the 2nd Workshop on Reliable and Responsible Foundation Models of the 42nd International Conference on Machine Learning (ICML) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27460 2026-08-31 cs.CL cs.LG 新提交

Accelerating LLM Inference via Vector Index Based Output Embeddings

基于向量索引的输出嵌入加速大语言模型推理

Martin Loretz, Sepp Hochreiter

AI总结 该研究针对大语言模型推理时的输出嵌入内存瓶颈,提出用基于HNSW的向量索引替代稠密词汇投影,在保持生成质量的同时,使Gemma 3 270M的端到端解码吞吐量提升最高达82%。

Comments ICML 2026 - AdaptFM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏