arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Edinburgh(爱丁堡大学)

2026-01-09 至 2026-01-09 共收录 4
2601.04736 2026-01-09 cs.CL

AM$^3$Safety: Towards Data Efficient Alignment of Multi-modal Multi-turn Safety for MLLMs

AM$^3$Safety: 向多模态多轮安全对齐的数据高效方法

Han Zhu, Jiale Chen, Chengkun Cai, Shengjie Sun, Haoran Li, Yujin Zhou, Chi-Min Chan, Pengcheng Wen, Lei Li, Sirui Han, Yike Guo

机构 * Hong Kong University of Science and Technology(香港科技大学) Zhongshan School of Medicine, SUN YAT-SEN UNIVERSITY(中山医学院,孙中山大学) University of Edinburgh(爱丁堡大学) University of Washington(华盛顿大学)

AI总结 AM$^3$Safety通过结合冷启动拒绝阶段和组相对策略优化,有效提升多模态多轮对话的安全性,降低攻击成功率并增强模型的无害与帮助维度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04455 2026-01-09 cs.IR cs.AI cs.CL cs.LG

Re-Rankers as Relevance Judges

重排序器作为相关性判断者

Chuan Meng, Jiqun Liu, Mohammad Aliannejadi, Fengran Mo, Jeff Dalton, Maarten de Rijke

机构 * The University of Edinburgh(爱丁堡大学) University of Oklahoma(俄克拉荷马大学) University of Amsterdam(阿姆斯特丹大学)

AI总结 本文提出将重排序器作为相关性判断者的方法,通过两种适应策略在重排序任务中实现优于现有方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04272 2026-01-09 cs.AI cs.LO

Propositional Abduction via Only-Knowing: A Non-Monotonic Approach

仅知下的命题反向推理:一种非单调方法

Sanderson Molick, Vaishak Belle

机构 * Division of Humanities(人文学院) Federal Institute of Pará(巴西亚马逊州联邦研究院) School of Informatics(信息学院) University of Edinburgh(爱丁堡大学)

AI总结 本文提出了一种基于非单调逻辑的反向推理方法,通过引入偏好关系扩展了仅知逻辑,以更灵活地处理反向推理解释的选择问题。

Comments In Proceedings ICLP 2025, arXiv:2601.00047

Journal ref EPTCS 439, 2026, pp. 5-17

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23067 2026-01-09 cs.AI cs.LG

The Reward Model Selection Crisis in Personalized Alignment

个性化对齐中的奖励模型选择危机

Fady Rezk, Yuangang Pan, Chuan-Sheng Foo, Xun Xu, Nancy Chen, Henry Gouk, Timothy Hospedales

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学) Agency for Science, Technology and Research (A*STAR)(科技研究局) Samsung AI Research Center(三星人工智能研究中心)

AI总结 该研究指出当前个性化对齐方法依赖于不准确的代理指标,提出策略准确性作为评估标准,并展示简单上下文学习在大模型中优于奖励引导方法。

详情

展开后加载摘要…

URL PDF HTML 收藏